KernelAI

Catalogue

53 modèles open source, tous sur le téléphone.

De 112 MB à 3.11 GB, publiés par 15 laboratoires. Filtrez par fournisseur, usage ou taille, puis téléchargez ceux que vous voulez et conservez les fichiers.

53 modèles

Tous open source. Tous s’exécutent entièrement sur votre appareil.

Qwen

· 14
  • Qwen 3.5 4B

    Dernier Qwen à architecture hybride pour des réponses détaillées et des conversations multilingues dans 201 langues.

    2,74 GB
    NouveauMultilingue
  • Qwen 3.5 2B

    Modèle hybride efficace pour les tâches quotidiennes avec une large couverture linguistique (201 langues).

    1,28 GB
    NouveauMultilingue
  • Qwen 3.5 0.8B

    Modèle hybride compact pour des tâches rapides dans 201 langues, en moins de 600 MB.

    533 MB
    NouveauMultilingue
  • Qwen 3 VL 2B

    À la une

    Analyse les images, lit le texte des captures d’écran et répond aux questions sur les photos dans 32 langues.

    1,11 GB
    VisionRéflexion
  • Qwen 3 4B

    Gère les questions complexes, les instructions en plusieurs étapes et les conversations dans plus de 29 langues.

    2,5 GB
    Multilingue
  • Qwen 3 VL 4B

    Analyse avancée d’images pour les graphiques, schémas, documents et tâches complexes de raisonnement visuel.

    2,5 GB
    VisionRéflexion
  • Qwen 2.5 Coder 3B

    Écrit, explique et remanie du code dans plus de 92 langages de programmation.

    2,1 GB
    Programmation
  • Qwen 3 4B Thinking

    Affiche un raisonnement étape par étape pour les mathématiques, les énigmes logiques et les problèmes complexes.

    2,5 GB
    Réflexion
  • Qwen 2.5 3B

    Gère la traduction, l’écriture créative et les documents longs dans plus de 29 langues.

    2,1 GB
    MultilingueRecherche web
  • Qwen 3 1.7B

    Modèle équilibré pour les tâches quotidiennes et les conversations multilingues.

    1,83 GB
    Multilingue
  • Qwen 2.5 Coder 1.5B

    Explications de code, corrections de bugs et complétions rapides dans plus de 92 langages de programmation.

    1,12 GB
    Programmation
  • Qwen 2.5 1.5B

    Conversations quotidiennes, aide à la rédaction et tâches de base dans plus de 29 langues.

    1,12 GB
    Multilingue
  • Qwen 3 0.6B

    Gère les questions rapides, les conversations simples et les tâches de base.

    444 MB
  • Qwen 2.5 0.5B

    Réponses ultrarapides aux questions très simples quand la vitesse compte avant tout.

    491 MB
    Petit

Meta

· 2
  • Llama 3.2 3B

    À la une

    Raisonnement solide et explications détaillées pour des conversations complexes dans 8 langues.

    2,02 GB
    MultilingueÉconome en RAM
  • Llama 3.2 1B

    Rapide et léger pour les résumés, les questions-réponses et les tâches de base dans 8 langues.

    808 MB
    MultilingueÉconome en RAM

Microsoft

· 2
  • Phi-4 Mini

    Excelle en mathématiques, logique et raisonnement ; rivalise avec des modèles bien plus grands dans les tests de performance.

    2,49 GB
    Nouveau
  • Phi-3 Mini

    De bonnes performances en mathématiques et en logique, grâce à un entraînement sur des données de manuels de qualité.

    2,39 GB

Google

· 8
  • Gemma 4 E2B QAT

    À la une

    Gemma multimodal de Google, conçu en priorité pour le mobile. Comprend les images et réfléchit aux questions difficiles, avec des poids QAT qui préservent la qualité à cette taille.

    2,62 GB
    NouveauVision
  • Gemma 4 E2B

    Gemma 4 multimodal à pleine qualité. Comprend les images et réfléchit aux questions complexes avant de répondre.

    3,11 GB
    NouveauVision
  • Gemma 3 4B

    À la une

    Modèle de raisonnement et de conversation avec une utilisation efficace de la mémoire pour les échanges généraux.

    2,49 GB
    Économe en RAMMultilingue
  • Gemma 3 4B QAT

    Raisonnement et conversations de haut niveau, avec des résultats optimisés par QAT à taille égale. Idéal pour les échanges généraux.

    2,49 GB
    NouveauÉconome en RAM
  • Gemma 3 1B

    Prend en charge plus de 140 langues en moins de 1 GB, idéal pour les langues moins courantes.

    806 MB
    Multilingue
  • Gemma 2 2B

    Conversations générales fiables avec un suivi précis des instructions.

    1,71 GB
  • CodeGemma 2B

    Spécialisé dans la complétion de code et le remplissage de parties intermédiaires.

    1,63 GB
    Programmation
  • Gemma 3 270M

    Extrêmement petit (253 MB), pour des tâches très simples quand l’espace de stockage est crucial.

    253 MB
    Petit

DeepSeek

· 2
  • DeepSeek R1 1.5B

    Affiche un raisonnement détaillé étape par étape avant de répondre. Idéal pour apprendre.

    1,12 GB
    Réflexion
  • DeepSeek Coder 1.3B

    Aide rapide au code dans 87 langues. Léger, mais avec des données d’entraînement plus anciennes.

    874 MB
    Programmation

Stability AI

· 2
  • Stable Code 3B

    Écrit et explique du code dans 18 langages, avec un bon contexte pour la revue de code.

    1,71 GB
    Programmation
  • StableLM Zephyr 3B

    Conversations générales fiables avec des réponses cohérentes et utiles.

    1,71 GB

Mistral AI

· 1
  • Ministral 3B

    À la une

    Réponses détaillées et suivi rigoureux des instructions dans plusieurs langues.

    2,15 GB
    MultilingueRecherche web

01.AI

· 1
  • Yi Coder 1.5B

    Complétion de code et débogage rapides dans 52 langues, en moins de 1 GB.

    964 MB
    Programmation

NVIDIA

· 1
  • Nemotron Mini 4B

    De bonnes performances pour les conversations longues.

    2,7 GB

IBM

· 3
  • Granite 4.0 Micro

    À la une

    Gère les tâches complexes en plusieurs étapes avec un suivi rigoureux des instructions et une faible consommation de mémoire.

    1,94 GB
    MultilingueÉconome en RAM
  • Granite 4.0 1B

    Performances fiables pour les tâches professionnelles et d’entreprise, en moins de 1 GB.

    901 MB
    MultilingueÉconome en RAM
  • Granite 4.0 350M

    Tâches de base avec prise en charge multilingue en seulement 223 MB.

    223 MB
    Petit

Hugging Face

· 4
  • SmolLM3 3B

    À la une

    Des réponses solides et un suivi des instructions qui dépassent sa catégorie, en moins de 2 GB.

    1,92 GB
    Nouveau
  • SmolLM2 1.7B

    De bonnes conversations et un bon suivi des instructions en un peu plus de 1 GB.

    1,06 GB
  • SmolLM2 360M

    Réponses rapides et raisonnement de base en seulement 390 MB.

    386 MB
    Petit
  • SmolLM2 135M

    Tout petit modèle pour des tests rapides. Téléchargez un modèle à la une pour obtenir de meilleures réponses.

    112 MB
    Petit

OpenAI

· 1
  • GPT-2

    GPT-2 historique de 2019, le modèle qui a lancé la vague moderne de l’IA. Complétion de texte uniquement, pas de conversation. Intéressant à des fins pédagogiques et pour l’histoire de l’IA.

    113 MB
    Petit

Liquid AI

· 4
  • LFM2.5 VL 3B

    Analyse les images et répond directement, avec l’inférence rapide et peu gourmande en mémoire pour laquelle les modèles Liquid sont conçus.

    1,67 GB
    NouveauVision
  • LFM2.5 2.6B

    Le modèle de texte phare de Liquid : suivi rigoureux des instructions et conversations multilingues avec une inférence rapide et peu gourmande en mémoire.

    1,67 GB
    NouveauÉconome en RAM
  • LFM2.5 1.2B

    À la une

    Rapide et intelligent dans un tout petit format. Traite les questions et tâches quotidiennes avec une qualité étonnante.

    731 MB
    NouveauÉconome en RAM
  • LFM2.5 1.2B Thinking

    Résout les problèmes étape par étape avant de répondre, dans un format assez petit pour n’importe quel téléphone.

    731 MB
    RéflexionÉconome en RAM

PrismML

· 4
  • Ternary Bonsai 8B

    Le plus grand modèle Bonsai ternaire de PrismML. Des réponses de niveau 8B avec des poids de 1,58 bit conçus pour une inférence rapide sur l’appareil.

    2,31 GB
    Nouveau
  • Bonsai 8B

    Bonsai, le modèle phare à 1 bit de PrismML. Un téléchargement de taille 8B plus petit que la plupart des modèles 1B, conçu pour la vitesse sur l’appareil.

    1,16 GB
    NouveauÉconome en RAM
  • Ternary Bonsai 4B

    Modèle expérimental de catégorie 4B, compressé avec des poids ternaires en un téléchargement adapté au téléphone.

    1,14 GB
    NouveauExpérimental
  • Ternary Bonsai 1.7B

    Modèle ternaire compact expérimental pour des conversations locales rapides sur les téléphones disposant de moins de mémoire.

    490 MB
    NouveauExpérimental

Community

· 4
  • Hermes 3 3B

    Jeu de rôle et écriture créative avec des voix de personnages cohérentes.

    2,02 GB
    Jeu de rôleRecherche web
  • Danube 3 4B

    Modèle 4B équilibré avec des réponses rapides pour les tâches générales.

    2,39 GB
  • TinyLlama 1.1B

    Conversation simple en moins de 700 MB : rapide sur presque tous les appareils.

    669 MB
    Économe en RAM
  • Danube 3 500M

    Réponses ultrarapides pour les tâches de base avec prise en charge multilingue.

    547 MB
    Petit

Par où commencer

Comment en choisir un.

  • Taille

    18 des 53 occupent moins d’un gigaoctet.

    Le plus petit fait 112 MB et le plus grand 3.11 GB. Un fichier plus grand répond généralement mieux, mais génère plus lentement : sur un iPhone ancien, commencez donc par les petits modèles.

  • Vision

    5 modèles lisent les images.

    Ils répondent aux questions sur une photo ou une capture d’écran, y compris sur le texte qu’elle contient. Tout le reste du catalogue reçoit du texte et produit du texte.

  • Téléchargements

    Un téléchargement en Wi-Fi, puis il reste.

    Le fichier reste ensuite sur votre appareil et chaque réponse y est générée, sur le CPU et le GPU du téléphone. Les instructions ordinaires sont traitées localement. La recherche web facultative utilise le réseau, comme l’explique la politique de confidentialité.

Commencez par un modèle.

Gratuit, sans compte et, une fois un modèle téléchargé, il répond avec les connexions sans fil désactivées.

Télécharger KernelAI

53 modèles. De 112 MB à 3.11 GB. iOS 16.4 ou version ultérieure.