Catalogue
53 modèles open source, tous sur le téléphone.
De 112 MB à 3.11 GB, publiés par 15 laboratoires. Filtrez par fournisseur, usage ou taille, puis téléchargez ceux que vous voulez et conservez les fichiers.
53 modèles
Tous open source. Tous s’exécutent entièrement sur votre appareil.
Qwen
· 14Qwen 3.5 4B
Dernier Qwen à architecture hybride pour des réponses détaillées et des conversations multilingues dans 201 langues.
2,74 GBNouveauMultilingueQwen 3.5 2B
Modèle hybride efficace pour les tâches quotidiennes avec une large couverture linguistique (201 langues).
1,28 GBNouveauMultilingueQwen 3.5 0.8B
Modèle hybride compact pour des tâches rapides dans 201 langues, en moins de 600 MB.
533 MBNouveauMultilingueQwen 3 VL 2B
À la uneAnalyse les images, lit le texte des captures d’écran et répond aux questions sur les photos dans 32 langues.
1,11 GBVisionRéflexionQwen 3 4B
Gère les questions complexes, les instructions en plusieurs étapes et les conversations dans plus de 29 langues.
2,5 GBMultilingueQwen 3 VL 4B
Analyse avancée d’images pour les graphiques, schémas, documents et tâches complexes de raisonnement visuel.
2,5 GBVisionRéflexionQwen 2.5 Coder 3B
Écrit, explique et remanie du code dans plus de 92 langages de programmation.
2,1 GBProgrammationQwen 3 4B Thinking
Affiche un raisonnement étape par étape pour les mathématiques, les énigmes logiques et les problèmes complexes.
2,5 GBRéflexionQwen 2.5 3B
Gère la traduction, l’écriture créative et les documents longs dans plus de 29 langues.
2,1 GBMultilingueRecherche webQwen 3 1.7B
Modèle équilibré pour les tâches quotidiennes et les conversations multilingues.
1,83 GBMultilingueQwen 2.5 Coder 1.5B
Explications de code, corrections de bugs et complétions rapides dans plus de 92 langages de programmation.
1,12 GBProgrammationQwen 2.5 1.5B
Conversations quotidiennes, aide à la rédaction et tâches de base dans plus de 29 langues.
1,12 GBMultilingueQwen 3 0.6B
Gère les questions rapides, les conversations simples et les tâches de base.
444 MBQwen 2.5 0.5B
Réponses ultrarapides aux questions très simples quand la vitesse compte avant tout.
491 MBPetit
Meta
· 2Llama 3.2 3B
À la uneRaisonnement solide et explications détaillées pour des conversations complexes dans 8 langues.
2,02 GBMultilingueÉconome en RAMLlama 3.2 1B
Rapide et léger pour les résumés, les questions-réponses et les tâches de base dans 8 langues.
808 MBMultilingueÉconome en RAM
Microsoft
· 2Phi-4 Mini
Excelle en mathématiques, logique et raisonnement ; rivalise avec des modèles bien plus grands dans les tests de performance.
2,49 GBNouveauPhi-3 Mini
De bonnes performances en mathématiques et en logique, grâce à un entraînement sur des données de manuels de qualité.
2,39 GB
Gemma 4 E2B QAT
À la uneGemma multimodal de Google, conçu en priorité pour le mobile. Comprend les images et réfléchit aux questions difficiles, avec des poids QAT qui préservent la qualité à cette taille.
2,62 GBNouveauVisionGemma 4 E2B
Gemma 4 multimodal à pleine qualité. Comprend les images et réfléchit aux questions complexes avant de répondre.
3,11 GBNouveauVisionGemma 3 4B
À la uneModèle de raisonnement et de conversation avec une utilisation efficace de la mémoire pour les échanges généraux.
2,49 GBÉconome en RAMMultilingueGemma 3 4B QAT
Raisonnement et conversations de haut niveau, avec des résultats optimisés par QAT à taille égale. Idéal pour les échanges généraux.
2,49 GBNouveauÉconome en RAMGemma 3 1B
Prend en charge plus de 140 langues en moins de 1 GB, idéal pour les langues moins courantes.
806 MBMultilingueGemma 2 2B
Conversations générales fiables avec un suivi précis des instructions.
1,71 GBCodeGemma 2B
Spécialisé dans la complétion de code et le remplissage de parties intermédiaires.
1,63 GBProgrammationGemma 3 270M
Extrêmement petit (253 MB), pour des tâches très simples quand l’espace de stockage est crucial.
253 MBPetit
DeepSeek
· 2DeepSeek R1 1.5B
Affiche un raisonnement détaillé étape par étape avant de répondre. Idéal pour apprendre.
1,12 GBRéflexionDeepSeek Coder 1.3B
Aide rapide au code dans 87 langues. Léger, mais avec des données d’entraînement plus anciennes.
874 MBProgrammation
Stability AI
· 2Stable Code 3B
Écrit et explique du code dans 18 langages, avec un bon contexte pour la revue de code.
1,71 GBProgrammationStableLM Zephyr 3B
Conversations générales fiables avec des réponses cohérentes et utiles.
1,71 GB
Mistral AI
· 1Ministral 3B
À la uneRéponses détaillées et suivi rigoureux des instructions dans plusieurs langues.
2,15 GBMultilingueRecherche web
01.AI
· 1Yi Coder 1.5B
Complétion de code et débogage rapides dans 52 langues, en moins de 1 GB.
964 MBProgrammation
NVIDIA
· 1Nemotron Mini 4B
De bonnes performances pour les conversations longues.
2,7 GB
IBM
· 3Granite 4.0 Micro
À la uneGère les tâches complexes en plusieurs étapes avec un suivi rigoureux des instructions et une faible consommation de mémoire.
1,94 GBMultilingueÉconome en RAMGranite 4.0 1B
Performances fiables pour les tâches professionnelles et d’entreprise, en moins de 1 GB.
901 MBMultilingueÉconome en RAMGranite 4.0 350M
Tâches de base avec prise en charge multilingue en seulement 223 MB.
223 MBPetit
Hugging Face
· 4SmolLM3 3B
À la uneDes réponses solides et un suivi des instructions qui dépassent sa catégorie, en moins de 2 GB.
1,92 GBNouveauSmolLM2 1.7B
De bonnes conversations et un bon suivi des instructions en un peu plus de 1 GB.
1,06 GBSmolLM2 360M
Réponses rapides et raisonnement de base en seulement 390 MB.
386 MBPetitSmolLM2 135M
Tout petit modèle pour des tests rapides. Téléchargez un modèle à la une pour obtenir de meilleures réponses.
112 MBPetit
OpenAI
· 1GPT-2
GPT-2 historique de 2019, le modèle qui a lancé la vague moderne de l’IA. Complétion de texte uniquement, pas de conversation. Intéressant à des fins pédagogiques et pour l’histoire de l’IA.
113 MBPetit
Liquid AI
· 4LFM2.5 VL 3B
Analyse les images et répond directement, avec l’inférence rapide et peu gourmande en mémoire pour laquelle les modèles Liquid sont conçus.
1,67 GBNouveauVisionLFM2.5 2.6B
Le modèle de texte phare de Liquid : suivi rigoureux des instructions et conversations multilingues avec une inférence rapide et peu gourmande en mémoire.
1,67 GBNouveauÉconome en RAMLFM2.5 1.2B
À la uneRapide et intelligent dans un tout petit format. Traite les questions et tâches quotidiennes avec une qualité étonnante.
731 MBNouveauÉconome en RAMLFM2.5 1.2B Thinking
Résout les problèmes étape par étape avant de répondre, dans un format assez petit pour n’importe quel téléphone.
731 MBRéflexionÉconome en RAM
PrismML
· 4Ternary Bonsai 8B
Le plus grand modèle Bonsai ternaire de PrismML. Des réponses de niveau 8B avec des poids de 1,58 bit conçus pour une inférence rapide sur l’appareil.
2,31 GBNouveauBonsai 8B
Bonsai, le modèle phare à 1 bit de PrismML. Un téléchargement de taille 8B plus petit que la plupart des modèles 1B, conçu pour la vitesse sur l’appareil.
1,16 GBNouveauÉconome en RAMTernary Bonsai 4B
Modèle expérimental de catégorie 4B, compressé avec des poids ternaires en un téléchargement adapté au téléphone.
1,14 GBNouveauExpérimentalTernary Bonsai 1.7B
Modèle ternaire compact expérimental pour des conversations locales rapides sur les téléphones disposant de moins de mémoire.
490 MBNouveauExpérimental
Community
· 4Hermes 3 3B
Jeu de rôle et écriture créative avec des voix de personnages cohérentes.
2,02 GBJeu de rôleRecherche webDanube 3 4B
Modèle 4B équilibré avec des réponses rapides pour les tâches générales.
2,39 GBTinyLlama 1.1B
Conversation simple en moins de 700 MB : rapide sur presque tous les appareils.
669 MBÉconome en RAMDanube 3 500M
Réponses ultrarapides pour les tâches de base avec prise en charge multilingue.
547 MBPetit
Par où commencer
Comment en choisir un.
Taille
18 des 53 occupent moins d’un gigaoctet.
Le plus petit fait 112 MB et le plus grand 3.11 GB. Un fichier plus grand répond généralement mieux, mais génère plus lentement : sur un iPhone ancien, commencez donc par les petits modèles.
Vision
5 modèles lisent les images.
Ils répondent aux questions sur une photo ou une capture d’écran, y compris sur le texte qu’elle contient. Tout le reste du catalogue reçoit du texte et produit du texte.
Téléchargements
Un téléchargement en Wi-Fi, puis il reste.
Le fichier reste ensuite sur votre appareil et chaque réponse y est générée, sur le CPU et le GPU du téléphone. Les instructions ordinaires sont traitées localement. La recherche web facultative utilise le réseau, comme l’explique la politique de confidentialité.
Commencez par un modèle.
Gratuit, sans compte et, une fois un modèle téléchargé, il répond avec les connexions sans fil désactivées.
Télécharger KernelAI53 modèles. De 112 MB à 3.11 GB. iOS 16.4 ou version ultérieure.