Catálogo
53 modelos de código abierto, todos en el teléfono.
De 112 MB a 3.11 GB, publicados por 15 laboratorios. Filtra por proveedor, uso o tamaño, descarga los que quieras y conserva los archivos.
53 modelos
Todos de código abierto. Todos funcionan íntegramente en tu dispositivo.
Qwen
· 14Qwen 3.5 4B
Qwen más reciente con arquitectura híbrida para respuestas detalladas y conversaciones multilingües en 201 idiomas.
2,74 GBNuevoMultilingüeQwen 3.5 2B
Modelo híbrido eficiente para tareas cotidianas con amplio soporte de idiomas (201 idiomas).
1,28 GBNuevoMultilingüeQwen 3.5 0.8B
Modelo híbrido compacto para tareas rápidas en 201 idiomas y menos de 600 MB.
533 MBNuevoMultilingüeQwen 3 VL 2B
DestacadosAnaliza imágenes, lee texto de capturas de pantalla y responde preguntas sobre fotos en 32 idiomas.
1,11 GBVisiónRazonamientoQwen 3 4B
Resuelve preguntas complejas, instrucciones de varios pasos y conversaciones en más de 29 idiomas.
2,5 GBMultilingüeQwen 3 VL 4B
Análisis avanzado de imágenes para gráficos, diagramas, documentos y tareas complejas de razonamiento visual.
2,5 GBVisiónRazonamientoQwen 2.5 Coder 3B
Escribe, explica y refactoriza código en más de 92 lenguajes de programación.
2,1 GBProgramaciónQwen 3 4B Thinking
Muestra un razonamiento paso a paso para matemáticas, acertijos de lógica y problemas complejos.
2,5 GBRazonamientoQwen 2.5 3B
Se ocupa de traducción, escritura creativa y documentos largos en más de 29 idiomas.
2,1 GBMultilingüeBúsqueda webQwen 3 1.7B
Modelo equilibrado para tareas cotidianas y conversaciones multilingües.
1,83 GBMultilingüeQwen 2.5 Coder 1.5B
Explicaciones de código, correcciones de errores y completados rápidos en más de 92 lenguajes de programación.
1,12 GBProgramaciónQwen 2.5 1.5B
Conversaciones cotidianas, ayuda para escribir y tareas básicas en más de 29 idiomas.
1,12 GBMultilingüeQwen 3 0.6B
Resuelve preguntas rápidas, conversaciones sencillas y tareas básicas.
444 MBQwen 2.5 0.5B
Respuestas ultrarrápidas para preguntas muy sencillas cuando la velocidad importa más.
491 MBPequeño
Meta
· 2Llama 3.2 3B
DestacadosRazonamiento sólido y explicaciones detalladas para conversaciones complejas en 8 idiomas.
2,02 GBMultilingüeUso eficiente de RAMLlama 3.2 1B
Rápido y ligero para resúmenes, preguntas y respuestas, y tareas básicas en 8 idiomas.
808 MBMultilingüeUso eficiente de RAM
Microsoft
· 2Phi-4 Mini
Destaca en matemáticas, lógica y razonamiento; compite con modelos mucho mayores en pruebas comparativas.
2,49 GBNuevoPhi-3 Mini
Buen rendimiento en matemáticas y lógica, entrenado con datos de libros de texto de alta calidad.
2,39 GB
Gemma 4 E2B QAT
DestacadosGemma multimodal de Google, diseñado primero para móviles. Entiende imágenes y razona sobre preguntas difíciles, con pesos QAT que mantienen la calidad a este tamaño.
2,62 GBNuevoVisiónGemma 4 E2B
Gemma 4 multimodal con toda su calidad. Entiende imágenes y razona sobre preguntas complejas antes de responder.
3,11 GBNuevoVisiónGemma 3 4B
DestacadosModelo de razonamiento y chat con uso eficiente de memoria para conversaciones generales.
2,49 GBUso eficiente de RAMMultilingüeGemma 3 4B QAT
Razonamiento y chat de primer nivel con resultados optimizados por QAT al mismo tamaño. Ideal para conversaciones generales.
2,49 GBNuevoUso eficiente de RAMGemma 3 1B
Soporta más de 140 idiomas en menos de 1 GB, ideal para idiomas menos comunes.
806 MBMultilingüeGemma 2 2B
Chat general fiable con seguimiento preciso de instrucciones.
1,71 GBCodeGemma 2B
Especializado en completado de código y tareas de rellenado de fragmentos intermedios.
1,63 GBProgramaciónGemma 3 270M
Extremadamente pequeño (253 MB) para tareas muy básicas cuando el almacenamiento es crucial.
253 MBPequeño
DeepSeek
· 2DeepSeek R1 1.5B
Muestra un razonamiento detallado paso a paso antes de responder. Ideal para aprender.
1,12 GBRazonamientoDeepSeek Coder 1.3B
Ayuda rápida con código en 87 idiomas. Ligero, pero con datos de entrenamiento más antiguos.
874 MBProgramación
Stability AI
· 2Stable Code 3B
Escribe y explica código en 18 lenguajes con buen contexto para la revisión de código.
1,71 GBProgramaciónStableLM Zephyr 3B
Chat general fiable con respuestas coherentes y útiles.
1,71 GB
Mistral AI
· 1Ministral 3B
DestacadosRespuestas detalladas y sólido seguimiento de instrucciones en varios idiomas.
2,15 GBMultilingüeBúsqueda web
01.AI
· 1Yi Coder 1.5B
Completado de código y depuración rápidos en 52 idiomas, en menos de 1 GB.
964 MBProgramación
NVIDIA
· 1Nemotron Mini 4B
Buen rendimiento de chat para conversaciones largas.
2,7 GB
IBM
· 3Granite 4.0 Micro
DestacadosResuelve tareas complejas de varios pasos con sólido seguimiento de instrucciones y bajo uso de memoria.
1,94 GBMultilingüeUso eficiente de RAMGranite 4.0 1B
Rendimiento fiable para tareas empresariales y profesionales en menos de 1 GB.
901 MBMultilingüeUso eficiente de RAMGranite 4.0 350M
Tareas básicas con soporte multilingüe en solo 223 MB.
223 MBPequeño
Hugging Face
· 4SmolLM3 3B
DestacadosRinde por encima de su tamaño con respuestas sólidas y seguimiento de instrucciones en menos de 2 GB.
1,92 GBNuevoSmolLM2 1.7B
Buenas conversaciones y seguimiento de instrucciones en poco más de 1 GB.
1,06 GBSmolLM2 360M
Respuestas rápidas y razonamiento básico en solo 390 MB.
386 MBPequeñoSmolLM2 135M
Modelo diminuto para pruebas rápidas. Descarga un modelo destacado para obtener mejores respuestas.
112 MBPequeño
OpenAI
· 1GPT-2
GPT-2 histórico de 2019, el modelo que inició la ola moderna de IA. Solo completa texto (no es un chat). Interesante para fines educativos y para la historia de la IA.
113 MBPequeño
Liquid AI
· 4LFM2.5 VL 3B
Analiza imágenes y responde directamente, con la inferencia rápida y de bajo consumo de memoria para la que están diseñados los modelos de Liquid.
1,67 GBNuevoVisiónLFM2.5 2.6B
El modelo de texto principal de Liquid: sólido seguimiento de instrucciones y chat multilingüe con inferencia rápida y de bajo consumo de memoria.
1,67 GBNuevoUso eficiente de RAMLFM2.5 1.2B
DestacadosRápido e inteligente en un paquete pequeño. Resuelve preguntas y tareas cotidianas con una calidad sorprendente.
731 MBNuevoUso eficiente de RAMLFM2.5 1.2B Thinking
Resuelve los problemas paso a paso antes de responder, en un paquete lo bastante pequeño para cualquier teléfono.
731 MBRazonamientoUso eficiente de RAM
PrismML
· 4Ternary Bonsai 8B
El mayor modelo Bonsai ternario de PrismML. Respuestas de escala 8B con pesos de 1,58 bits diseñados para inferencia rápida en el dispositivo.
2,31 GBNuevoBonsai 8B
Bonsai, el modelo de 1 bit principal de PrismML. Una descarga de escala 8B más pequeña que la mayoría de los modelos de 1B, diseñada para la velocidad en el dispositivo.
1,16 GBNuevoUso eficiente de RAMTernary Bonsai 4B
Modelo experimental de la clase 4B comprimido con pesos ternarios en una descarga adecuada para teléfonos.
1,14 GBNuevoExperimentalTernary Bonsai 1.7B
Modelo ternario compacto experimental para chat local rápido en teléfonos con menos memoria.
490 MBNuevoExperimental
Community
· 4Hermes 3 3B
Juego de rol y escritura creativa con voces de personajes coherentes.
2,02 GBJuego de rolBúsqueda webDanube 3 4B
Modelo equilibrado de 4B con respuestas rápidas para tareas generales.
2,39 GBTinyLlama 1.1B
Chat básico en menos de 700 MB: funciona rápido en casi cualquier dispositivo.
669 MBUso eficiente de RAMDanube 3 500M
Respuestas ultrarrápidas para tareas básicas con soporte multilingüe.
547 MBPequeño
Por dónde empezar
Cómo elegir uno.
Tamaño
18 de los 53 ocupan menos de un gigabyte.
El más pequeño ocupa 112 MB y el mayor, 3.11 GB. Un archivo más grande suele responder mejor y generar más despacio, así que en un iPhone antiguo conviene empezar por los pequeños.
Visión
5 modelos leen imágenes.
Responden preguntas sobre una foto o captura de pantalla, incluido el texto que contiene. El resto del catálogo admite texto y devuelve texto.
Descargas
Una descarga por Wi-Fi y se queda contigo.
A partir de entonces, el archivo permanece en tu dispositivo y cada respuesta se genera allí, en la CPU y GPU del teléfono. Las instrucciones normales se procesan localmente. La búsqueda web opcional usa la red, como describe la política de privacidad.
Empieza con un modelo.
Gratis, sin cuenta y, una vez descargado un modelo, responde con las conexiones inalámbricas desactivadas.
Descargar KernelAI53 modelos. De 112 MB a 3.11 GB. iOS 16.4 o posterior.