KernelAI

Catálogo

53 modelos de código abierto, todos en el teléfono.

De 112 MB a 3.11 GB, publicados por 15 laboratorios. Filtra por proveedor, uso o tamaño, descarga los que quieras y conserva los archivos.

53 modelos

Todos de código abierto. Todos funcionan íntegramente en tu dispositivo.

Qwen

· 14
  • Qwen 3.5 4B

    Qwen más reciente con arquitectura híbrida para respuestas detalladas y conversaciones multilingües en 201 idiomas.

    2,74 GB
    NuevoMultilingüe
  • Qwen 3.5 2B

    Modelo híbrido eficiente para tareas cotidianas con amplio soporte de idiomas (201 idiomas).

    1,28 GB
    NuevoMultilingüe
  • Qwen 3.5 0.8B

    Modelo híbrido compacto para tareas rápidas en 201 idiomas y menos de 600 MB.

    533 MB
    NuevoMultilingüe
  • Qwen 3 VL 2B

    Destacados

    Analiza imágenes, lee texto de capturas de pantalla y responde preguntas sobre fotos en 32 idiomas.

    1,11 GB
    VisiónRazonamiento
  • Qwen 3 4B

    Resuelve preguntas complejas, instrucciones de varios pasos y conversaciones en más de 29 idiomas.

    2,5 GB
    Multilingüe
  • Qwen 3 VL 4B

    Análisis avanzado de imágenes para gráficos, diagramas, documentos y tareas complejas de razonamiento visual.

    2,5 GB
    VisiónRazonamiento
  • Qwen 2.5 Coder 3B

    Escribe, explica y refactoriza código en más de 92 lenguajes de programación.

    2,1 GB
    Programación
  • Qwen 3 4B Thinking

    Muestra un razonamiento paso a paso para matemáticas, acertijos de lógica y problemas complejos.

    2,5 GB
    Razonamiento
  • Qwen 2.5 3B

    Se ocupa de traducción, escritura creativa y documentos largos en más de 29 idiomas.

    2,1 GB
    MultilingüeBúsqueda web
  • Qwen 3 1.7B

    Modelo equilibrado para tareas cotidianas y conversaciones multilingües.

    1,83 GB
    Multilingüe
  • Qwen 2.5 Coder 1.5B

    Explicaciones de código, correcciones de errores y completados rápidos en más de 92 lenguajes de programación.

    1,12 GB
    Programación
  • Qwen 2.5 1.5B

    Conversaciones cotidianas, ayuda para escribir y tareas básicas en más de 29 idiomas.

    1,12 GB
    Multilingüe
  • Qwen 3 0.6B

    Resuelve preguntas rápidas, conversaciones sencillas y tareas básicas.

    444 MB
  • Qwen 2.5 0.5B

    Respuestas ultrarrápidas para preguntas muy sencillas cuando la velocidad importa más.

    491 MB
    Pequeño

Meta

· 2
  • Llama 3.2 3B

    Destacados

    Razonamiento sólido y explicaciones detalladas para conversaciones complejas en 8 idiomas.

    2,02 GB
    MultilingüeUso eficiente de RAM
  • Llama 3.2 1B

    Rápido y ligero para resúmenes, preguntas y respuestas, y tareas básicas en 8 idiomas.

    808 MB
    MultilingüeUso eficiente de RAM

Microsoft

· 2
  • Phi-4 Mini

    Destaca en matemáticas, lógica y razonamiento; compite con modelos mucho mayores en pruebas comparativas.

    2,49 GB
    Nuevo
  • Phi-3 Mini

    Buen rendimiento en matemáticas y lógica, entrenado con datos de libros de texto de alta calidad.

    2,39 GB

Google

· 8
  • Gemma 4 E2B QAT

    Destacados

    Gemma multimodal de Google, diseñado primero para móviles. Entiende imágenes y razona sobre preguntas difíciles, con pesos QAT que mantienen la calidad a este tamaño.

    2,62 GB
    NuevoVisión
  • Gemma 4 E2B

    Gemma 4 multimodal con toda su calidad. Entiende imágenes y razona sobre preguntas complejas antes de responder.

    3,11 GB
    NuevoVisión
  • Gemma 3 4B

    Destacados

    Modelo de razonamiento y chat con uso eficiente de memoria para conversaciones generales.

    2,49 GB
    Uso eficiente de RAMMultilingüe
  • Gemma 3 4B QAT

    Razonamiento y chat de primer nivel con resultados optimizados por QAT al mismo tamaño. Ideal para conversaciones generales.

    2,49 GB
    NuevoUso eficiente de RAM
  • Gemma 3 1B

    Soporta más de 140 idiomas en menos de 1 GB, ideal para idiomas menos comunes.

    806 MB
    Multilingüe
  • Gemma 2 2B

    Chat general fiable con seguimiento preciso de instrucciones.

    1,71 GB
  • CodeGemma 2B

    Especializado en completado de código y tareas de rellenado de fragmentos intermedios.

    1,63 GB
    Programación
  • Gemma 3 270M

    Extremadamente pequeño (253 MB) para tareas muy básicas cuando el almacenamiento es crucial.

    253 MB
    Pequeño

DeepSeek

· 2
  • DeepSeek R1 1.5B

    Muestra un razonamiento detallado paso a paso antes de responder. Ideal para aprender.

    1,12 GB
    Razonamiento
  • DeepSeek Coder 1.3B

    Ayuda rápida con código en 87 idiomas. Ligero, pero con datos de entrenamiento más antiguos.

    874 MB
    Programación

Stability AI

· 2
  • Stable Code 3B

    Escribe y explica código en 18 lenguajes con buen contexto para la revisión de código.

    1,71 GB
    Programación
  • StableLM Zephyr 3B

    Chat general fiable con respuestas coherentes y útiles.

    1,71 GB

Mistral AI

· 1
  • Ministral 3B

    Destacados

    Respuestas detalladas y sólido seguimiento de instrucciones en varios idiomas.

    2,15 GB
    MultilingüeBúsqueda web

01.AI

· 1
  • Yi Coder 1.5B

    Completado de código y depuración rápidos en 52 idiomas, en menos de 1 GB.

    964 MB
    Programación

NVIDIA

· 1
  • Nemotron Mini 4B

    Buen rendimiento de chat para conversaciones largas.

    2,7 GB

IBM

· 3
  • Granite 4.0 Micro

    Destacados

    Resuelve tareas complejas de varios pasos con sólido seguimiento de instrucciones y bajo uso de memoria.

    1,94 GB
    MultilingüeUso eficiente de RAM
  • Granite 4.0 1B

    Rendimiento fiable para tareas empresariales y profesionales en menos de 1 GB.

    901 MB
    MultilingüeUso eficiente de RAM
  • Granite 4.0 350M

    Tareas básicas con soporte multilingüe en solo 223 MB.

    223 MB
    Pequeño

Hugging Face

· 4
  • SmolLM3 3B

    Destacados

    Rinde por encima de su tamaño con respuestas sólidas y seguimiento de instrucciones en menos de 2 GB.

    1,92 GB
    Nuevo
  • SmolLM2 1.7B

    Buenas conversaciones y seguimiento de instrucciones en poco más de 1 GB.

    1,06 GB
  • SmolLM2 360M

    Respuestas rápidas y razonamiento básico en solo 390 MB.

    386 MB
    Pequeño
  • SmolLM2 135M

    Modelo diminuto para pruebas rápidas. Descarga un modelo destacado para obtener mejores respuestas.

    112 MB
    Pequeño

OpenAI

· 1
  • GPT-2

    GPT-2 histórico de 2019, el modelo que inició la ola moderna de IA. Solo completa texto (no es un chat). Interesante para fines educativos y para la historia de la IA.

    113 MB
    Pequeño

Liquid AI

· 4
  • LFM2.5 VL 3B

    Analiza imágenes y responde directamente, con la inferencia rápida y de bajo consumo de memoria para la que están diseñados los modelos de Liquid.

    1,67 GB
    NuevoVisión
  • LFM2.5 2.6B

    El modelo de texto principal de Liquid: sólido seguimiento de instrucciones y chat multilingüe con inferencia rápida y de bajo consumo de memoria.

    1,67 GB
    NuevoUso eficiente de RAM
  • LFM2.5 1.2B

    Destacados

    Rápido e inteligente en un paquete pequeño. Resuelve preguntas y tareas cotidianas con una calidad sorprendente.

    731 MB
    NuevoUso eficiente de RAM
  • LFM2.5 1.2B Thinking

    Resuelve los problemas paso a paso antes de responder, en un paquete lo bastante pequeño para cualquier teléfono.

    731 MB
    RazonamientoUso eficiente de RAM

PrismML

· 4
  • Ternary Bonsai 8B

    El mayor modelo Bonsai ternario de PrismML. Respuestas de escala 8B con pesos de 1,58 bits diseñados para inferencia rápida en el dispositivo.

    2,31 GB
    Nuevo
  • Bonsai 8B

    Bonsai, el modelo de 1 bit principal de PrismML. Una descarga de escala 8B más pequeña que la mayoría de los modelos de 1B, diseñada para la velocidad en el dispositivo.

    1,16 GB
    NuevoUso eficiente de RAM
  • Ternary Bonsai 4B

    Modelo experimental de la clase 4B comprimido con pesos ternarios en una descarga adecuada para teléfonos.

    1,14 GB
    NuevoExperimental
  • Ternary Bonsai 1.7B

    Modelo ternario compacto experimental para chat local rápido en teléfonos con menos memoria.

    490 MB
    NuevoExperimental

Community

· 4
  • Hermes 3 3B

    Juego de rol y escritura creativa con voces de personajes coherentes.

    2,02 GB
    Juego de rolBúsqueda web
  • Danube 3 4B

    Modelo equilibrado de 4B con respuestas rápidas para tareas generales.

    2,39 GB
  • TinyLlama 1.1B

    Chat básico en menos de 700 MB: funciona rápido en casi cualquier dispositivo.

    669 MB
    Uso eficiente de RAM
  • Danube 3 500M

    Respuestas ultrarrápidas para tareas básicas con soporte multilingüe.

    547 MB
    Pequeño

Por dónde empezar

Cómo elegir uno.

  • Tamaño

    18 de los 53 ocupan menos de un gigabyte.

    El más pequeño ocupa 112 MB y el mayor, 3.11 GB. Un archivo más grande suele responder mejor y generar más despacio, así que en un iPhone antiguo conviene empezar por los pequeños.

  • Visión

    5 modelos leen imágenes.

    Responden preguntas sobre una foto o captura de pantalla, incluido el texto que contiene. El resto del catálogo admite texto y devuelve texto.

  • Descargas

    Una descarga por Wi-Fi y se queda contigo.

    A partir de entonces, el archivo permanece en tu dispositivo y cada respuesta se genera allí, en la CPU y GPU del teléfono. Las instrucciones normales se procesan localmente. La búsqueda web opcional usa la red, como describe la política de privacidad.

Empieza con un modelo.

Gratis, sin cuenta y, una vez descargado un modelo, responde con las conexiones inalámbricas desactivadas.

Descargar KernelAI

53 modelos. De 112 MB a 3.11 GB. iOS 16.4 o posterior.