KernelAI

Catálogo

53 modelos de código aberto, todos no telefone.

De 112 MB a 3.11 GB, publicados por 15 laboratórios. Filtre por fornecedor, finalidade ou tamanho, depois descarregue os que quiser e mantenha os ficheiros.

53 modelos

Todos de código aberto. Todos funcionam inteiramente no seu dispositivo.

Qwen

· 14
  • Qwen 3.5 4B

    Qwen mais recente com arquitetura híbrida para respostas detalhadas e conversas multilingues em 201 idiomas.

    2,74 GB
    NovoMultilingue
  • Qwen 3.5 2B

    Modelo híbrido eficiente para tarefas quotidianas com amplo suporte de idiomas (201 idiomas).

    1,28 GB
    NovoMultilingue
  • Qwen 3.5 0.8B

    Modelo híbrido compacto para tarefas rápidas em 201 idiomas, com menos de 600 MB.

    533 MB
    NovoMultilingue
  • Qwen 3 VL 2B

    Em destaque

    Analisa imagens, lê texto de capturas de ecrã e responde a perguntas sobre fotos em 32 idiomas.

    1,11 GB
    VisãoRaciocínio
  • Qwen 3 4B

    Trata perguntas complexas, instruções de várias etapas e conversas em mais de 29 idiomas.

    2,5 GB
    Multilingue
  • Qwen 3 VL 4B

    Análise avançada de imagens para gráficos, diagramas, documentos e tarefas complexas de raciocínio visual.

    2,5 GB
    VisãoRaciocínio
  • Qwen 2.5 Coder 3B

    Escreve, explica e refatora código em mais de 92 linguagens de programação.

    2,1 GB
    Programação
  • Qwen 3 4B Thinking

    Mostra raciocínio passo a passo para matemática, enigmas de lógica e problemas complexos.

    2,5 GB
    Raciocínio
  • Qwen 2.5 3B

    Trata tradução, escrita criativa e documentos mais longos em mais de 29 idiomas.

    2,1 GB
    MultilinguePesquisa web
  • Qwen 3 1.7B

    Modelo equilibrado para tarefas quotidianas e conversas multilingues.

    1,83 GB
    Multilingue
  • Qwen 2.5 Coder 1.5B

    Explicações de código, correções de erros e conclusões rápidas em mais de 92 linguagens de programação.

    1,12 GB
    Programação
  • Qwen 2.5 1.5B

    Conversas quotidianas, ajuda na escrita e tarefas básicas em mais de 29 idiomas.

    1,12 GB
    Multilingue
  • Qwen 3 0.6B

    Trata perguntas rápidas, conversas simples e tarefas básicas.

    444 MB
  • Qwen 2.5 0.5B

    Respostas ultrarrápidas a perguntas muito simples quando a velocidade é o mais importante.

    491 MB
    Pequeno

Meta

· 2
  • Llama 3.2 3B

    Em destaque

    Raciocínio sólido e explicações detalhadas para conversas complexas em 8 idiomas.

    2,02 GB
    MultilingueUso eficiente de RAM
  • Llama 3.2 1B

    Rápido e leve para resumos, perguntas e respostas, e tarefas básicas em 8 idiomas.

    808 MB
    MultilingueUso eficiente de RAM

Microsoft

· 2
  • Phi-4 Mini

    Destaca-se em matemática, lógica e raciocínio, competindo com modelos muito maiores em testes comparativos.

    2,49 GB
    Novo
  • Phi-3 Mini

    Bom desempenho em matemática e lógica, treinado com dados de manuais de alta qualidade.

    2,39 GB

Google

· 8
  • Gemma 4 E2B QAT

    Em destaque

    Gemma multimodal da Google, concebido prioritariamente para dispositivos móveis. Compreende imagens e raciocina sobre perguntas difíceis, com pesos QAT que mantêm a qualidade neste tamanho.

    2,62 GB
    NovoVisão
  • Gemma 4 E2B

    Gemma 4 multimodal com qualidade total. Compreende imagens e raciocina sobre perguntas complexas antes de responder.

    3,11 GB
    NovoVisão
  • Gemma 3 4B

    Em destaque

    Modelo de raciocínio e conversação com uso eficiente de memória para conversas gerais.

    2,49 GB
    Uso eficiente de RAMMultilingue
  • Gemma 3 4B QAT

    Raciocínio e qualidade de conversação de alto nível, com resultados otimizados por QAT no mesmo tamanho. Ótimo para conversas gerais.

    2,49 GB
    NovoUso eficiente de RAM
  • Gemma 3 1B

    Suporta mais de 140 idiomas em menos de 1 GB, ideal para idiomas menos comuns.

    806 MB
    Multilingue
  • Gemma 2 2B

    Conversas gerais fiáveis com seguimento preciso de instruções.

    1,71 GB
  • CodeGemma 2B

    Especializado em conclusão de código e preenchimento de trechos intermédios.

    1,63 GB
    Programação
  • Gemma 3 270M

    Extremamente pequeno (253 MB) para tarefas muito básicas quando o armazenamento é crucial.

    253 MB
    Pequeno

DeepSeek

· 2
  • DeepSeek R1 1.5B

    Mostra um raciocínio detalhado passo a passo antes de responder. Ótimo para aprender.

    1,12 GB
    Raciocínio
  • DeepSeek Coder 1.3B

    Ajuda rápida com código em 87 idiomas. Leve, mas com dados de treino mais antigos.

    874 MB
    Programação

Stability AI

· 2
  • Stable Code 3B

    Escreve e explica código em 18 linguagens, com bom contexto para revisão de código.

    1,71 GB
    Programação
  • StableLM Zephyr 3B

    Conversas gerais fiáveis com respostas consistentes e úteis.

    1,71 GB

Mistral AI

· 1
  • Ministral 3B

    Em destaque

    Respostas detalhadas e bom seguimento de instruções em vários idiomas.

    2,15 GB
    MultilinguePesquisa web

01.AI

· 1
  • Yi Coder 1.5B

    Conclusão de código e depuração rápidas em 52 idiomas, com menos de 1 GB.

    964 MB
    Programação

NVIDIA

· 1
  • Nemotron Mini 4B

    Bom desempenho de conversação para diálogos mais longos.

    2,7 GB

IBM

· 3
  • Granite 4.0 Micro

    Em destaque

    Trata tarefas complexas de várias etapas com bom seguimento de instruções e baixo uso de memória.

    1,94 GB
    MultilingueUso eficiente de RAM
  • Granite 4.0 1B

    Desempenho fiável para tarefas empresariais e profissionais em menos de 1 GB.

    901 MB
    MultilingueUso eficiente de RAM
  • Granite 4.0 350M

    Tarefas básicas com suporte multilingue em apenas 223 MB.

    223 MB
    Pequeno

Hugging Face

· 4
  • SmolLM3 3B

    Em destaque

    Supera a sua categoria de tamanho com respostas sólidas e bom seguimento de instruções em menos de 2 GB.

    1,92 GB
    Novo
  • SmolLM2 1.7B

    Boas conversas e bom seguimento de instruções em pouco mais de 1 GB.

    1,06 GB
  • SmolLM2 360M

    Respostas rápidas e raciocínio básico em apenas 390 MB.

    386 MB
    Pequeno
  • SmolLM2 135M

    Modelo minúsculo para testes rápidos. Descarregue um modelo em destaque para obter melhores respostas.

    112 MB
    Pequeno

OpenAI

· 1
  • GPT-2

    GPT-2 histórico de 2019, o modelo que iniciou a vaga moderna da IA. Apenas conclusão de texto, não conversação. Interessante para fins educativos e para a história da IA.

    113 MB
    Pequeno

Liquid AI

· 4
  • LFM2.5 VL 3B

    Analisa imagens e responde diretamente, com a inferência rápida e de baixo consumo de memória para a qual os modelos da Liquid foram concebidos.

    1,67 GB
    NovoVisão
  • LFM2.5 2.6B

    O principal modelo de texto da Liquid: bom seguimento de instruções e conversas multilingues com inferência rápida e de baixo consumo de memória.

    1,67 GB
    NovoUso eficiente de RAM
  • LFM2.5 1.2B

    Em destaque

    Rápido e inteligente num pacote pequeno. Trata perguntas e tarefas quotidianas com qualidade surpreendente.

    731 MB
    NovoUso eficiente de RAM
  • LFM2.5 1.2B Thinking

    Resolve os problemas passo a passo antes de responder, num pacote suficientemente pequeno para qualquer telefone.

    731 MB
    RaciocínioUso eficiente de RAM

PrismML

· 4
  • Ternary Bonsai 8B

    O maior modelo ternário Bonsai da PrismML. Respostas de escala 8B com pesos de 1,58 bits concebidos para inferência rápida no dispositivo.

    2,31 GB
    Novo
  • Bonsai 8B

    Bonsai, o principal modelo de 1 bit da PrismML. Uma transferência de escala 8B mais pequena do que a maioria dos modelos 1B, concebida para velocidade no dispositivo.

    1,16 GB
    NovoUso eficiente de RAM
  • Ternary Bonsai 4B

    Modelo experimental de classe 4B, comprimido com pesos ternários para uma transferência adequada ao telefone.

    1,14 GB
    NovoExperimental
  • Ternary Bonsai 1.7B

    Modelo ternário compacto experimental para conversas locais rápidas em telefones com menos memória.

    490 MB
    NovoExperimental

Community

· 4
  • Hermes 3 3B

    Interpretação de papéis e escrita criativa com vozes de personagens consistentes.

    2,02 GB
    Interpretação de papéisPesquisa web
  • Danube 3 4B

    Modelo equilibrado de 4B com respostas rápidas para tarefas gerais.

    2,39 GB
  • TinyLlama 1.1B

    Conversas básicas em menos de 700 MB, com execução rápida em quase qualquer dispositivo.

    669 MB
    Uso eficiente de RAM
  • Danube 3 500M

    Respostas ultrarrápidas para tarefas básicas com suporte multilingue.

    547 MB
    Pequeno

Por onde começar

Como escolher um.

  • Tamanho

    18 dos 53 ocupam menos de um gigabyte.

    O mais pequeno tem 112 MB e o maior 3.11 GB. Um ficheiro maior normalmente responde melhor, mas gera mais devagar, por isso num iPhone mais antigo é melhor começar pelos pequenos.

  • Visão

    5 modelos leem imagens.

    Respondem a perguntas sobre uma foto ou captura de ecrã, incluindo o texto que contém. Tudo o resto no catálogo recebe texto e devolve texto.

  • Transferências

    Uma transferência por Wi-Fi e fica.

    A partir daí, o ficheiro permanece no dispositivo e cada resposta é gerada ali, na CPU e GPU do telefone. As instruções normais são processadas localmente. A pesquisa web opcional usa a rede, como descrito na política de privacidade.

Comece com um modelo.

Gratuito, sem conta e, depois de descarregar um modelo, responde com as ligações sem fios desligadas.

Descarregar KernelAI

53 modelos. De 112 MB a 3.11 GB. iOS 16.4 ou posterior.