Catálogo
53 modelos de código aberto, todos no telefone.
De 112 MB a 3.11 GB, publicados por 15 laboratórios. Filtre por fornecedor, finalidade ou tamanho, depois descarregue os que quiser e mantenha os ficheiros.
53 modelos
Todos de código aberto. Todos funcionam inteiramente no seu dispositivo.
Qwen
· 14Qwen 3.5 4B
Qwen mais recente com arquitetura híbrida para respostas detalhadas e conversas multilingues em 201 idiomas.
2,74 GBNovoMultilingueQwen 3.5 2B
Modelo híbrido eficiente para tarefas quotidianas com amplo suporte de idiomas (201 idiomas).
1,28 GBNovoMultilingueQwen 3.5 0.8B
Modelo híbrido compacto para tarefas rápidas em 201 idiomas, com menos de 600 MB.
533 MBNovoMultilingueQwen 3 VL 2B
Em destaqueAnalisa imagens, lê texto de capturas de ecrã e responde a perguntas sobre fotos em 32 idiomas.
1,11 GBVisãoRaciocínioQwen 3 4B
Trata perguntas complexas, instruções de várias etapas e conversas em mais de 29 idiomas.
2,5 GBMultilingueQwen 3 VL 4B
Análise avançada de imagens para gráficos, diagramas, documentos e tarefas complexas de raciocínio visual.
2,5 GBVisãoRaciocínioQwen 2.5 Coder 3B
Escreve, explica e refatora código em mais de 92 linguagens de programação.
2,1 GBProgramaçãoQwen 3 4B Thinking
Mostra raciocínio passo a passo para matemática, enigmas de lógica e problemas complexos.
2,5 GBRaciocínioQwen 2.5 3B
Trata tradução, escrita criativa e documentos mais longos em mais de 29 idiomas.
2,1 GBMultilinguePesquisa webQwen 3 1.7B
Modelo equilibrado para tarefas quotidianas e conversas multilingues.
1,83 GBMultilingueQwen 2.5 Coder 1.5B
Explicações de código, correções de erros e conclusões rápidas em mais de 92 linguagens de programação.
1,12 GBProgramaçãoQwen 2.5 1.5B
Conversas quotidianas, ajuda na escrita e tarefas básicas em mais de 29 idiomas.
1,12 GBMultilingueQwen 3 0.6B
Trata perguntas rápidas, conversas simples e tarefas básicas.
444 MBQwen 2.5 0.5B
Respostas ultrarrápidas a perguntas muito simples quando a velocidade é o mais importante.
491 MBPequeno
Meta
· 2Llama 3.2 3B
Em destaqueRaciocínio sólido e explicações detalhadas para conversas complexas em 8 idiomas.
2,02 GBMultilingueUso eficiente de RAMLlama 3.2 1B
Rápido e leve para resumos, perguntas e respostas, e tarefas básicas em 8 idiomas.
808 MBMultilingueUso eficiente de RAM
Microsoft
· 2Phi-4 Mini
Destaca-se em matemática, lógica e raciocínio, competindo com modelos muito maiores em testes comparativos.
2,49 GBNovoPhi-3 Mini
Bom desempenho em matemática e lógica, treinado com dados de manuais de alta qualidade.
2,39 GB
Gemma 4 E2B QAT
Em destaqueGemma multimodal da Google, concebido prioritariamente para dispositivos móveis. Compreende imagens e raciocina sobre perguntas difíceis, com pesos QAT que mantêm a qualidade neste tamanho.
2,62 GBNovoVisãoGemma 4 E2B
Gemma 4 multimodal com qualidade total. Compreende imagens e raciocina sobre perguntas complexas antes de responder.
3,11 GBNovoVisãoGemma 3 4B
Em destaqueModelo de raciocínio e conversação com uso eficiente de memória para conversas gerais.
2,49 GBUso eficiente de RAMMultilingueGemma 3 4B QAT
Raciocínio e qualidade de conversação de alto nível, com resultados otimizados por QAT no mesmo tamanho. Ótimo para conversas gerais.
2,49 GBNovoUso eficiente de RAMGemma 3 1B
Suporta mais de 140 idiomas em menos de 1 GB, ideal para idiomas menos comuns.
806 MBMultilingueGemma 2 2B
Conversas gerais fiáveis com seguimento preciso de instruções.
1,71 GBCodeGemma 2B
Especializado em conclusão de código e preenchimento de trechos intermédios.
1,63 GBProgramaçãoGemma 3 270M
Extremamente pequeno (253 MB) para tarefas muito básicas quando o armazenamento é crucial.
253 MBPequeno
DeepSeek
· 2DeepSeek R1 1.5B
Mostra um raciocínio detalhado passo a passo antes de responder. Ótimo para aprender.
1,12 GBRaciocínioDeepSeek Coder 1.3B
Ajuda rápida com código em 87 idiomas. Leve, mas com dados de treino mais antigos.
874 MBProgramação
Stability AI
· 2Stable Code 3B
Escreve e explica código em 18 linguagens, com bom contexto para revisão de código.
1,71 GBProgramaçãoStableLM Zephyr 3B
Conversas gerais fiáveis com respostas consistentes e úteis.
1,71 GB
Mistral AI
· 1Ministral 3B
Em destaqueRespostas detalhadas e bom seguimento de instruções em vários idiomas.
2,15 GBMultilinguePesquisa web
01.AI
· 1Yi Coder 1.5B
Conclusão de código e depuração rápidas em 52 idiomas, com menos de 1 GB.
964 MBProgramação
NVIDIA
· 1Nemotron Mini 4B
Bom desempenho de conversação para diálogos mais longos.
2,7 GB
IBM
· 3Granite 4.0 Micro
Em destaqueTrata tarefas complexas de várias etapas com bom seguimento de instruções e baixo uso de memória.
1,94 GBMultilingueUso eficiente de RAMGranite 4.0 1B
Desempenho fiável para tarefas empresariais e profissionais em menos de 1 GB.
901 MBMultilingueUso eficiente de RAMGranite 4.0 350M
Tarefas básicas com suporte multilingue em apenas 223 MB.
223 MBPequeno
Hugging Face
· 4SmolLM3 3B
Em destaqueSupera a sua categoria de tamanho com respostas sólidas e bom seguimento de instruções em menos de 2 GB.
1,92 GBNovoSmolLM2 1.7B
Boas conversas e bom seguimento de instruções em pouco mais de 1 GB.
1,06 GBSmolLM2 360M
Respostas rápidas e raciocínio básico em apenas 390 MB.
386 MBPequenoSmolLM2 135M
Modelo minúsculo para testes rápidos. Descarregue um modelo em destaque para obter melhores respostas.
112 MBPequeno
OpenAI
· 1GPT-2
GPT-2 histórico de 2019, o modelo que iniciou a vaga moderna da IA. Apenas conclusão de texto, não conversação. Interessante para fins educativos e para a história da IA.
113 MBPequeno
Liquid AI
· 4LFM2.5 VL 3B
Analisa imagens e responde diretamente, com a inferência rápida e de baixo consumo de memória para a qual os modelos da Liquid foram concebidos.
1,67 GBNovoVisãoLFM2.5 2.6B
O principal modelo de texto da Liquid: bom seguimento de instruções e conversas multilingues com inferência rápida e de baixo consumo de memória.
1,67 GBNovoUso eficiente de RAMLFM2.5 1.2B
Em destaqueRápido e inteligente num pacote pequeno. Trata perguntas e tarefas quotidianas com qualidade surpreendente.
731 MBNovoUso eficiente de RAMLFM2.5 1.2B Thinking
Resolve os problemas passo a passo antes de responder, num pacote suficientemente pequeno para qualquer telefone.
731 MBRaciocínioUso eficiente de RAM
PrismML
· 4Ternary Bonsai 8B
O maior modelo ternário Bonsai da PrismML. Respostas de escala 8B com pesos de 1,58 bits concebidos para inferência rápida no dispositivo.
2,31 GBNovoBonsai 8B
Bonsai, o principal modelo de 1 bit da PrismML. Uma transferência de escala 8B mais pequena do que a maioria dos modelos 1B, concebida para velocidade no dispositivo.
1,16 GBNovoUso eficiente de RAMTernary Bonsai 4B
Modelo experimental de classe 4B, comprimido com pesos ternários para uma transferência adequada ao telefone.
1,14 GBNovoExperimentalTernary Bonsai 1.7B
Modelo ternário compacto experimental para conversas locais rápidas em telefones com menos memória.
490 MBNovoExperimental
Community
· 4Hermes 3 3B
Interpretação de papéis e escrita criativa com vozes de personagens consistentes.
2,02 GBInterpretação de papéisPesquisa webDanube 3 4B
Modelo equilibrado de 4B com respostas rápidas para tarefas gerais.
2,39 GBTinyLlama 1.1B
Conversas básicas em menos de 700 MB, com execução rápida em quase qualquer dispositivo.
669 MBUso eficiente de RAMDanube 3 500M
Respostas ultrarrápidas para tarefas básicas com suporte multilingue.
547 MBPequeno
Por onde começar
Como escolher um.
Tamanho
18 dos 53 ocupam menos de um gigabyte.
O mais pequeno tem 112 MB e o maior 3.11 GB. Um ficheiro maior normalmente responde melhor, mas gera mais devagar, por isso num iPhone mais antigo é melhor começar pelos pequenos.
Visão
5 modelos leem imagens.
Respondem a perguntas sobre uma foto ou captura de ecrã, incluindo o texto que contém. Tudo o resto no catálogo recebe texto e devolve texto.
Transferências
Uma transferência por Wi-Fi e fica.
A partir daí, o ficheiro permanece no dispositivo e cada resposta é gerada ali, na CPU e GPU do telefone. As instruções normais são processadas localmente. A pesquisa web opcional usa a rede, como descrito na política de privacidade.
Comece com um modelo.
Gratuito, sem conta e, depois de descarregar um modelo, responde com as ligações sem fios desligadas.
Descarregar KernelAI53 modelos. De 112 MB a 3.11 GB. iOS 16.4 ou posterior.