KernelAI

카탈로그

오픈 소스 모델 53개가 모두 휴대폰에서 실행됩니다.

15개 개발사가 공개한 112 MB~3.11 GB 크기의 모델입니다. 개발사, 용도 또는 크기로 필터링한 뒤 원하는 모델을 다운로드하고 파일을 보관하십시오.

모델 53개

모두 오픈 소스입니다. 모두 기기에서만 실행됩니다.

Qwen

· 14
  • Qwen 3.5 4B

    하이브리드 구조를 갖춘 최신 Qwen으로, 201개 언어의 상세한 답변과 다국어 대화를 지원합니다.

    2.74 GB
    신규다국어
  • Qwen 3.5 2B

    일상 작업을 위한 효율적인 하이브리드 모델로, 201개 언어를 폭넓게 지원합니다.

    1.28 GB
    신규다국어
  • Qwen 3.5 0.8B

    600 MB 미만으로 201개 언어의 빠른 작업을 지원하는 소형 하이브리드 모델.

    533 MB
    신규다국어
  • Qwen 3 VL 2B

    추천

    32개 언어로 이미지를 분석하고 스크린샷의 텍스트를 읽으며 사진에 관한 질문에 답합니다.

    1.11 GB
    이미지 인식추론
  • Qwen 3 4B

    29개 이상의 언어로 복잡한 질문, 다단계 지시 및 대화를 처리합니다.

    2.5 GB
    다국어
  • Qwen 3 VL 4B

    차트, 도표, 문서 및 복잡한 시각적 추론 작업을 위한 고급 이미지 분석.

    2.5 GB
    이미지 인식추론
  • Qwen 2.5 Coder 3B

    92개 이상의 프로그래밍 언어로 코드를 작성, 설명 및 리팩터링합니다.

    2.1 GB
    코딩
  • Qwen 3 4B Thinking

    수학, 논리 퍼즐 및 복잡한 문제의 단계별 추론을 보여줍니다.

    2.5 GB
    추론
  • Qwen 2.5 3B

    29개 이상의 언어로 번역, 창작 및 긴 문서를 처리합니다.

    2.1 GB
    다국어웹 검색
  • Qwen 3 1.7B

    일상적인 작업과 다국어 대화에 적합한 균형 잡힌 모델.

    1.83 GB
    다국어
  • Qwen 2.5 Coder 1.5B

    92개 이상의 프로그래밍 언어로 빠른 코드 설명, 버그 수정 및 코드 완성을 제공합니다.

    1.12 GB
    코딩
  • Qwen 2.5 1.5B

    29개 이상의 언어로 일상 대화, 글쓰기 지원 및 기본 작업을 처리합니다.

    1.12 GB
    다국어
  • Qwen 3 0.6B

    빠른 질문, 간단한 대화 및 기본 작업을 처리합니다.

    444 MB
  • Qwen 2.5 0.5B

    속도가 가장 중요한 매우 간단한 질문에 초고속으로 답변합니다.

    491 MB
    소형

Meta

· 2
  • Llama 3.2 3B

    추천

    8개 언어의 복잡한 대화에 강력한 추론과 상세한 설명을 제공합니다.

    2.02 GB
    다국어메모리 효율
  • Llama 3.2 1B

    8개 언어로 요약, 질의응답 및 기본 작업을 빠르게 처리하는 경량 모델.

    808 MB
    다국어메모리 효율

Microsoft

· 2
  • Phi-4 Mini

    수학, 논리 및 추론에 뛰어나며 벤치마크에서 훨씬 큰 모델들과 경쟁합니다.

    2.49 GB
    신규
  • Phi-3 Mini

    고품질 교과서 데이터로 학습한 탄탄한 수학 및 논리 성능.

    2.39 GB

Google

· 8
  • Gemma 4 E2B QAT

    추천

    Google의 모바일 중심 멀티모달 Gemma입니다. 이미지를 이해하고 어려운 질문을 깊이 생각하며, 이 크기에서도 품질을 유지하는 QAT 가중치를 사용합니다.

    2.62 GB
    신규이미지 인식
  • Gemma 4 E2B

    온전한 품질의 멀티모달 Gemma 4입니다. 이미지를 이해하고 복잡한 질문을 생각한 뒤 답변합니다.

    3.11 GB
    신규이미지 인식
  • Gemma 3 4B

    추천

    일반 대화에 적합하며 메모리를 효율적으로 사용하는 추론 및 채팅 모델.

    2.49 GB
    메모리 효율다국어
  • Gemma 3 4B QAT

    같은 크기에서 QAT 최적화 출력으로 최상급 추론 및 채팅 품질을 제공합니다. 일반 대화에 적합합니다.

    2.49 GB
    신규메모리 효율
  • Gemma 3 1B

    1 GB 미만에서 140개 이상의 언어를 지원해, 덜 널리 쓰이는 언어에도 적합합니다.

    806 MB
    다국어
  • Gemma 2 2B

    지시를 정확하게 따르는 신뢰할 수 있는 일반 채팅 모델.

    1.71 GB
  • CodeGemma 2B

    코드 완성과 중간 부분 채우기 작업에 특화되어 있습니다.

    1.63 GB
    코딩
  • Gemma 3 270M

    저장 공간이 중요한 경우의 매우 기본적인 작업용으로, 253 MB의 아주 작은 모델입니다.

    253 MB
    소형

DeepSeek

· 2
  • DeepSeek R1 1.5B

    답변 전에 상세한 단계별 추론을 보여줍니다. 학습에 좋습니다.

    1.12 GB
    추론
  • DeepSeek Coder 1.3B

    87개 언어로 빠른 코드 지원을 제공합니다. 가볍지만 학습 데이터는 오래되었습니다.

    874 MB
    코딩

Stability AI

· 2
  • Stable Code 3B

    18개 언어로 코드를 작성하고 설명하며 코드 검토를 위한 충분한 컨텍스트를 제공합니다.

    1.71 GB
    코딩
  • StableLM Zephyr 3B

    일관되고 유용한 답변을 제공하는 신뢰할 수 있는 일반 채팅 모델.

    1.71 GB

Mistral AI

· 1
  • Ministral 3B

    추천

    여러 언어로 자세히 답변하고 지시를 충실하게 따릅니다.

    2.15 GB
    다국어웹 검색

01.AI

· 1
  • Yi Coder 1.5B

    1 GB 미만으로 52개 언어의 빠른 코드 완성과 디버깅을 지원합니다.

    964 MB
    코딩

NVIDIA

· 1
  • Nemotron Mini 4B

    긴 대화에서 뛰어난 채팅 성능을 제공합니다.

    2.7 GB

IBM

· 3
  • Granite 4.0 Micro

    추천

    지시를 충실하게 따르고 메모리 사용량을 줄이면서 복잡한 다단계 작업을 처리합니다.

    1.94 GB
    다국어메모리 효율
  • Granite 4.0 1B

    1 GB 미만에서 비즈니스 및 전문 작업을 안정적으로 처리합니다.

    901 MB
    다국어메모리 효율
  • Granite 4.0 350M

    223 MB만으로 다국어 기본 작업을 지원합니다.

    223 MB
    소형

Hugging Face

· 4
  • SmolLM3 3B

    추천

    2 GB 미만에서 강력한 답변과 충실한 지시 이행으로 크기 이상의 성능을 발휘합니다.

    1.92 GB
    신규
  • SmolLM2 1.7B

    1 GB를 조금 넘는 크기로 좋은 대화 품질과 충실한 지시 이행을 제공합니다.

    1.06 GB
  • SmolLM2 360M

    390 MB만으로 빠른 답변과 기본 추론을 제공합니다.

    386 MB
    소형
  • SmolLM2 135M

    빠른 시험용 초소형 모델입니다. 더 좋은 답변을 위해 추천 모델을 다운로드하십시오.

    112 MB
    소형

OpenAI

· 1
  • GPT-2

    현대 AI 물결의 시작이 된 2019년의 역사적인 GPT-2입니다. 채팅이 아닌 텍스트 완성 전용이며 교육 목적과 AI 역사 탐구에 흥미로운 모델입니다.

    113 MB
    소형

Liquid AI

· 4
  • LFM2.5 VL 3B

    이미지를 분석하고 바로 답변합니다. Liquid 모델의 빠르고 메모리 사용량이 적은 추론을 활용합니다.

    1.67 GB
    신규이미지 인식
  • LFM2.5 2.6B

    Liquid의 주력 텍스트 모델로, 빠르고 메모리 사용량이 적은 추론과 함께 충실한 지시 이행 및 다국어 채팅을 제공합니다.

    1.67 GB
    신규메모리 효율
  • LFM2.5 1.2B

    추천

    작은 크기에 빠르고 똑똑한 모델입니다. 일상적인 질문과 작업을 놀랄 만큼 좋은 품질로 처리합니다.

    731 MB
    신규메모리 효율
  • LFM2.5 1.2B Thinking

    어떤 휴대폰에도 들어갈 만큼 작은 크기로 답변 전에 문제를 단계적으로 해결합니다.

    731 MB
    추론메모리 효율

PrismML

· 4
  • Ternary Bonsai 8B

    PrismML의 가장 큰 3값 Bonsai 모델입니다. 빠른 온디바이스 추론을 위해 설계된 1.58비트 가중치로 8B급 답변을 제공합니다.

    2.31 GB
    신규
  • Bonsai 8B

    PrismML의 주력 1비트 Bonsai 모델입니다. 대부분의 1B 모델보다 작은 다운로드로 8B급을 구현하며 온디바이스 속도를 위해 설계되었습니다.

    1.16 GB
    신규메모리 효율
  • Ternary Bonsai 4B

    3값 가중치로 압축해 휴대폰에 다운로드하기 알맞은 크기로 만든 실험적 4B급 모델.

    1.14 GB
    신규실험적
  • Ternary Bonsai 1.7B

    메모리가 적은 휴대폰에서 빠른 로컬 채팅을 위한 실험적 소형 3값 모델.

    490 MB
    신규실험적

Community

· 4
  • Hermes 3 3B

    일관된 등장인물 말투를 유지하는 역할극과 창작.

    2.02 GB
    역할극웹 검색
  • Danube 3 4B

    일반적인 작업에 빠르게 답변하는 균형 잡힌 4B 모델.

    2.39 GB
  • TinyLlama 1.1B

    700 MB 미만의 기본 채팅 모델로, 거의 모든 기기에서 빠르게 실행됩니다.

    669 MB
    메모리 효율
  • Danube 3 500M

    다국어를 지원하며 기본 작업에 매우 빠르게 답변합니다.

    547 MB
    소형

시작 방법

모델 선택 방법.

  • 크기

    53개 중 18개가 1 GB 미만입니다.

    가장 작은 모델은 112 MB, 가장 큰 모델은 3.11 GB입니다. 일반적으로 파일이 클수록 더 좋은 답변을 내지만 생성 속도가 느리므로 오래된 iPhone에서는 작은 모델부터 시작하십시오.

  • 이미지 인식

    모델 5개가 이미지를 읽습니다.

    사진이나 스크린샷 속 텍스트를 포함해 해당 이미지에 관한 질문에 답합니다. 카탈로그의 다른 모델은 모두 텍스트를 입력받아 텍스트를 출력합니다.

  • 다운로드

    Wi-Fi로 한 번 다운로드하면 계속 보관됩니다.

    다운로드한 이후 파일은 기기에 보관되고 모든 답변은 휴대폰의 CPU와 GPU에서 생성됩니다. 일반 프롬프트는 로컬로 처리됩니다. 선택적 웹 검색은 개인정보 처리방침에 설명된 대로 네트워크를 사용합니다.

모델 하나로 시작하십시오.

무료이며 계정이 필요 없습니다. 모델을 다운로드하면 무선 통신을 꺼도 답변합니다.

KernelAI 다운로드

모델 53개. 112 MB~3.11 GB. iOS 16.4 이상.