KernelAI

目錄

53個開源模型,全都在手機上執行。

由15家開發機構發布,大小從112 MB到3.11 GB。依開發機構、用途或大小篩選,下載想要的模型,並保留檔案。

53個模型

全部開源,全部完全在你的裝置上執行。

Qwen

· 14
  • Qwen 3.5 4B

    採用混合架構的最新Qwen,支援201種語言的詳細回答與多語言對話。

    2.74 GB
    新多語言
  • Qwen 3.5 2B

    適合日常工作的高效率混合架構模型,廣泛支援201種語言。

    1.28 GB
    新多語言
  • Qwen 3.5 0.8B

    精巧的混合架構模型,不到600 MB即可支援201種語言的快速工作。

    533 MB
    新多語言
  • Qwen 3 VL 2B

    精選

    支援32種語言,可分析圖片、讀取螢幕截圖中的文字,並回答有關照片的問題。

    1.11 GB
    圖片辨識推理
  • Qwen 3 4B

    支援29種以上語言的複雜問題、多步驟指示與對話。

    2.5 GB
    多語言
  • Qwen 3 VL 4B

    為圖表、示意圖、文件及複雜視覺推理工作提供進階圖片分析。

    2.5 GB
    圖片辨識推理
  • Qwen 2.5 Coder 3B

    支援92種以上程式語言的程式碼撰寫、說明與重構。

    2.1 GB
    程式設計
  • Qwen 3 4B Thinking

    展示數學、邏輯謎題與複雜問題的逐步推理。

    2.5 GB
    推理
  • Qwen 2.5 3B

    支援29種以上語言的翻譯、創作與較長文件。

    2.1 GB
    多語言網頁搜尋
  • Qwen 3 1.7B

    適合日常工作與多語言對話的均衡模型。

    1.83 GB
    多語言
  • Qwen 2.5 Coder 1.5B

    提供92種以上程式語言的快速程式碼說明、錯誤修正與補全。

    1.12 GB
    程式設計
  • Qwen 2.5 1.5B

    支援29種以上語言的日常對話、寫作協助與基本工作。

    1.12 GB
    多語言
  • Qwen 3 0.6B

    處理快速提問、簡單對話與基本工作。

    444 MB
  • Qwen 2.5 0.5B

    在速度最重要時,為非常簡單的問題提供超快回應。

    491 MB
    小型

Meta

· 2
  • Llama 3.2 3B

    精選

    在8種語言的複雜對話中提供強大的推理與詳細說明。

    2.02 GB
    多語言記憶體效率
  • Llama 3.2 1B

    快速、輕量,支援8種語言的摘要、問答與基本工作。

    808 MB
    多語言記憶體效率

Microsoft

· 2
  • Phi-4 Mini

    擅長數學、邏輯與推理,在基準測試中可與大得多的模型競爭。

    2.49 GB
    新
  • Phi-3 Mini

    使用高品質教科書資料訓練,數學與邏輯表現扎實。

    2.39 GB

Google

· 8
  • Gemma 4 E2B QAT

    精選

    Google以行動裝置為優先的多模態Gemma。能理解圖片、思考難題,使用QAT權重在這個體積下保持品質。

    2.62 GB
    新圖片辨識
  • Gemma 4 E2B

    完整品質的多模態Gemma 4。能理解圖片,並在回答前思考複雜問題。

    3.11 GB
    新圖片辨識
  • Gemma 3 4B

    精選

    適合日常對話的推理與聊天模型,記憶體使用效率高。

    2.49 GB
    記憶體效率多語言
  • Gemma 3 4B QAT

    在相同體積下,以QAT最佳化的輸出提供高水準推理與聊天品質,適合一般對話。

    2.49 GB
    新記憶體效率
  • Gemma 3 1B

    不到1 GB,支援140種以上語言,適合較不常使用的語言。

    806 MB
    多語言
  • Gemma 2 2B

    可靠的一般聊天模型,精準遵循指示。

    1.71 GB
  • CodeGemma 2B

    專為程式碼補全與中間填補工作設計。

    1.63 GB
    程式設計
  • Gemma 3 270M

    極小的253 MB模型,適合儲存空間不足時處理非常基本的工作。

    253 MB
    小型

DeepSeek

· 2
  • DeepSeek R1 1.5B

    在回答前展示詳細的逐步推理過程,很適合學習。

    1.12 GB
    推理
  • DeepSeek Coder 1.3B

    提供87種語言的快速程式碼協助。體積輕巧,但訓練資料較舊。

    874 MB
    程式設計

Stability AI

· 2
  • Stable Code 3B

    支援18種語言的程式碼撰寫與說明,具備適合程式碼審查的上下文容量。

    1.71 GB
    程式設計
  • StableLM Zephyr 3B

    可靠的一般聊天模型,回答一致且實用。

    1.71 GB

Mistral AI

· 1
  • Ministral 3B

    精選

    支援多種語言,能詳盡回答並忠實遵循指示。

    2.15 GB
    多語言網頁搜尋

01.AI

· 1
  • Yi Coder 1.5B

    不到1 GB即可提供52種語言的快速程式碼補全與除錯。

    964 MB
    程式設計

NVIDIA

· 1
  • Nemotron Mini 4B

    在較長對話中有優秀的聊天表現。

    2.7 GB

IBM

· 3
  • Granite 4.0 Micro

    精選

    指示遵循能力強、記憶體用量低,能處理複雜的多步驟工作。

    1.94 GB
    多語言記憶體效率
  • Granite 4.0 1B

    不到1 GB,即可為商務與專業工作提供可靠表現。

    901 MB
    多語言記憶體效率
  • Granite 4.0 350M

    只需223 MB,即可處理支援多語言的基本工作。

    223 MB
    小型

Hugging Face

· 4
  • SmolLM3 3B

    精選

    不到2 GB,以優秀的回答與指示遵循能力發揮超越體積的實力。

    1.92 GB
    新
  • SmolLM2 1.7B

    只比1 GB稍大,即可提供良好的對話品質與指示遵循表現。

    1.06 GB
  • SmolLM2 360M

    只需390 MB,即可提供快速回應與基本推理。

    386 MB
    小型
  • SmolLM2 135M

    供快速測試用的微型模型。想要更好的回答,請下載精選模型。

    112 MB
    小型

OpenAI

· 1
  • GPT-2

    來自2019年的歷史性GPT-2,是現代AI浪潮的起點。只支援文字補全,不支援聊天。適合用於學習與了解AI歷史。

    113 MB
    小型

Liquid AI

· 4
  • LFM2.5 VL 3B

    分析圖片並直接回答,發揮Liquid模型推理快速、記憶體用量低的優勢。

    1.67 GB
    新圖片辨識
  • LFM2.5 2.6B

    Liquid的旗艦文字模型:指示遵循能力強,支援多語言聊天,推理快速且記憶體用量低。

    1.67 GB
    新記憶體效率
  • LFM2.5 1.2B

    精選

    體積小,速度快,也很聰明。以令人驚喜的品質處理日常問題和工作。

    731 MB
    新記憶體效率
  • LFM2.5 1.2B Thinking

    以適合任何手機的體積,先逐步解決問題,再回答。

    731 MB
    推理記憶體效率

PrismML

· 4
  • Ternary Bonsai 8B

    PrismML最大的三值Bonsai模型。採用為快速裝置端推理設計的1.58位元權重,提供8B規模的回答能力。

    2.31 GB
    新
  • Bonsai 8B

    PrismML的旗艦1位元Bonsai模型。下載體積比大多數1B模型更小,卻具有8B規模,專為裝置端速度而設計。

    1.16 GB
    新記憶體效率
  • Ternary Bonsai 4B

    實驗性4B級模型,使用三值權重壓縮成適合手機下載的大小。

    1.14 GB
    新實驗性
  • Ternary Bonsai 1.7B

    實驗性精巧三值模型,適合記憶體較少的手機進行快速本機聊天。

    490 MB
    新實驗性

Community

· 4
  • Hermes 3 3B

    支援角色扮演與創意寫作,保持一致的角色語氣。

    2.02 GB
    角色扮演網頁搜尋
  • Danube 3 4B

    均衡的4B模型,可快速回應一般工作。

    2.39 GB
  • TinyLlama 1.1B

    不到700 MB的基本聊天模型,幾乎在任何裝置上都能快速執行。

    669 MB
    記憶體效率
  • Danube 3 500M

    支援多語言,為基本工作提供超快回應。

    547 MB
    小型

從哪裡開始

如何選擇模型。

  • 大小

    53個模型中,有18個小於1 GB。

    最小的模型是112 MB,最大的模型是3.11 GB。通常檔案越大,回答越好,但產生速度越慢,因此較舊的iPhone應從較小的模型開始。

  • 圖片辨識

    5個模型能讀取圖片。

    它們回答關於照片或螢幕截圖的問題,包括其中的文字。目錄中的其他模型都以文字輸入、文字輸出。

  • 下載

    透過Wi-Fi下載一次,之後就留在本機。

    從那之後,檔案保存在你的裝置上,每個回答都由手機的CPU與GPU產生。一般提示在本機處理。選用網頁搜尋依隱私權政策所述使用網路。

從一個模型開始。

免費,不需要帳號。下載模型後,關閉無線通訊也能回答問題。

下載KernelAI

53個模型。112 MB至3.11 GB。支援iOS 16.4及更新版本。