53個模型
全部開源,全部完全在你的裝置上執行。
Qwen
· 14Qwen 3.5 4B
採用混合架構的最新Qwen,支援201種語言的詳細回答與多語言對話。
2.74 GB新多語言Qwen 3.5 2B
適合日常工作的高效率混合架構模型,廣泛支援201種語言。
1.28 GB新多語言Qwen 3.5 0.8B
精巧的混合架構模型,不到600 MB即可支援201種語言的快速工作。
533 MB新多語言Qwen 3 VL 2B
精選支援32種語言,可分析圖片、讀取螢幕截圖中的文字,並回答有關照片的問題。
1.11 GB圖片辨識推理Qwen 3 4B
支援29種以上語言的複雜問題、多步驟指示與對話。
2.5 GB多語言Qwen 3 VL 4B
為圖表、示意圖、文件及複雜視覺推理工作提供進階圖片分析。
2.5 GB圖片辨識推理Qwen 2.5 Coder 3B
支援92種以上程式語言的程式碼撰寫、說明與重構。
2.1 GB程式設計Qwen 3 4B Thinking
展示數學、邏輯謎題與複雜問題的逐步推理。
2.5 GB推理Qwen 2.5 3B
支援29種以上語言的翻譯、創作與較長文件。
2.1 GB多語言網頁搜尋Qwen 3 1.7B
適合日常工作與多語言對話的均衡模型。
1.83 GB多語言Qwen 2.5 Coder 1.5B
提供92種以上程式語言的快速程式碼說明、錯誤修正與補全。
1.12 GB程式設計Qwen 2.5 1.5B
支援29種以上語言的日常對話、寫作協助與基本工作。
1.12 GB多語言Qwen 3 0.6B
處理快速提問、簡單對話與基本工作。
444 MBQwen 2.5 0.5B
在速度最重要時,為非常簡單的問題提供超快回應。
491 MB小型
Meta
· 2Llama 3.2 3B
精選在8種語言的複雜對話中提供強大的推理與詳細說明。
2.02 GB多語言記憶體效率Llama 3.2 1B
快速、輕量,支援8種語言的摘要、問答與基本工作。
808 MB多語言記憶體效率
Microsoft
· 2Phi-4 Mini
擅長數學、邏輯與推理,在基準測試中可與大得多的模型競爭。
2.49 GB新Phi-3 Mini
使用高品質教科書資料訓練,數學與邏輯表現扎實。
2.39 GB
Gemma 4 E2B QAT
精選Google以行動裝置為優先的多模態Gemma。能理解圖片、思考難題,使用QAT權重在這個體積下保持品質。
2.62 GB新圖片辨識Gemma 4 E2B
完整品質的多模態Gemma 4。能理解圖片,並在回答前思考複雜問題。
3.11 GB新圖片辨識Gemma 3 4B
精選適合日常對話的推理與聊天模型,記憶體使用效率高。
2.49 GB記憶體效率多語言Gemma 3 4B QAT
在相同體積下,以QAT最佳化的輸出提供高水準推理與聊天品質,適合一般對話。
2.49 GB新記憶體效率Gemma 3 1B
不到1 GB,支援140種以上語言,適合較不常使用的語言。
806 MB多語言Gemma 2 2B
可靠的一般聊天模型,精準遵循指示。
1.71 GBCodeGemma 2B
專為程式碼補全與中間填補工作設計。
1.63 GB程式設計Gemma 3 270M
極小的253 MB模型,適合儲存空間不足時處理非常基本的工作。
253 MB小型
DeepSeek
· 2DeepSeek R1 1.5B
在回答前展示詳細的逐步推理過程,很適合學習。
1.12 GB推理DeepSeek Coder 1.3B
提供87種語言的快速程式碼協助。體積輕巧,但訓練資料較舊。
874 MB程式設計
Stability AI
· 2Stable Code 3B
支援18種語言的程式碼撰寫與說明,具備適合程式碼審查的上下文容量。
1.71 GB程式設計StableLM Zephyr 3B
可靠的一般聊天模型,回答一致且實用。
1.71 GB
Mistral AI
· 1Ministral 3B
精選支援多種語言,能詳盡回答並忠實遵循指示。
2.15 GB多語言網頁搜尋
01.AI
· 1Yi Coder 1.5B
不到1 GB即可提供52種語言的快速程式碼補全與除錯。
964 MB程式設計
NVIDIA
· 1Nemotron Mini 4B
在較長對話中有優秀的聊天表現。
2.7 GB
IBM
· 3Granite 4.0 Micro
精選指示遵循能力強、記憶體用量低,能處理複雜的多步驟工作。
1.94 GB多語言記憶體效率Granite 4.0 1B
不到1 GB,即可為商務與專業工作提供可靠表現。
901 MB多語言記憶體效率Granite 4.0 350M
只需223 MB,即可處理支援多語言的基本工作。
223 MB小型
Hugging Face
· 4SmolLM3 3B
精選不到2 GB,以優秀的回答與指示遵循能力發揮超越體積的實力。
1.92 GB新SmolLM2 1.7B
只比1 GB稍大,即可提供良好的對話品質與指示遵循表現。
1.06 GBSmolLM2 360M
只需390 MB,即可提供快速回應與基本推理。
386 MB小型SmolLM2 135M
供快速測試用的微型模型。想要更好的回答,請下載精選模型。
112 MB小型
OpenAI
· 1GPT-2
來自2019年的歷史性GPT-2,是現代AI浪潮的起點。只支援文字補全,不支援聊天。適合用於學習與了解AI歷史。
113 MB小型
Liquid AI
· 4LFM2.5 VL 3B
分析圖片並直接回答,發揮Liquid模型推理快速、記憶體用量低的優勢。
1.67 GB新圖片辨識LFM2.5 2.6B
Liquid的旗艦文字模型:指示遵循能力強,支援多語言聊天,推理快速且記憶體用量低。
1.67 GB新記憶體效率LFM2.5 1.2B
精選體積小,速度快,也很聰明。以令人驚喜的品質處理日常問題和工作。
731 MB新記憶體效率LFM2.5 1.2B Thinking
以適合任何手機的體積,先逐步解決問題,再回答。
731 MB推理記憶體效率
PrismML
· 4Ternary Bonsai 8B
PrismML最大的三值Bonsai模型。採用為快速裝置端推理設計的1.58位元權重,提供8B規模的回答能力。
2.31 GB新Bonsai 8B
PrismML的旗艦1位元Bonsai模型。下載體積比大多數1B模型更小,卻具有8B規模,專為裝置端速度而設計。
1.16 GB新記憶體效率Ternary Bonsai 4B
實驗性4B級模型,使用三值權重壓縮成適合手機下載的大小。
1.14 GB新實驗性Ternary Bonsai 1.7B
實驗性精巧三值模型,適合記憶體較少的手機進行快速本機聊天。
490 MB新實驗性
Community
· 4Hermes 3 3B
支援角色扮演與創意寫作,保持一致的角色語氣。
2.02 GB角色扮演網頁搜尋Danube 3 4B
均衡的4B模型,可快速回應一般工作。
2.39 GBTinyLlama 1.1B
不到700 MB的基本聊天模型,幾乎在任何裝置上都能快速執行。
669 MB記憶體效率Danube 3 500M
支援多語言,為基本工作提供超快回應。
547 MB小型
從哪裡開始
如何選擇模型。
大小
53個模型中,有18個小於1 GB。
最小的模型是112 MB,最大的模型是3.11 GB。通常檔案越大,回答越好,但產生速度越慢,因此較舊的iPhone應從較小的模型開始。
圖片辨識
5個模型能讀取圖片。
它們回答關於照片或螢幕截圖的問題,包括其中的文字。目錄中的其他模型都以文字輸入、文字輸出。
下載
透過Wi-Fi下載一次,之後就留在本機。
從那之後,檔案保存在你的裝置上,每個回答都由手機的CPU與GPU產生。一般提示在本機處理。選用網頁搜尋依隱私權政策所述使用網路。