कैटलॉग
53 ओपन-सोर्स मॉडल, सभी फ़ोन पर।
15 लैब से, 112 MB से 3.11 GB तक। प्रदाता, उपयोग या साइज़ के अनुसार फ़िल्टर करें। फिर मनचाहे मॉडल डाउनलोड करें और फ़ाइलें अपने पास रखें।
53 मॉडल
सभी ओपन-सोर्स हैं। सभी पूरी तरह आपके डिवाइस पर चलते हैं।
Qwen
· 14Qwen 3.5 4B
विस्तृत जवाब और 201 भाषाओं में बातचीत के लिए हाइब्रिड आर्किटेक्चर वाला नवीनतम Qwen।
2.74 GBनयाकई भाषाओं मेंQwen 3.5 2B
रोज़मर्रा के कामों के लिए कुशल हाइब्रिड मॉडल, जिसमें कई भाषाओं का समर्थन है (201 भाषाएँ)।
1.28 GBनयाकई भाषाओं मेंQwen 3.5 0.8B
600MB से कम में 201 भाषाओं में छोटे काम जल्दी करने वाला कॉम्पैक्ट हाइब्रिड मॉडल।
533 MBनयाकई भाषाओं मेंQwen 3 VL 2B
चुनिंदातस्वीरों का विश्लेषण करता है, स्क्रीनशॉट से टेक्स्ट पढ़ता है और तस्वीरों से जुड़े सवालों के जवाब 32 भाषाओं में देता है।
1.11 GBविज़नविचार प्रक्रियाQwen 3 4B
जटिल सवाल, कई चरणों वाले निर्देश और 29 से ज़्यादा भाषाओं में बातचीत संभालता है।
2.5 GBकई भाषाओं मेंQwen 3 VL 4B
चार्ट, आरेख, दस्तावेज़ और जटिल दृश्य तर्क के कामों के लिए उन्नत तस्वीर विश्लेषण।
2.5 GBविज़नविचार प्रक्रियाQwen 2.5 Coder 3B
92 से ज़्यादा प्रोग्रामिंग भाषाओं में कोड लिखता, समझाता और रिफ़ैक्टर करता है।
2.1 GBकोडिंगQwen 3 4B Thinking
गणित, तार्किक पहेलियों और जटिल समस्याओं के लिए चरण-दर-चरण तर्क दिखाता है।
2.5 GBविचार प्रक्रियाQwen 2.5 3B
29 से ज़्यादा भाषाओं में अनुवाद, रचनात्मक लेखन और लंबे दस्तावेज़ संभालता है।
2.1 GBकई भाषाओं मेंवेब सर्चQwen 3 1.7B
रोज़मर्रा के काम और कई भाषाओं में बातचीत के लिए संतुलित मॉडल।
1.83 GBकई भाषाओं मेंQwen 2.5 Coder 1.5B
92 से ज़्यादा प्रोग्रामिंग भाषाओं में तेज़ कोड समझाना, बग सुधारना और कोड पूरा करना।
1.12 GBकोडिंगQwen 2.5 1.5B
29 से ज़्यादा भाषाओं में रोज़मर्रा की बातचीत, लिखने में मदद और सामान्य काम।
1.12 GBकई भाषाओं मेंQwen 3 0.6B
छोटे सवाल, सरल बातचीत और सामान्य काम संभालता है।
444 MBQwen 2.5 0.5B
बहुत सरल सवालों के बेहद तेज़ जवाब, जब गति सबसे ज़रूरी हो।
491 MBछोटा
Meta
· 2Llama 3.2 3B
चुनिंदा8 भाषाओं में जटिल बातचीत के लिए अच्छी तर्क क्षमता और विस्तृत स्पष्टीकरण।
2.02 GBकई भाषाओं मेंकम RAM इस्तेमाल करता हैLlama 3.2 1B
8 भाषाओं में सारांश, सवाल-जवाब और सामान्य कामों के लिए तेज़ और हल्का।
808 MBकई भाषाओं मेंकम RAM इस्तेमाल करता है
Microsoft
· 2Phi-4 Mini
गणित, तर्क और विवेचना में अच्छा प्रदर्शन। बेंचमार्क पर खुद से बहुत बड़े मॉडल का मुकाबला करता है।
2.49 GBनयाPhi-3 Mini
उच्च गुणवत्ता वाली पाठ्यपुस्तकों के डेटा से प्रशिक्षित, गणित और तर्क में अच्छा प्रदर्शन।
2.39 GB
Gemma 4 E2B QAT
चुनिंदाGoogle का मोबाइल के लिए बना मल्टीमोडल Gemma। तस्वीरें समझता है और मुश्किल सवालों पर सोचता है। QAT वेट इस साइज़ में गुणवत्ता बनाए रखते हैं।
2.62 GBनयाविज़नGemma 4 E2B
पूरी गुणवत्ता वाला मल्टीमोडल Gemma 4। तस्वीरें समझता है और जवाब देने से पहले जटिल सवालों पर सोचता है।
3.11 GBनयाविज़नGemma 3 4B
चुनिंदासामान्य बातचीत के लिए कम मेमोरी इस्तेमाल करने वाला तर्क और चैट मॉडल।
2.49 GBकम RAM इस्तेमाल करता हैकई भाषाओं मेंGemma 3 4B QAT
उसी साइज़ में QAT-अनुकूलित परिणामों के साथ उच्च स्तर की तर्क क्षमता और चैट गुणवत्ता। सामान्य बातचीत के लिए अच्छा।
2.49 GBनयाकम RAM इस्तेमाल करता हैGemma 3 1B
1GB से कम में 140 से ज़्यादा भाषाओं का समर्थन, कम प्रचलित भाषाओं के लिए अच्छा।
806 MBकई भाषाओं मेंGemma 2 2B
निर्देशों का सटीक पालन करने वाली भरोसेमंद सामान्य चैट।
1.71 GBCodeGemma 2B
कोड पूरा करने और बीच में छूटे हिस्से भरने वाले कामों में विशेषज्ञ।
1.63 GBकोडिंगGemma 3 270M
स्टोरेज की कमी होने पर बहुत सामान्य कामों के लिए बेहद छोटा (253MB) मॉडल।
253 MBछोटा
DeepSeek
· 2DeepSeek R1 1.5B
जवाब देने से पहले विस्तृत, चरण-दर-चरण तर्क दिखाता है। सीखने के लिए अच्छा है।
1.12 GBविचार प्रक्रियाDeepSeek Coder 1.3B
87 भाषाओं में तेज़ कोड सहायता। हल्का है, लेकिन इसके प्रशिक्षण का डेटा पुराना है।
874 MBकोडिंग
Stability AI
· 2Stable Code 3B
18 भाषाओं में कोड लिखता और समझाता है। कोड रिव्यू के लिए अच्छा कॉन्टेक्स्ट देता है।
1.71 GBकोडिंगStableLM Zephyr 3B
लगातार उपयोगी जवाब देने वाली भरोसेमंद सामान्य चैट।
1.71 GB
Mistral AI
· 1Ministral 3B
चुनिंदाकई भाषाओं में विस्तृत जवाब और निर्देशों का अच्छी तरह पालन।
2.15 GBकई भाषाओं मेंवेब सर्च
01.AI
· 1Yi Coder 1.5B
1GB से कम में 52 भाषाओं में तेज़ कोड पूरा करना और डीबगिंग।
964 MBकोडिंग
NVIDIA
· 1Nemotron Mini 4B
लंबी बातचीत के लिए अच्छा चैट प्रदर्शन।
2.7 GB
IBM
· 3Granite 4.0 Micro
चुनिंदाकम मेमोरी में जटिल, कई चरणों वाले काम करता है और निर्देशों का अच्छी तरह पालन करता है।
1.94 GBकई भाषाओं मेंकम RAM इस्तेमाल करता हैGranite 4.0 1B
1GB से कम में व्यावसायिक और पेशेवर कामों के लिए भरोसेमंद प्रदर्शन।
901 MBकई भाषाओं मेंकम RAM इस्तेमाल करता हैGranite 4.0 350M
सिर्फ़ 223MB में सामान्य काम और कई भाषाओं का समर्थन।
223 MBछोटा
Hugging Face
· 4SmolLM3 3B
चुनिंदा2GB से कम में अच्छे जवाब और निर्देशों के पालन से अपने साइज़ से बेहतर प्रदर्शन करता है।
1.92 GBनयाSmolLM2 1.7B
1GB से थोड़ा ज़्यादा साइज़ में अच्छी बातचीत और निर्देशों का पालन।
1.06 GBSmolLM2 360M
सिर्फ़ 390MB में तेज़ जवाब और सामान्य तर्क क्षमता।
386 MBछोटाSmolLM2 135M
जल्दी जाँच करने के लिए बहुत छोटा मॉडल। बेहतर जवाब के लिए कोई चुनिंदा मॉडल डाउनलोड करें।
112 MBछोटा
OpenAI
· 1GPT-2
2019 का ऐतिहासिक GPT-2, जिससे आधुनिक AI की लहर शुरू हुई। सिर्फ़ टेक्स्ट पूरा करने के लिए है, चैट के लिए नहीं। सीखने और AI का इतिहास समझने के लिए दिलचस्प है।
113 MBछोटा
Liquid AI
· 4LFM2.5 VL 3B
तस्वीरों का विश्लेषण करता है और सीधे जवाब देता है। Liquid मॉडल जिस तेज़ और कम मेमोरी वाले इन्फ़रेंस के लिए बनाए गए हैं, वह इसमें मौजूद है।
1.67 GBनयाविज़नLFM2.5 2.6B
Liquid का प्रमुख टेक्स्ट मॉडल: निर्देशों का अच्छी तरह पालन और कई भाषाओं में चैट, तेज़ तथा कम मेमोरी वाले इन्फ़रेंस के साथ।
1.67 GBनयाकम RAM इस्तेमाल करता हैLFM2.5 1.2B
चुनिंदाछोटे से पैकेज में तेज़ और समझदार। रोज़मर्रा के सवालों और कामों में आश्चर्यजनक रूप से अच्छे परिणाम देता है।
731 MBनयाकम RAM इस्तेमाल करता हैLFM2.5 1.2B Thinking
किसी भी फ़ोन के लिए छोटे पैकेज में, जवाब देने से पहले समस्याएँ चरण-दर-चरण हल करता है।
731 MBविचार प्रक्रियाकम RAM इस्तेमाल करता है
PrismML
· 4Ternary Bonsai 8B
PrismML का सबसे बड़ा टर्नरी Bonsai मॉडल। डिवाइस पर तेज़ इन्फ़रेंस के लिए बने 1.58-बिट वेट से 8B-श्रेणी के जवाब।
2.31 GBनयाBonsai 8B
PrismML का प्रमुख 1-बिट Bonsai मॉडल। फ़ोन पर तेज़ चलने के लिए बनाया गया 8B-श्रेणी का मॉडल, जिसका डाउनलोड ज़्यादातर 1B मॉडल से छोटा है।
1.16 GBनयाकम RAM इस्तेमाल करता हैTernary Bonsai 4B
फ़ोन के लिए उपयुक्त डाउनलोड बनाने के लिए टर्नरी वेट से संकुचित किया गया प्रयोगात्मक 4B-श्रेणी मॉडल।
1.14 GBनयाप्रयोगात्मकTernary Bonsai 1.7B
कम मेमोरी वाले फ़ोन पर तेज़ लोकल चैट के लिए छोटा प्रयोगात्मक टर्नरी मॉडल।
490 MBनयाप्रयोगात्मक
Community
· 4Hermes 3 3B
एकसमान पात्र शैली के साथ भूमिका निभाना और रचनात्मक लेखन।
2.02 GBभूमिका निभानावेब सर्चDanube 3 4B
सामान्य कामों के लिए तेज़ जवाब देने वाला संतुलित 4B मॉडल।
2.39 GBTinyLlama 1.1B
700MB से कम में सामान्य चैट, जो लगभग किसी भी डिवाइस पर तेज़ चलती है।
669 MBकम RAM इस्तेमाल करता हैDanube 3 500M
कई भाषाओं के समर्थन के साथ सामान्य कामों के लिए बेहद तेज़ जवाब।
547 MBछोटा
कहाँ से शुरू करें
मॉडल कैसे चुनें।
साइज़
53 में से 18 मॉडल एक गीगाबाइट से छोटे हैं।
सबसे छोटा 112 MB और सबसे बड़ा 3.11 GB है। बड़ी फ़ाइल आम तौर पर बेहतर जवाब देती है, लेकिन उन्हें बनाने में ज़्यादा समय लेती है। इसलिए पुराने iPhone पर छोटे मॉडल से शुरुआत करें।
विज़न
5 मॉडल तस्वीरें पढ़ सकते हैं।
ये फोटो या स्क्रीनशॉट के बारे में सवालों के जवाब देते हैं, जिनमें उनमें लिखा टेक्स्ट भी शामिल है। कैटलॉग के बाकी मॉडल टेक्स्ट लेते हैं और टेक्स्ट देते हैं।
डाउनलोड
Wi-Fi से एक बार डाउनलोड करें, फिर यह आपके पास रहता है।
उसके बाद फ़ाइल आपके डिवाइस पर रहती है और हर जवाब फ़ोन के CPU और GPU पर बनता है। सामान्य प्रॉम्प्ट लोकल रूप से संसाधित होते हैं। वैकल्पिक वेब सर्च नेटवर्क इस्तेमाल करती है, जैसा गोपनीयता नीति में बताया गया है।
एक मॉडल से शुरुआत करें।
मुफ़्त, बिना अकाउंट के। मॉडल डाउनलोड होने के बाद वायरलेस कनेक्शन बंद होने पर भी जवाब देता है।
KernelAI डाउनलोड करें53 मॉडल। 112 MB से 3.11 GB तक। iOS 16.4 या उसके बाद का संस्करण।