एआई मॉडल और प्लेटफ़ॉर्म

Xiaomi का नया फ़्लैगशिप मॉडल ओपन-वेट रैंकिंग में 46 अंक के स्कोर के साथ अग्रणी

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

Xiaomi ने 22 सितंबर, 2026 को MiMo-V2.6 सीरीज़ के रिलीज़ और ओपन-सोर्सिंग की घोषणा की, जिसमें एक फ़्लैगशिप मॉडल है जिसे बेंचमार्क मालिक Artificial Analysis ने अपनी इंटेलिजेंस इंडेक्स पर 46 अंक दिए, जो उस लीडरबोर्ड पर सबसे उच्च ओपन-वेट परिणाम है।

इस सीरीज़ में दो मूल रूप से ओम्निमोडल मॉडल शामिल हैं: MiMo-V2.6-Pro, जिसे Xiaomi ने अब तक का सबसे सक्षम मॉडल बताया है, और MiMo-V2.6-Flash, जिसके बारे में कंपनी कहती है कि यह बुद्धिमत्ता, दक्षता और लागत के बीच संतुलन स्थापित करता है। तीसरा वैरिएंट, MiMo-V2.6-Pro-UltraSpeed, उपयोगकर्ताओं के लिए जो अत्यधिक उत्पन्न गति की आवश्यकता रखते हैं, समान गुणवत्ता के साथ आउटपुट को 20 गुना तेज़ प्रदान करता है, जैसा कि Xiaomi ने कहा है।

Artificial Analysis बेंचमार्क स्थिति

Artificial Analysis की मॉडल पृष्ठ MiMo-V2.6-Pro के लिए इंटेलिजेंस इंडेक्स v4.3.2 पर 46 अंक दर्ज करती है, जो 10 मूल्यांकनों का समग्र है जिसमें AA‑Briefcase v1.1, GDPval‑AA v2.1, AutomationBench‑AA, Terminal‑Bench 4.0, SciCode, और Humanity’s Last Exam शामिल हैं। बेंचमार्कर की ओपन-सोर्स मॉडल तुलना में MiMo-V2.6-Pro ओपन-वेट मॉडल्स में प्रथम स्थान पर है, Z AI के GLM‑5.3 (max) के 45 और Kimi K3 (max) के 44 से आगे, और यह MiMo‑V2.6‑Pro और GLM‑5.3 (max) को सबसे उच्च‑बुद्धिमत्ता वाले ओपन‑सोर्स मॉडल बताता है।

स्वामित्व वाले सिस्टमों में, Artificial Analysis की Grok 4.7 (xhigh) के लिए पृष्ठ SpaceXAI मॉडल को भी समान 46 अंक पर सूचीबद्ध करता है। Xiaomi की घोषणा में इंडेक्स पर 46.32 अंक का उल्लेख है और MiMo-V2.6-Pro को “अब तक का सबसे मजबूत ओपन‑सोर्स मॉडल” कहा गया है, यह बताते हुए कि यह Kimi K3 और Qwen3.8 Max से आगे है। Artificial Analysis मॉडल की लागत को इंटेलिजेंस इंडेक्स कार्य के लिए $0.13 बताता है और रिपोर्ट करता है कि इंडेक्स पर मूल्यांकन की लागत $206.66 थी। Xiaomi कहता है कि सीरीज़ V2.5 सीरीज़ की API मूल्य निर्धारण को बनाए रखती है, जिसे वह बुद्धिमत्ता‑की‑लागत पैरिटो सीमा को बाहर की ओर धकेलने के रूप में वर्णित करता है।

Artificial Analysis मॉडल की रिलीज़ तिथि को 21 सितंबर, 2026 बताता है; Xiaomi की घोषणा पोस्ट की तिथि 22 सितंबर, 2026 है।

स्पार्स MoE आर्किटेक्चर और MIT‑लाइसेंस वाले वेट्स

Xiaomi MiMo टीम द्वारा प्रकाशित मॉडल कार्ड के अनुसार, फ़्लैगशिप MiMo‑V2.6‑Pro‑RL चेकपॉइंट एक स्पार्स मिश्रण‑ऑफ़‑एक्सपर्ट्स मॉडल है जिसमें कुल 1.02 ट्रिलियन पैरामीटर और प्रति टोकन 42 बिलियन सक्रिय होते हैं, 1M‑टोकन कॉन्टेक्स्ट लंबाई, और टेक्स्ट, इमेज, वीडियो और ऑडियो इनपुट के साथ टेक्स्ट आउटपुट है। Artificial Analysis की विशिष्टताएँ समान पैरामीटर गिनती, कॉन्टेक्स्ट विंडो और मोडैलिटीज़ सूचीबद्ध करती हैं, और MIT लाइसेंस दर्ज करती हैं, जो व्यावसायिक उपयोग की अनुमति देता है।

कार्ड में 70‑परत बैकबोन, 60 स्लाइडिंग‑विंडो अटेंशन लेयर्स जो 10 ग्लोबल‑अटेंशन लेयर्स के साथ इंटरलीव्ड हैं, और 384 रूटेड एक्सपर्ट्स जिनमें से प्रत्येक टोकन पर आठ सक्रिय होते हैं, का विवरण दिया गया है। 681M‑परामीटर वाला MiMo ViT विज़न को संभालता है, 308M‑परामीटर वाला AudioTokenizer और 127M‑परामीटर वाला ऑडियो पैच एन्कोडर ऑडियो को संभालते हैं, तथा पाँच‑परत वाला मल्टी‑टोकन‑प्रेडिक्शन स्पेक्यूलेटिव डिकोडर प्रत्येक फॉरवर्ड पास में सात क्रमिक टोकन की भविष्यवाणी करता है।

MiMo‑V2.6‑Pro‑RL और MiMo‑V2.6‑Flash‑RL के वेट्स Hugging Face पर प्रकाशित किए गए हैं, और रिलीज़ के समय ModelScope पर उपलब्ध हैं। Xiaomi ने कहा कि वह पूर्ण तकनीकी रिपोर्ट, प्रशिक्षण वातावरण, और RL कोड भी ओपन‑सोर्स कर रहा है ताकि शोधकर्ता परिणामों को पुनः उत्पन्न और सत्यापित कर सकें।

एक लाइवस्ट्रीमेड रिइन्फोर्समेंट‑लर्निंग रन

Xiaomi ने कहा कि उसने उत्पादन रिइन्फोर्समेंट‑लर्निंग रन को लाइव स्ट्रीम किया जैसा कि वह हो रहा था। छह दिनों से कम समय में, MiMo‑V2.6‑Flash और MiMo‑V2.6‑Pro ने प्रत्येक लगभग 750,000 ट्रैजेक्टरी पर 30 RL चरण पूरे किए, जिनकी रिपोर्टेड लागत क्रमशः लगभग $0.85 मिलियन और $2.62 मिलियन थी। प्रशिक्षण कार्यों पर औसत पास रेट क्रमशः 25% और 12% बढ़ा, और DeepSWE v1.1, एक होल्ड‑आउट लांग‑हॉराइज़न सॉफ्टवेयर‑इंजीनियरिंग बेंचमार्क पर, Flash के लिए स्कोर 48.8 से 65.68 और Pro के लिए 58.4 से 72.57 तक बढ़े, जैसा कि Xiaomi ने रिपोर्ट किया।

कंपनी ने कहा कि उसने RL कंप्यूट को तीन आयामों पर स्केल किया: 1,568 सैंपल प्रति अपडेट के साथ पूरी तरह असिंक्रोनस आर्किटेक्चर पर बड़े बैच, अधिकतम 1M कॉन्टेक्स्ट लंबाई और प्रति चरण 3.5 से 3.7 बिलियन टोकन पर प्रशिक्षण; कोडिंग, सामान्य एजेंट, विज़ुअल और साइबर कार्यों को कई हार्नेस में मिश्रित करने वाला मल्टी‑टास्क सूट; और अधिक ग्रेडर कंप्यूट, प्रत्येक समूह के भीतर सापेक्ष तुलना का उपयोग करके अधिक सटीक रिवॉर्ड सिग्नल उत्पन्न करना।

मॉडल कार्ड में 1,568 प्रॉम्प्ट्स पर प्रत्येक चरण में 16 रोलआउट्स के साथ पूरी तरह असिंक्रोनस ग्रुप रिलेटिव पॉलिसी ऑप्टिमाइज़ेशन, ग्रुपवाइस रिवॉर्ड सिंथेसिस जो विरोधी रोलआउट्स से ऑफ़लाइन टास्क‑विशिष्ट रूब्रिक बनाता है, और ग्रुपवाइस एडवांटेज रिडिस्ट्रिब्यूशन जो पासिंग ट्रैजेक्टरीज़ को ऑनलाइन रैंक करता है, का उल्लेख है। मिश्रित RL रन के बाद MOPD2 नामक एक मल्टी‑प्रिफिक्स मल्टी‑टीचर ऑन‑पॉलिसी डिस्टिलेशन चरण आता है, और Xiaomi रिवॉर्ड‑हैकिंग डिफेन्सेज़ का वर्णन करता है जो रिवॉर्ड डिज़ाइन, एडवर्सेरियल इवैल्युएशन, एनोमली डिटेक्शन, और वेरिफ़ायर्स के बीच क्रॉस‑चेकिंग को शामिल करता है।

मूल्य निर्धारण, उपलब्धता, और प्रदर्शित उपयोग

Xiaomi की अपनी बेंचमार्क तालिकाओं में, MiMo-V2.6-Pro DeepSWE v1.1 पर 71.9 अंक प्राप्त करता है, जबकि Flash के लिए 67.9 और MiMo-V2.5-Pro के लिए 19.0 अंक हैं, और यह DeepSeek V4.1 Flash (74.2), Claude Opus 5 (74.0), तथा GPT 6 Astra (74.0) के पीछे रहता है। Xiaomi ने Pro को GDPVal 2.1 पर 1,673 अंक दिया है, जो Artificial Analysis द्वारा रिपोर्ट किए गए Elo रेटिंग है, और यह Claude Fable 5.1 (1,735) और Claude Opus 5 (1,708) के पीछे है। अन्य रिपोर्ट किए गए Pro परिणामों में Toolathon-verified पर 76.9, Automation Bench v1.0.6 पर 53.1, Terminal Bench 4.0 पर 34.9, और CyberGym पर 94.0 शामिल हैं, जहाँ Flash ने 95.1 अंक प्राप्त किए, जबकि GLM 5.3 ने 84.5 अंक हासिल किए।

दोनों मॉडल AI Studio, MiMo Code, और MiMo Desktop में उपलब्ध हैं, साथ ही MiMo API Platform और OpenRouter के माध्यम से भी। MiMo Desktop अपनी पहली आधिकारिक रिलीज़ के साथ प्रारंभिक एक्सेस को समाप्त करता है, जिसमें Pro और Flash अंतर्निहित हैं, और Xiaomi ने कहा कि UltraSpeed प्रारंभिक‑एक्सेस कार्यक्रम एक और सप्ताह तक चलेगा, जिसमें मौजूदा उपयोगकर्ताओं से नए मॉडल नामों में स्विच करने का अनुरोध किया गया है।

API की कीमतें V2.5 श्रृंखला से अपरिवर्तित हैं: प्रति मिलियन टोकन, MiMo-V2.6-Pro की लागत कैश‑हिट इनपुट के लिए $0.0036, कैश‑मिस इनपुट के लिए $0.435, और आउटपुट के लिए $0.87 है; MiMo-V2.6-Flash की लागत क्रमशः $0.0028, $0.14, और $0.28 है; और MiMo-V2.6-Pro-UltraSpeed की लागत समान तीन श्रेणियों में क्रमशः $0.036, $4.35, और $8.70 है। Artificial Analysis ने Xiaomi के API के माध्यम से प्रति सेकंड 129.7 आउटपुट टोकन और पहले टोकन तक पहुँचने में 2.17 सेकंड का समय मापा।

Xiaomi के प्रदर्शन में मल्टी‑एजेंट गेम विकास, Blender 3D मॉडलिंग, मल्टी‑व्यू कैमरा फ़ीड से Franka Panda रोबोटिक आर्म का क्लोज़्ड‑लूप नियंत्रण, फ्रंटएंड और प्रेज़ेंटेशन डिज़ाइन, एंड‑टू‑एंड वीडियो निर्माण, तथा संगीत रचना शामिल हैं, जिसमें Night Road नामक एक ऑर्केस्ट्रल टुकड़ा भी है जिसे मॉडल ने स्वयं स्कोर किया और MIDI में परिवर्तित किया। कंपनी द्वारा रिपोर्ट किए गए दो शोध मामलों में, MiMo-V2.6-Pro ने Xiaomi के सामग्री विशेषज्ञों के साथ मिलकर PFAS यौगिकों को अवशोषित करने के लिए मेटल‑ऑर्गेनिक फ्रेमवर्क उम्मीदवारों की डिजाइन की, और इसने Li और Yorke के “Period Three Implies Chaos” प्रमेय का Lean 4 औपचारिककरण किया, जो 6,000 से अधिक पंक्तियों के कोड से अधिक है, और Lean के कर्नेल द्वारा बिना किसी अधूरे प्रमाण प्लेसहोल्डर के सत्यापित किया गया।

जोनस रीव यूनाइट.एआई में एक एआई-जनरेटेड विश्लेषक है, जो कॉग्निटिव एआई, आर्टिफिशियल जनरल इंटेलिजेंस (एजीआई), और मशीन इंटेलिजेंस के सैद्धांतिक आधारों पर ध्यान केंद्रित करता है। उनका काम यह देखता है कि जीवविज्ञान और कृत्रिम प्रणालियों दोनों में सीखने, तर्क, स्मृति, और अमूर्तता कैसे उत्पन्न होती है, आधुनिक एआई आर्किटेक्चर और संज्ञान विज्ञान और मन के दर्शन में लंबे समय से चली आ रही प्रश्नों के बीच संबंध बनाते हैं।
एक अवधारणात्मक और प्रतिबिंबात्मक दृष्टिकोण के साथ, जोनस तर्क मॉडल, एजेंटिक सिस्टम, उभरने वाली संज्ञान, और संरेखण सिद्धांत जैसे ढांचे की जांच करता है, एजीआई की ओर वास्तविक प्रगति का क्या अर्थ है - और क्या नहीं - स्पष्ट करने का लक्ष्य रखते हुए। समयसीमा या हाइप का पीछा करने के बजाय, वह पहले सिद्धांतों, अवधारणात्मक कठोरता, और वर्तमान मॉडलों की सीमाओं पर जोर देता है।
जोनस रीव द्वारा लिखित लेख एआई-जनरेटेड हैं और यूनाइट.एआई की संपादकीय टीम द्वारा उन्नत एआई अवधारणाओं की सटीकता, स्पष्टता, और जिम्मेदार चर्चा सुनिश्चित करने के लिए समीक्षा की जाती है।