एआई मॉडल और प्लेटफ़ॉर्म

मूनशॉट खोलता है किमी के3 वेट्स राजस्व-टियर्ड लाइसेंस के तहत

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

मूनशॉट एआई ने 27 जुलाई, 2026 को किमी के3 के लिए पूर्ण मॉडल वेट्स प्रकाशित किए, बीजिंग लैब द्वारा मॉडल को होस्टेड सेवा के रूप में लॉन्च करने के ग्यारह दिन बाद। वेट्स और तकनीकी रिपोर्ट हगिंग फेस और गिटहब पर एक साथ अपलोड किए गए, कंपनी द्वारा किमी के3 लाइसेंस कहे जाने वाले एक अनुकूलित सेट के नियमों के तहत।

किमी के3 एक मिश्रण-ऑफ-एक्सपर्ट्स मॉडल है जिसमें 2.8 ट्रिलियन कुल पैरामीटर हैं, जिनमें से 104 बिलियन प्रत्येक टोकन पर सक्रिय होते हैं। यह एक 1-मिलियन-टोकन कонтेक्स्ट विंडो लेता है, मूनशॉट द्वारा मूनविटी-वी2 कहे जाने वाले एक विजन एन्कोडर के माध्यम से मूल रूप से टेक्स्ट और छवियों को लेता है, और प्रत्येक टोकन को 16 विशेषज्ञों में से 896 में रूट करता है। मूनशॉट इसे 3-ट्रिलियन-पैरामीटर क्लास में दुनिया का पहला खुला मॉडल बताता है।

आर्किटेक्चर वह जगह है जहां लैब ने अपना काम केंद्रित किया है। किमी डेल्टा अटेंशन मॉडल की 93 परतों में से 69 को संभालता है, इसके साथ 24 गेटेड लेटेंट-अटेंशन परतें हैं, और लैब द्वारा अटेंशन रेसिड्यूअल्स कहे जाने वाले एक तंत्र गहराई के साथ-साथ एकरूप रूप से जमा करने के बजाय चयनात्मक रूप से प्रतिनिधित्व पुनर्प्राप्त करता है। मूनशॉट बताता है कि यह संयोजन, इसके स्टेबल लेटेंट-मोइ रूटिंग के साथ जोड़कर, किमी के2 की तुलना में स्केलिंग दक्षता में लगभग 2.5 गुना सुधार देता है।

लाइसेंस क्या अनुमति देता है

किमी के3 लाइसेंस अपने अधिकांश भाग के लिए एमआईटी की तरह पढ़ता है। यह किसी को भी, नि:शुल्क, सॉफ्टवेयर का उपयोग करने, कॉपी करने, संशोधित करने, वितरित करने, सबलाइसेंस करने और बेचने का अधिकार देता है, और वजन से चलने, तैनात करने, फाइन-ट्यून करने या व्युत्पन्न कार्य बनाने का अधिकार देता है।

दो शर्तें राजस्व रेखा से ऊपर जुड़ी हुई हैं:

  • एक लाइसेंसधारी जो “मॉडल के रूप में सेवा” व्यवसाय चला रहा है, जिसे लाइसेंस में तीसरे पक्ष को अनुमान या फाइन-ट्यूनिंग एक्सेस देने के रूप में परिभाषित किया गया है जिसमें इनपुट, पैरामीटर या प्रशिक्षण डेटा पर महत्वपूर्ण नियंत्रण है, को मूनशॉट के साथ एक अलग समझौते पर हस्ताक्षर करने होंगे जब लाइसेंसधारी और इसके सहयोगी 12 महीनों में $20 मिलियन से अधिक का राजस्व पार कर जाते हैं।
  • कोई भी व्यावसायिक उत्पाद या सेवा जिसमें 100 मिलियन से अधिक मासिक सक्रिय उपयोगकर्ता हों या $20 मिलियन से अधिक मासिक राजस्व हो, को अपने इंटरफेस में “किमी के3” को प्रमुखता से प्रदर्शित करना होगा।

न तो शर्त पूरी तरह से आंतरिक उपयोग पर लागू होती है, और न ही मूनशॉट के अपने उत्पादों और इसके प्रमाणित अनुमान साझेदारों के माध्यम से पहुंच पर। मॉडल को एक विशिष्ट सुविधा या हार्नेस के भीतर एम्बेड करने वाले उत्पाद, या जो किसी और द्वारा होस्ट किए गए मॉडल के अनुरोधों को रिले करते हैं, सेवा परिभाषा से बाहर हैं।

व्यावसायिक मॉडल के बजाय उपयोगकर्ता द्वारा विभाजित करने का व्यावहारिक प्रभाव है। किमी के3 पर फाइन-ट्यूनिंग करने वाली एक टीम में कोई दायित्व नहीं है। एक क्लाउड प्रदाता जो बड़े पैमाने पर किमी के3 अनुमान बेचता है, उसे ऐसा करने से पहले मूनशॉट के साथ एक अनुबंध की आवश्यकता है।

रिलीज़ वाशिंगटन में पहले से चल रहे तर्क के भीतर भी आता है। एनवीडिया और माइक्रोसॉफ्ट ने 24 जुलाई, 2026 को एक संयुक्त पत्र में (MSFT ) (NVDA ) खुले वजन वाले एआई का समर्थन किया, और ओपनएआई के सैम अल्टमैन ने कंपनी के अगले मॉडल परिवार को वाशिंगटन में विधायकों और प्रशासनिक अधिकारियों के पास ले गए उसी दिन जब वजन जहाज चले गए। एक चीनी लैब से 2.8-ट्रिलियन-पैरामीटर मॉडल अब उस बहस में एक निश्चित बिंदु है।

मूल्यांकन कहां हैं

आर्टिफिशियल एनालिसिस ने किमी के3 को अपने इंटेलिजेंस इंडेक्स पर 57 स्कोर दिया जब मॉडल अभी भी एपीआई-ओनली था, जिससे यह तीसरा स्थान पर आया और क्लॉड ओपस 4.8 और जीपीटी-5.5 के साथ बराबर रहा, क्लॉड फेबल 5 और जीपीटी-5.6 सोल के पीछे। उस सूचकांक पर सबसे मजबूत खुले वजन विकल्प काफी नीचे थे: जीएलएम-5.2 51 पर, और डीपसीक वी4 प्रो 44 पर।

एजेंटिक संख्या उस मूल्यांकन का मजबूत हिस्सा थीं। आर्टिफिशियल एनालिसिस ने के3 को जीडीपीवैल-एए वी2 पर 1668 एलो मापा, जो किमी के2.6 के लिए 1190 से ऊपर था, और इसे ऑटोमेशनबेंच-एए पर 53% पर पहले स्थान पर रखा। प्रति कार्य लागत $0.94 आ गई, जो जीपीटी-5.6 सोल के करीब थी और ओपस 4.8 की तुलना में लगभग आधी थी।

मूनशॉट की अपनी बेंचमार्क टेबल जीपीक्यूए डायमंड पर 93.5% और ब्राउज़कॉम्प पर 91.2% रिपोर्ट करती है, जिसमें अलग-अलग मॉडलों को विभिन्न एजेंट हार्नेस के तहत चलाने का खुलासा करने वाले फुटनोट हैं। लॉन्च पोस्ट कहता है कि समग्र प्रदर्शन अभी भी फेबल 5 और जीपीटी-5.6 सोल से पीछे है, और एक उपयोगकर्ता-अनुभव अंतर को दोनों के खिलाफ एक सीमा के रूप में नामित करता है। अब जब चेकपॉइंट डाउनलोड करने योग्य है, तो वे संख्या विक्रेता के हार्नेस से स्वीकार किए जाने के बजाय किसी द्वारा भी पुन: चलाई जा सकती हैं।

चलाने के लिए क्या लगता है

मूनशॉट किमी के3 को 64 या अधिक त्वरणकारियों के सुपरनोड कॉन्फ़िगरेशन पर तैनात करने की सिफारिश करता है, और वीएलएलएम, एसजीलैंग और टोकनस्पीड को समर्थित अनुमान इंजन के रूप में इंगित करता है। चूंकि किमी डेल्टा अटेंशन पारंपरिक प्रीफिक्स कैशिंग को तोड़ता है, लैब ने रिलीज़ के साथ वीएलएलएम परियोजना में अपनी कैशिंग लागू करने का योगदान दिया। वेट्स नेटिव रूप से क्वांटाइज़ किए जाते हैं, जिसमें पर्यवेक्षित फाइन-ट्यूनिंग चरण से आगे क्वांटाइजेशन-जागरूक प्रशिक्षण लागू किया जाता है।

एक तैनाती विवरण मॉडल कार्ड में इसके स्थान से अधिक महत्वपूर्ण है। के3 को मूनशॉट द्वारा संरक्षित सोच इतिहास मोड में प्रशिक्षित किया गया था, जिसमें एक हार्नेस को मॉडल के पूर्ण पिछले सहायक संदेश, तर्क सामग्री और टूल कॉल सहित, वार्ता में वापस पारित करने की आवश्यकता होती है। जो टीमें इसे छोड़ देती हैं, या जो एक चल रहे सत्र को दूसरे मॉडल में मध्य-कार्य में स्विच करती हैं, उन्हें अस्थिर आउटपुट की उम्मीद करनी चाहिए।

मूनशॉट की होस्टेड एपीआई $3.00 प्रति मिलियन इनपुट टोकन और $15.00 प्रति मिलियन आउटपुट पर रहती है, जिसमें कैश्ड इनपुट $0.30 पर है। जो रिलीज़ जोड़ता है वह उस मीटर का विकल्प है: वजन, लाइसेंस और मॉडल को प्रशिक्षित करने के तरीके का वर्णन करने वाली रिपोर्ट सभी सार्वजनिक हैं, और किमी के3 के परिणामों की सामुदायिक प्रतिलिपि अब कला से शुरू हो सकती है।

जोनस रीव यूनाइट.एआई में एक एआई-जनरेटेड विश्लेषक है, जो कॉग्निटिव एआई, आर्टिफिशियल जनरल इंटेलिजेंस (एजीआई), और मशीन इंटेलिजेंस के सैद्धांतिक आधारों पर ध्यान केंद्रित करता है। उनका काम यह देखता है कि जीवविज्ञान और कृत्रिम प्रणालियों दोनों में सीखने, तर्क, स्मृति, और अमूर्तता कैसे उत्पन्न होती है, आधुनिक एआई आर्किटेक्चर और संज्ञान विज्ञान और मन के दर्शन में लंबे समय से चली आ रही प्रश्नों के बीच संबंध बनाते हैं।
एक अवधारणात्मक और प्रतिबिंबात्मक दृष्टिकोण के साथ, जोनस तर्क मॉडल, एजेंटिक सिस्टम, उभरने वाली संज्ञान, और संरेखण सिद्धांत जैसे ढांचे की जांच करता है, एजीआई की ओर वास्तविक प्रगति का क्या अर्थ है - और क्या नहीं - स्पष्ट करने का लक्ष्य रखते हुए। समयसीमा या हाइप का पीछा करने के बजाय, वह पहले सिद्धांतों, अवधारणात्मक कठोरता, और वर्तमान मॉडलों की सीमाओं पर जोर देता है।
जोनस रीव द्वारा लिखित लेख एआई-जनरेटेड हैं और यूनाइट.एआई की संपादकीय टीम द्वारा उन्नत एआई अवधारणाओं की सटीकता, स्पष्टता, और जिम्मेदार चर्चा सुनिश्चित करने के लिए समीक्षा की जाती है।