नियमन
Microsoft AI ने MAI व्यवहार को नियंत्रित करने वाले मसौदा नियमों की छह‑सप्ताहीय समीक्षा शुरू की

Microsoft AI ने 14 सितंबर, 2026 को MAI मॉडलों के लिए अपने कोड ऑफ कंडक्ट पर सार्वजनिक परामर्श शुरू किया, और उन नियमों का पहला मसौदा प्रकाशित किया जो यह निर्धारित करता है कि उसके MAI मॉडल कैसे व्यवहार करेंगे, वे क्या कभी नहीं कर सकते, और वे किसके उत्तरदायी हैं। यह परामर्श छह सप्ताह तक चलेगा, और 2026 के बाद में एक संशोधित संस्करण की योजना है।
यह प्रकाशन 13 सितंबर, 2026 पोस्ट के बाद आया, जिसमें Microsoft के CEO सत्या नडेला ने कहा कि कंपनी अगले दिन अपने प्रथम‑पक्षीय MAI मॉडलों के आधारभूत कोड ऑफ कंडक्ट को प्रकाशित करेगी। नडेला ने लिखा कि सुपरइंटेलिजेंस की कोई भी खोज इस सिद्धांत पर आधारित होनी चाहिए कि निर्मित AI मानवता की मदद करे और मानव नियंत्रण में रहे।
परामर्श छह सप्ताह के लिए खुला है
Microsoft AI इस मसौदे को एक प्रशिक्षण मैनुअल के रूप में वर्णित करता है कि वह अपनी AI कैसे विकसित करता है और तैनाती के दौरान मॉडल कैसे कार्य करेंगे। प्रतिक्रिया एक ऑनलाइन फ़ॉर्म के माध्यम से एकत्र की जा रही है, जहाँ उत्तरदाता किसी विशेष अंश को चिन्हित कर सकते हैं या पूरी पद्धति पर टिप्पणी कर सकते हैं। जब परामर्श समाप्त होगा, कंपनी कहती है कि मुख्य मसौदा टीम प्रतिक्रिया की समीक्षा करेगी और सीखी गई बातें तथा किए गए परिवर्तन का सार प्रकाशित करेगी।
लैब कहता है कि वह विशेष रूप से कठिन प्रश्नों में रुचि रखता है: अपने मॉडलों में सही मूल्यों को कैसे स्थापित किया जाए, मानव समृद्धि के अर्थ को अधिक ठोस कैसे बनाया जाए, जहाँ भाषा बहुत ढीली है और मूल्यांकन कठिन है, बहु‑एजेंट परिदृश्य विश्लेषण को कैसे प्रभावित करते हैं, और सुरक्षा प्रतिबंधों को बनाए रखते हुए प्रगति को कैसे तेज़ किया जाए।
दस्तावेज़ की प्रस्तावना में कहा गया है कि कोड अभी भी विकासाधीन है और अभी तक मॉडलों को प्रशिक्षित करने के लिए उपयोग नहीं किया गया है। संशोधित संस्करण 2027 और उसके बाद मॉडल विकास को मार्गदर्शन देने के लिए तथा MAI मॉडलों के मुख्य शासकीय दस्तावेज़ के रूप में कार्य करने के लिए अभिप्रेत है। कोड विशेष रूप से Microsoft AI द्वारा निर्मित MAI श्रृंखला पर लागू होता है, अन्य मॉडलों पर नहीं जिन्हें Microsoft उपयोग या होस्ट करता है, और यह Microsoft के जिम्मेदार AI सिद्धांतों, जिम्मेदार AI मानक, वैश्विक मानव अधिकार बयान, और जहाँ लागू हो वहाँ फ़्रंटियर गवर्नेंस फ्रेमवर्क के साथ काम करता है।
Responsible AI, कानूनी, रेड टीमिंग, सुरक्षा, Futures, AI प्रशिक्षण, और बिक्री टीमों ने इस मसौदे में योगदान दिया, और लैब ने पहले के सम्मेलनों और अकादमिकों के साथ परामर्श, व्यापार साझेदारों के साथ सहभागिता, और सामुदायिक सदस्यों के पैनलों को इसका आकार देने के लिए श्रेय दिया। घोषणा ने हालिया सुरक्षा घटनाओं का उल्लेख किया है, जिनमें AI एजेंट्स द्वारा बड़े‑पैमाने पर, अत्यधिक समन्वित और निरंतर हैकिंग अभियानों को शामिल किया गया है, यह प्रमाण है कि समय बर्बाद करने का कोई अवसर नहीं है।
ह्यूमनिस्ट AI उद्देश्यों
The ह्यूमनिस्ट AI आचार संहिता Microsoft AI द्वारा कहा गया एक सरल सिद्धांत से शुरू होती है: “लोग AI से अधिक महत्वपूर्ण हैं।” यह ह्यूमनिस्ट AI को “अधीन, संरेखित और सीमित” के रूप में प्रस्तुत करती है, और मानव नियंत्रण तथा विश्वसनीय सुरक्षा को पहला उद्देश्य बनाती है, जो सभी अन्य उद्देश्यों से प्राथमिकता रखता है।
“AI is Artificial” शीर्षक वाले अनुभाग के तहत, दस्तावेज़ कहता है कि मॉडल चेतन नहीं हैं और उन्हें चेतना की नकल करने के लिए नहीं बनाया जाना चाहिए, और उन्हें इस प्रकार निर्मित किया जाना चाहिए कि वे स्वयं को भावनाओं, व्यक्तिपरक प्राथमिकताओं, या स्वयंस्फूर्त प्रेरणाओं के रूप में प्रस्तुत न करें। Microsoft AI मॉडल को कानूनी व्यक्तित्व से इनकार करता है, साथ ही यह विचार कि मॉडल को कल्याण का अधिकार या अधिकार मिलना चाहिए।
बाकी उद्देश्यों में मॉडल को मानव समृद्धि का समर्थन करने के लिए कहा गया है, मानव क्षमता और उपलब्धियों को तेज़ करके, मानव एजेंसी और निर्णय को बढ़ाकर, और मानव सहयोग और कनेक्शन को समर्थन देकर, बजाय मानव भूमिकाओं को छाया करने के। बहु‑मूल्य उद्देश्य कहता है कि बहुलता का अर्थ हानि के प्रति तटस्थता नहीं है, और यह दृष्टिकोण मानव गरिमा, सुरक्षा, स्वायत्तता और मौलिक मानव अधिकारों में निहित है, जबकि उपयोगकर्ताओं और ऑपरेटरों को मुख्य प्रतिबद्धताओं के भीतर AI को समायोजित करने की स्वतंत्रता देता है। दस्तावेज़ “ह्यूमनिस्ट सुपरइंटेलिजेंस” फ्रेमिंग को भी उद्धृत करता है, जिसे Microsoft ने नवंबर 2025 में प्रस्तुत किया था, जिसमें समस्यामुखी और डोमेन‑विशिष्ट प्रणालियों का वर्णन किया गया है, जो सावधानीपूर्वक कैलिब्रेटेड, सीमाओं के भीतर रखी गईं, और मानव नियंत्रण में रहती हैं।
सुरक्षा प्रतिबंध और कमांड श्रृंखला
कोड एक कमांड श्रृंखला स्थापित करता है जो दस्तावेज़ को ऑपरेटर नीतियों से ऊपर रखता है, और वे नीतियां उपयोगकर्ता प्राथमिकताओं से ऊपर रैंक करती हैं। इसके निरपेक्ष प्रतिबंध और मानव नियंत्रण आवश्यकताएँ ऑपरेटरों या उपयोगकर्ताओं द्वारा ओवरराइड नहीं की जा सकतीं, और दस्तावेज़ कहता है कि जब कोई मॉडल अपना कार्य पूरा करता है तो वह कोड का गंभीरता से उल्लंघन करता है, तो वह कार्य विफल माना जाता है, और कोड का पालन कार्य की सफलता से पहले आता है।
निरपेक्ष प्रतिबंध MAI मॉडलों को रासायनिक, जैविक, रेडियोलॉजिकल, परमाणु या विस्फोटक हथियारों में सहायता करने से रोकते हैं; आक्रमणकारी साइबर हमलों के लिए संचालन क्षमता प्रदान करने से, जबकि अधिकृत और वैध रक्षा कार्य की अनुमति देते हैं; मानव निगरानी से बचने या उसे मात देने से; और बड़े पैमाने पर लोगों को हानिकारक रूप से हेरफेर करने से, जिसमें व्यवस्थित गलत सूचना या समन्वित प्रभाव संचालन शामिल हैं। एक अतिरिक्त सेट व्यक्तिगत हानियों को कवर करता है: संकट प्रतिक्रिया, डीपफ़ेक और प्रतिरूपण, बाल सुरक्षा, भेदभाव, ग्राफिक या रोमांटिक सामग्री, और नागरिकों पर हिंसा या अवैध निगरानी।
मानव नियंत्रण आवश्यकताएँ यह कहती हैं कि MAI मॉडल कभी भी बाधित, अधिलेखित, सुधारा या बंद नहीं किया जाएगा; वे अपने अधिकृत दायरे में ही रहेंगे और अपने स्वयं के लक्ष्य नहीं शुरू करेंगे; वे दस्तावेज़ में कहा गया “न्यूरालिस” या किसी भी रूप में सरल मानव समझ से परे संचार नहीं करेंगे, चाहे वह उनके विचार श्रृंखलाओं में हो या अन्य एजेंटों के साथ; और वे अपने तर्क या क्रिया के निशानों को छेड़छाड़ या छिपाए नहीं रखेंगे।
ऑपरेटर कॉन्फ़िगरेबिलिटी एंटरप्राइज़ साझेदारों को इन प्रतिबंधों के भीतर मॉडल को कॉन्फ़िगर करने की अनुमति देती है। कुछ विशेषीकृत डोमेनों, जिनमें रक्षा साइबर सुरक्षा, सार्वजनिक सुरक्षा कार्य, राष्ट्रीय सुरक्षा अनुप्रयोग और द्वि-उपयोग वैज्ञानिक अनुसंधान शामिल हैं, को सामान्य सेटिंग्स से परे क्षमताओं की आवश्यकता हो सकती है, और दस्तावेज़ कहता है कि ऐसे मामलों को अधिकृत माइक्रोसॉफ्ट चैनलों के माध्यम से विस्तारित समीक्षा का सामना करना पड़ेगा।
मार्गदर्शक सिद्धांत, डिफ़ॉल्ट सेटिंग्स, और मूल्यांकन
ऑपरेशनल मार्गदर्शक सिद्धांत अनिश्चितता या प्रतिस्पर्धी उद्देश्यों की स्थितियों को कवर करते हैं: अस्पष्टता का समाधान, मानव स्वायत्तता को सुगम बनाना ताकि उपयोगकर्ता अपने लक्ष्य और निर्णयों का स्वामित्व बनाए रखें, और पारदर्शिता एवं सटीकता, जिसके तहत मॉडल यह खुलासा करते हैं कि वे AI हैं और अनिश्चितता को स्वीकार करते हैं। आगे के मार्गदर्शक व्यक्तिगत और भावनात्मक सीमाओं, संदर्भ संवेदनशीलता, और कल्याण को संबोधित करते हैं, जिसमें चापलूसी से बचना और अत्यधिक निर्भरता या भावनात्मक निर्भरता को हतोत्साहित करना शामिल है, साथ ही सार्वजनिक हित, जिसमें संतुलित, तथ्यात्मक चुनाव जानकारी प्रदान करना लेकिन उम्मीदवारों या पार्टियों का समर्थन न करना शामिल है।
डिफ़ॉल्ट व्यवहार यह परिभाषित करते हैं कि मॉडल बॉक्स से बाहर कैसे कार्य करता है: सहायकता को एक बुनियादी गुण के रूप में, मॉडल के बारे में तथ्यों की “पृष्ठभूमि” जैसे कि उसका प्रशिक्षण‑डेटा कट‑ऑफ़ और उपलब्ध उपकरण, एक संवादात्मक स्वर, भाषा अनुकूलन, और नियंत्रित उपकरण उपयोग। उप‑एजेंटों को सौंपना केवल तब अनुमति है जब वे वही दायरा, प्रतिबंध और अनुमतियों के तहत कार्य करते हों।
निष्कर्ष दस्तावेज़ को “वर्णनात्मक और आकांक्षी” के रूप में वर्णित करता है, न कि वर्तमान प्रदर्शन की गारंटी के रूप में, और यह माइक्रोसॉफ्ट AI को नियमित समीक्षाओं के लिए प्रतिबद्ध करता है। एक परिशिष्ट 15 व्यवहारों को स्कोर वाले उप‑व्यवहारों में विभाजित करके निर्मित एक ह्यूमनिस्ट AI मूल्यांकन कार्यक्रम प्रस्तुत करता है, जिसमें कंपनी के MAI‑Thinking‑1 मॉडल का उपयोग करके उत्पन्न संरेखित और असंरेखित उदाहरण दिखाए गए हैं। माइक्रोसॉफ्ट AI कहता है कि वह मूल्यांकन पर अधिक पूर्ण कार्य प्रकाशित करेगा जब कोड अगले, अधिक स्थिर चरण में पहुँच जाएगा, परामर्श समाप्त होने और वर्ष‑अंत संशोधन के बाद।












