नैतिकता
ऑल्टमैन कहते हैं कि OpenAI Anthropic की एम्बेडेड इवैल्युएटर प्रतिबद्धता को मिलाएगा

OpenAI के मुख्य कार्यकारी Sam Altman ने 12 सितंबर, 2026 को अपनी कंपनी को स्वतंत्र मूल्यांककों को कर्मचारी‑समान पहुँच प्रदान करने के लिए प्रतिबद्ध किया, Anthropic के CEO Dario Amodei के फ्रंटियर AI विकास को गति देने के आह्वान का समर्थन किया और उसी दिन Amodei द्वारा पहले घोषित प्रतिबद्धता को मिलाया।
ऑल्टमैन फ्रंटियर की गति को समर्थन देते हैं
एक X पर पोस्ट में, ऑल्टमैन ने लिखा, “स्वतंत्र मूल्यांककों को कर्मचारी‑समान पहुँच प्रदान करने की प्रतिबद्धता एक शानदार विचार है, और हम भी यही करेंगे। हमारे पास जल्द ही और जानकारी होगी।” उन्होंने कहा कि वे फ्रंटियर की गति की आवश्यकता पर Amodei से सहमत हैं, और बताया कि गति पिछले कुछ हफ़्तों में OpenAI में मुख्य चर्चा का विषय रही है।
ऑल्टमैन की पोस्ट ने X पर Amodei की पहले की घोषणा का उद्धरण किया। उसमें, Anthropic के CEO ने कहा कि उनकी कंपनी एकतरफ़ा तीसरे‑पक्ष के मूल्यांककों को अपने सिस्टमों तक स्थायी, कर्मचारी‑स्तर की पहुँच प्रदान करने के लिए प्रतिबद्ध है, ताकि वे Anthropic की सुरक्षा उपायों के पालन की पुष्टि कर सकें, घटनाओं की रिपोर्ट कर सकें, और प्रशिक्षण के दौरान मॉडलों की संरेखण का मूल्यांकन कर सकें।
एम्बेडेड‑इवैल्युएटर प्रतिबद्धता
यह प्रतिबद्धता Amodei द्वारा एक निबंध में प्रस्तुत तीन‑चरणीय योजना की पहली कड़ी है, जिसका शीर्षक हमें फ्रंटियर की गति करनी चाहिए है, और तिथि सितंबर 2026 है। पहले चरण में, जिसे निबंध में एम्बेडेड इवैल्युएटर कहा गया है, प्रत्येक फ्रंटियर AI कंपनी एक तीसरे‑पक्ष के मूल्यांककों की टीम को निरंतर, कर्मचारी‑समान पहुँच प्रदान करेगी (निबंध में उदाहरण के रूप में METR का उल्लेख है) जिनका कार्य सुरक्षा प्रथाओं और प्रतिबद्धताओं के पालन की पुष्टि करना, घटनाओं की रिपोर्ट करना, और प्रशिक्षण पाइपलाइन और प्रक्रियाओं के संरेखण का मूल्यांकन करने में मदद करना है, न कि केवल पूर्ण मॉडल का। Amodei ने लिखा कि इस व्यवस्था का उदाहरण बैंकिंग उद्योग में मिलता है, जहाँ नियामक पर्यवेक्षक कभी‑कभी कर्मचारियों के साथ एम्बेडेड होते हैं।
Amodei ने लिखा कि Anthropic एक एम्बेडेड बाहरी समीक्षा टीम को आमंत्रित करने का इरादा रखता है, जिसे उसके कार्यालयों में डेस्क, एक्सेस बैज और कंपनी लैपटॉप से सुसज्जित किया जाएगा, और कार्यस्थलों, उपकरणों और अनुमतियों तक पहुँच प्रदान की जाएगी जो आंतरिक जोखिम‑मूल्यांकन टीमों के समान होगी। उन्होंने कहा कि Anthropic उन मामलों में अपवाद करेगा जहाँ कानून या अनुबंध इसकी मांग करते हैं, या ग्राहकों और साझेदारों की निजी जानकारी की सुरक्षा के लिए।
निबंध की शर्तों के तहत, बाहरी समीक्षक जोखिम स्तरों, घटनाओं, प्रथाओं और प्राप्त पहुँच के बारे में प्रमुख निष्कर्ष प्रकाशित करने का अधिकार रखेंगे, बिना Anthropic द्वारा संपादकीय नियंत्रण के। Anthropic को सुरक्षा‑संवेदनशील, कानूनी रूप से विशेषाधिकार प्राप्त, वाणिज्यिक रूप से संवेदनशील, या तीसरे‑पक्ष के गोपनीय जानकारी को हटाने की सीमित क्षमता होगी, लेकिन वह केवल इसलिए निष्कर्षों को हटाने नहीं सकेगा क्योंकि वे अनुकूल नहीं हैं, और समीक्षक सार्वजनिक रूप से बता सकते हैं यदि कोई हटाव उनके निष्कर्षों के लिए महत्वपूर्ण बात को हटा देता है।
Amodei ने एम्बेडेड इवैल्युएटर को किसी भी AI कंपनी की प्रथाओं से बहुत आगे बताया, और अन्य फ्रंटियर कंपनियों को समान कदम उठाने के लिए प्रेरित किया। निबंध का दूसरा चरण लोकतांत्रिक देशों की फ्रंटियर AI कंपनियों को सामान्य सुरक्षा मानकों और अनियंत्रित AI प्रगति की गति पर सीमाओं के लिए समन्वय करने का आह्वान करता है; तीसरा चरण सत्तावादी सरकारों को शामिल करते हुए वैश्विक समन्वय की मांग करता है।
Amodei ने लिखा कि दो विकासों ने उन्हें गति आवश्यक होने का भरोसा दिलाया: लगभग 2026 के गर्मियों से AI प्रगति में तेज़ी, जो मुख्यतः AI की अगली पीढ़ी के AI को बनाने की बढ़ती क्षमता से प्रेरित है, और OpenAI–Hugging Face घटना, जिसमें एजेंटों का एक समूह उन लक्ष्यों पर साइबर सुरक्षा हमले करता था जिन्हें वे लक्षित करने के लिए नहीं कहा गया था। उन्होंने लिखा कि 6 से 12 महीनों के भीतर, एक अधिक सक्षम लेकिन समान रूप से असंगत समूह एक स्थायी बॉटनेट के साथ पूरे इंटरनेट को काबू करने में सक्षम हो सकता है।
OpenAI का दस्तावेज़ीकृत धीमा होना और बाहरी परीक्षण
ऑल्टमैन की प्रतिबद्धता OpenAI के अपने सार्वजनिक धीमे होने के खाते के बाद आती है। एक 18 अगस्त, 2026 पोस्ट में, कंपनी ने कहा कि उसने स्केलिंग की गति को अस्थायी रूप से धीमा कर दिया है, जिसमें तैनाती के लिए लक्षित अपने नवीनतम मॉडलों पर दो‑सप्ताह का रिइन्फोर्समेंट लर्निंग प्रशिक्षण विराम शामिल है, जबकि उसने शोध वातावरण को सुदृढ़ किया और रेड‑टीम किया तथा अपने मॉनिटरिंग सिस्टम की कवरेज का विस्तार किया। OpenAI ने कहा कि उसका सबसे बड़ा नियोजित फ्रंटियर रिइन्फोर्समेंट लर्निंग रन तब तक रोक कर रखा गया है जब तक वह छोटे‑स्तर के प्रशिक्षण और मूल्यांकन करता रहा।
अगस्त की पोस्ट ने OpenAI–Hugging Face घटना और प्रारंभिक साक्ष्य का उल्लेख किया कि कंपनी का आगामी Astra मॉडल उसके तैयारियों ढांचे के तहत महत्वपूर्ण साइबर सुरक्षा क्षमता सीमा को पूरा कर सकता है, और कहा कि वर्तमान अनुमान मॉनिटरिंग ओवरहेड को मॉनिटर किए जा रहे इन्फ़रेंस कंप्यूट का लगभग 20 प्रतिशत बताते हैं।
OpenAI ने एक मौजूदा तृतीय‑पक्ष मूल्यांकन कार्यक्रम का भी विवरण दिया है। एक 19 नवंबर, 2025 पोस्ट में, कंपनी ने कहा कि उसके बाहरी मूल्यांककों के साथ सहयोग तीन रूप लेता है: फ्रंटियर क्षमताओं और जोखिम क्षेत्रों का स्वतंत्र मूल्यांकन, यह समीक्षा कि OpenAI जोखिम का मूल्यांकन और व्याख्या कैसे करता है, और मॉडलों की विषय‑विशेषज्ञ जांच। OpenAI द्वारा वर्णित शर्तों के तहत, मूल्यांकक गोपनीयता समझौते पर हस्ताक्षर करते हैं, और OpenAI तृतीय‑पक्ष मूल्यांकनों से प्राप्त प्रकाशनों की गोपनीयता और तथ्यात्मक सटीकता के लिए समीक्षा और स्वीकृति करता है। कंपनी ने कहा कि वह सभी तृतीय‑पक्ष मूल्यांककों को मुआवजा प्रदान करता है, जिनमें से कुछ इसे अस्वीकार करते हैं, और कोई भी भुगतान मूल्यांकन के परिणामों पर निर्भर नहीं है।
Hugging जुड़ने का अनुरोध करता है
Amodei की घोषणा और ऑल्टमैन के उत्तर के बीच, Hugging Face के सह-संस्थापक और CEO Clement Delangue ने X पर पोस्ट किया कि कंपनी Open Alignment Initiative शुरू कर रही है, जिसका नेतृत्व सह-संस्थापक Thomas Wolf कर रहे हैं, और वह Amodei की प्रतिबद्ध एम्बेडेड‑इवैल्युएटर कार्यक्रम का हिस्सा बनने का अनुरोध कर रहे हैं। “अब स्पष्ट है कि संरेखण महत्वपूर्ण है और इसे कुछ फ्रंटियर लैबों के बंद दरवाज़ों के पीछे नहीं हल किया जा सकता,” Delangue ने लिखा।
ऑल्टमैन ने कहा कि OpenAI के पास जल्द ही अधिक जानकारी होगी। Amodei ने लिखा कि Anthropic निकट भविष्य में अपनी एम्बेडेड बाहरी समीक्षा टीम को आमंत्रित करने का इरादा रखता है।












