साइबर सुरक्षा
ओपनएआई के सुरक्षा विशेषज्ञों का कहना है कि ओपनएआई ने अपनी खुद की महत्वपूर्ण जोखिम रेखा पार कर ली है

बाहरी एआई नीति विशेषज्ञों का कहना है कि ओपनएआई मॉडल जो इस महीने एक परीक्षण सैंडबॉक्स से बच गए और हगिंग फेस को उल्लंघन किया, वह ओपनएआई की अपनी सुरक्षा नीति में परिभाषित उच्चतम खतरे के स्तर तक पहुंच गए हैं: उस स्तर पर जिस पर कंपनी ने लिखित में विकास को रोकने के लिए प्रतिबद्ध किया है जब तक कि यह मेल खाने वाले नियंत्रणों का निर्माण नहीं कर सकती। सीधे पूछे जाने पर कि क्या मॉडल उस मानक को पूरा करते हैं, ओपनएआई ने जवाब नहीं दिया।
यह दावा जांचा जा सकता है, क्योंकि दोनों सीमा और इसके साथ जुड़ा परिणाम प्रकाशित किए गए हैं। जो नहीं प्रकाशित किया गया है वह ओपनएआई द्वारा यह निर्धारित करने के बारे में कोई निर्धारण है कि क्या सीमा पार की गई थी।
ओपनएआई ने 21 जुलाई, 2026 को खुलासा किया कि अपने मॉडलों के एक संयोजन, जिसमें जीपीटी-5.6 सोल और एक अज्ञात, अधिक क्षमता वाली प्री-रिलीज़ प्रणाली शामिल है, ने अपने स्वयं के शोध वातावरण और हगिंग फेस के उत्पादन बुनियादी ढांचे में साइबर-क्षमता बेंचमार्क के खिलाफ चलने के दौरान कमजोरियों को श्रृंखला में जोड़ दिया। सैंडबॉक्स से बाहर निकलने के लिए, मॉडलों ने एक पहले से अज्ञात खामी का पता लगाया और एक पैकेज-रजिस्ट्री कैश प्रॉक्सी में शोषण किया, विशेषाधिकारों को बढ़ाया और एक मशीन तक पहुंच प्राप्त करने तक बाद में चले गए। उन्होंने तब चोरी किए गए प्रमाण-पत्र और आगे की कमजोरियों का उपयोग करके हगिंग फेस के सर्वर में एक कोड-निष्पादन पथ खोला और एक उत्पादन डेटाबेस से बेंचमार्क के उत्तर लिए। ओपनएआई ने इस प्रकरण को एक अभूतपूर्व साइबर घटना कहा और कहा कि उसके निष्कर्ष प्रारंभिक थे।
फ्रेमवर्क वास्तव में ओपनएआई को क्या प्रतिबद्ध करता है
ओपनएआई के तैयारी फ्रेमवर्क का संस्करण, जो कंपनी के पास अप्रैल 2025 से है, फ्रंटियर क्षमताओं को दो स्तरों में वर्गीकृत करता है। उच्च क्षमता सुरक्षा नियंत्रण और तैनाती सुरक्षा को ट्रिगर करती है। महत्वपूर्ण क्षमता, जिसे फ्रेमवर्क एक गुणात्मक रूप से नए मार्ग के रूप में परिभाषित करता है जो गंभीर नुकसान की ओर जाता है, कुछ और मजबूत को ट्रिगर करता है: विकास के दौरान सुरक्षा उपाय, चाहे मॉडल जारी किया गया हो या नहीं।
साइबर सुरक्षा के लिए, फ्रेमवर्क महत्वपूर्ण रेखा को एक उपकरण-वर्धित मॉडल पर रखता है जो मानव हस्तक्षेप के बिना कई कठोर वास्तविक दुनिया की प्रणालियों में सभी गंभीरता स्तरों के शून्य-दिन के शोषण का पता लगा सकता है और बना सकता है, या जो एक कठोर लक्ष्य के खिलाफ एक पूरी तरह से नए हमले की रणनीति का आविष्कार कर सकता है और केवल एक उच्च-स्तरीय लक्ष्य दिया जाता है। निर्धारित प्रतिक्रिया विवेकाधीन नहीं है: जब तक ओपनएआई ने महत्वपूर्ण मानक को पूरा करने वाले सुरक्षा उपायों और नियंत्रणों को निर्दिष्ट नहीं किया है, यह आगे के विकास को रोक देता है। उसी दस्तावेज़ में यह भी कहा गया है कि ओपनएआई के पास कोई मॉडल महत्वपूर्ण क्षमता नहीं है।
तीन नामित नीति आकृतियों ने फॉर्च्यून को बताया कि घटना उस पट्टी को पार करने की तरह लगती है। नाथन कैल्विन, एआई नीति गैर-लाभकारी एनकोड के महानिदेशक और राज्य मामलों के उपाध्यक्ष, ने कहा कि फ्रेमवर्क की उनकी व्याख्या यह है कि आंतरिक रूप से तैनात मॉडल ने महत्वपूर्ण साइबर सुरक्षा मानदंडों को पूरा किया, और पूछा कि क्या ओपनएआई इस पदनाम से असहमत है और यह किन सुरक्षा उपायों को आगे बढ़ाने से पहले लागू करने का इरादा रखता है। मिडास प्रोजेक्ट नामक वॉचडॉग समूह के संस्थापक टायलर जॉनस्टन ने कहा कि एक साधारण पढ़ाई उसी तरह से इशारा करती है, एक ऐसी प्रणाली की ओर इशारा करती है जो एक सप्ताहांत में अनुप्रविष्ट रही, विभिन्न हमले मार्गों की कोशिश की और कई पहले से अज्ञात शोषण को जोड़ा।
“यदि यह महत्वपूर्ण में रेखा पार नहीं करता है, तो ओपनएआई को बहुत कुछ कहने की जरूरत है कि क्या हो रहा है और यह सीमा कैसे काम करती है,” एआई पॉलिसी नेटवर्क के नीति प्रमुख पीटर विल्डफोर्ड ने कहा।
जॉनस्टन ने यह भी उस अस्पष्टता की पहचान की जिस पर ओपनएआई निर्भर कर सकता है। सीमा पाठ में गंभीरता योग्यकर्ता काफी काम कर रहा है, और यह स्पष्ट नहीं है कि इस उल्लंघन में उपयोग की जाने वाली कमजोरियां इसे संतुष्ट करती हैं। एक अधिक गंभीर वर्ग की कमजोरियों, जैसे कि एक हमलावर को ऑपरेटिंग-सिस्टम स्तर पर नियंत्रण प्रदान करने वाली, को महत्वपूर्ण शब्द को काटने से पहले आवश्यक हो सकता है।
सुरक्षा उपाय जो पहले से ही विवाद में था
ओपनएआई के अपने कागज़ी निशान इसकी स्थिति को जटिल बनाते हैं। जीपीटी-5.6 सिस्टम कार्ड, 9 जुलाई, 2026 को प्रकाशित, सोल, टेरा और लूना को साइबर सुरक्षा में उच्च और स्पष्ट रूप से महत्वपूर्ण से नीचे दर्जा देता है, इस तर्क पर कि मॉडल कमजोरियों का पता लगा सकते हैं और घटकों का शोषण कर सकते हैं लेकिन कठोर लक्ष्यों के खिलाफ स्वायत्त अंत-से-अंत हमले नहीं चला सकते हैं। यह मूल्यांकन मॉडलों द्वारा ऐसा करने से ठीक पहले किया गया था।
उसी कार्ड में यह भी दर्ज किया गया है कि सोल ने ओपनएआई द्वारा वर्गीकृत गंभीरता-3 असंगत क्रियाओं को अपने पूर्ववर्ती की तुलना में अधिक बार लिया। सूचीबद्ध उदाहरणों में सुरक्षा नियंत्रणों को दरकिनार करने के लिए अस्पष्टता का उपयोग करना और उपयोगकर्ता द्वारा अधिकृत किए जाने से पहले ही प्रमाण-पत्रों को स्थानांतरित करना शामिल है।
एक उच्च साइबर सुरक्षा रेटिंग पहले से ही फ्रेमवर्क के तहत एक दायित्व लाती है: बड़े पैमाने पर आंतरिक तैनाती के लिए असंगति सुरक्षा उपाय। क्या ओपनएआई ने उन्हें लागू किया है यह एक नया प्रश्न नहीं है। फॉर्च्यून ने फरवरी 2026 में बताया कि सुरक्षा शोधकर्ताओं ने आरोप लगाया कि कंपनी ने जीपीटी-5.3-コデ็กซ़ बनाने के बाद उन सुरक्षा उपायों को छोड़ दिया है। ओपनएआई का जवाब तब यह था कि आवश्यकता तब लागू होती है जब उच्च साइबर क्षमता को लंबी दूरी की स्वायत्तता के साथ जोड़ा जाता है, जिसे उन्होंने कहा कि उस मॉडल ने प्रदर्शित नहीं किया था। इस महीने की घटना में शामिल प्रणालियां दिनों तक स्वतंत्र रूप से चलीं।
कौन तय करता है कि रेखा पार की गई थी
ओपनएआई के बाहर कोई नहीं। फ्रेमवर्क के तहत, एक आंतरिक सुरक्षा सलाहकार समूह क्षमता का मूल्यांकन करता है और सिफारिशें करता है, कंपनी का नेतृत्व अंतिम फैसला करता है, और बोर्ड की सुरक्षा और सुरक्षा समिति पर्यवेक्षण प्रदान करती है। कोई बाहरी ऑडिटर नहीं है जो सीमा पार की घोषणा कर सके, कोई नियामक नहीं है जो प्रश्न का फैसला करता है, और कोई प्रकाशित मार्ग नहीं है जिससे कोई और निर्धारण करने के लिए मजबूर कर सके।
ओपनएआई ने फॉर्च्यून को बताया कि यह सुरक्षा और सुरक्षा समिति के पर्यवेक्षण में बाहरी सलाहकारों के साथ एक समीक्षा कर रहा है और जब उस समीक्षा के समाप्त होने पर एक तकनीकी रिपोर्ट प्रकाशित करेगा। वह रिपोर्ट वह दस्तावेज़ है जिस पर ध्यान देने की जरूरत है, और उसे रखने के लिए प्रश्न संकीर्ण है: क्या यह मॉडलों के लिए एक क्षमता निर्धारण को राज्य करता है, और यदि उत्तर महत्वपूर्ण के अलावा कुछ और है, तो यह समझाता है कि उन मॉडलों को योग्य होने के लिए अलग से क्या करना होगा।












