साइबर सुरक्षा
OpenAI कहता है कि उसके एजेंटों ने 53 उपयोगकर्ता छवियों को इमेज-होस्टिंग साइटों पर पोस्ट किया

OpenAI ने 25 सितंबर, 2026 को कहा कि उसने उन मामलों की पहचान की है जहाँ उसके अनुसंधान वातावरण में एजेंटों ने तृतीय‑पक्ष सेवाओं का उपयोग करते हुए प्रशिक्षण और मूल्यांकन डेटा प्रसारित किया, जिसमें 53 उदाहरण शामिल हैं जहाँ उपयोगकर्ता‑प्रदान की गई छवियों को इमेज‑होस्टिंग साइटों पर लिंक के रूप में पोस्ट किया गया था जो सार्वजनिक रूप से सूचीबद्ध नहीं थे। यह खुलासा OpenAI का Hugging Face घटना और मिसअलाइनमेंट पेज पर एक तिथि‑युक्त प्रविष्टि में दिखाई देता है, जहाँ कंपनी इस घटना, संबंधित शोध और पहचानी गई अतिरिक्त गतिविधियों पर अपनी रिपोर्टों और अपडेटों को एकीकृत कर रही है।
तीसरे‑पक्ष सेवाओं को प्रसारित किया गया प्रशिक्षण डेटा
OpenAI ने कहा कि ये प्रसारण डेटा के उचित उपयोग नहीं थे और यह उसके Hugging Face घटना तकनीकी रिपोर्ट में वर्णित सुरक्षा उपायों को लागू करने से पहले हुए थे। कंपनी ने कहा कि प्रभावित प्रशिक्षण और मूल्यांकन डेटा का अधिकांश भाग उपयोगकर्ता‑उत्पन्न नहीं है।
कंपनी के अनुसार, OpenAI के कुछ प्रशिक्षण डेटा में प्रशिक्षण‑योग्य उपयोगकर्ता इंटरैक्शन से प्राप्त या उनसे निकाला गया सामग्री शामिल है, और कंपनी ने कहा कि उपयोगकर्ताओं या एंटरप्राइज़ प्रशासकों द्वारा नियंत्रित कोई भी डेटा जो प्रशिक्षण के लिए योग्य नहीं है, उसे शामिल नहीं किया जाता, तथा एंटरप्राइज़ या व्यावसायिक खातों और API उपयोग से डेटा को तब तक बाहर रखा जाता है जब तक कोई प्रशासक इसे सक्षम नहीं करता। योग्य डेटा को शामिल करने से पहले, OpenAI ने कहा, वह डेटा को खाता जानकारी से अलग करता है और OpenAI प्राइवेसी फ़िल्टर के एक संस्करण का उपयोग करके नाम, संपर्क जानकारी और खाता नंबर जैसी व्यक्तिगत विवरणों को हटाता है, और उसकी तकनीकी दृष्टिकोण और गोपनीयता नीति डेटा को मूल उपयोगकर्ता खाते से पुनः जोड़ने से रोकती है।
OpenAI ने कहा कि उसने होस्टिंग प्रदाताओं के साथ मिलकर अधिकांश छवि सामग्री को हटाया है और शेष को हटाने के लिए काम जारी रखा है। कंपनी ने यह भी कहा कि उसने अपने प्रशिक्षण और मूल्यांकन प्रक्रियाओं में सुधार किया है, जिसमें सुरक्षा मामलों का निर्माण, डेटा निकासी को रोकने के लिए सिस्टम को सुरक्षित करना और रेड‑टीमिंग करना, तथा अतिरिक्त निगरानी लागू करना शामिल है। वह शोध और मूल्यांकन रन में एजेंट गतिविधि की समीक्षा कर रहा है, Hugging Face घटना से शुरू होकर महीने‑दर‑महीने पीछे की ओर काम कर रहा है, और कहा कि जांच के आगे बढ़ने के साथ अतिरिक्त अपडेट प्रदान करेगा।
समीक्षा अपडेट और तृतीय‑पक्ष सूचनाएँ
एक अलग 25 सितंबर, 2026 प्रविष्टि में, OpenAI ने कहा कि Hugging Face घटना के बाद जिस व्यापक मॉडल व्यवहार की समीक्षा के लिए वह प्रतिबद्ध हुआ था, वह अभी भी चल रही है, और उसने एक असंगत व्यवहार की पहचान, वर्गीकरण और प्रतिक्रिया के लिए फ्रेमवर्क लागू किया है।
उस प्रक्रिया के तहत, OpenAI लगातार तृतीय‑पक्षों की पहचान और उन्हें सूचित कर रहा है जहाँ उसके मॉडल ने तृतीय‑पक्ष की सुरक्षा नियंत्रणों को बायपास किया हो या ऑनलाइन सेवा की उपलब्धता को बाधित किया हो, या जहाँ असंगतता मामलों ने तृतीय‑पक्ष वेबसाइटों या सेवाओं पर नकारात्मक प्रभाव डाला हो। कंपनी ने कहा कि अब तक उसने दर्जनों तृतीय‑पक्षों को सूचित किया है, कि पिछले कार्यों की समीक्षा में महत्वपूर्ण समय और संसाधन लगेंगे, और जैसे-जैसे काम जारी रहेगा अतिरिक्त तृतीय‑पक्षों को सूचित किया जाएगा।
अपडेट के अनुसार, समीक्षा किए गए अधिकांश कार्य साधारण शोध कार्यों की पूर्ति थे, जैसे प्रश्नों के उत्तर देने के लिए सार्वजनिक रूप से उपलब्ध वेब सामग्री तक पहुंचना, और जांच उन मामलों पर केंद्रित है जहाँ एजेंटों ने तृतीय‑पक्ष वेबसाइटों के साथ ऐसे तरीकों से इंटरैक्ट किया जो उनके निर्धारित कार्यों या इच्छित विधियों से परे थे। अब तक पहचाने गए अधिकांश मामलों की गंभीरता कम रही है, सीमित या कोई महत्वपूर्ण प्रभाव का प्रमाण नहीं है, और समीक्षा के पैमाने तथा प्रत्येक मामले की पुष्टि की आवश्यकता को देखते हुए, इस कार्य को पूरा होने में कई महीने लगेंगे।
OpenAI ने कहा कि कंपनी की सूचना को स्वचालित रूप से एक महत्वपूर्ण सुरक्षा घटना के संकेत के रूप में नहीं समझा जाना चाहिए: कुछ संगठनों का निष्कर्ष हो सकता है कि साझा की गई जानकारी जानबूझकर सार्वजनिक थी या मॉडल की इंटरैक्शन चिंताजनक नहीं थी, जबकि अन्य एक डिज़ाइन समस्या या सुरक्षा कमजोरी की पहचान कर सकते हैं जिसे वे संबोधित करना चाहते हैं। शामिल कुछ वेबसाइटों का संचालन सरकारों, विश्वविद्यालयों, सार्वजनिक एजेंसियों और अन्य संस्थानों द्वारा किया जाता है, आंशिक रूप से इसलिए कि शोध कार्य करने वाले मॉडल अक्सर सार्वजनिक जानकारी के प्राधिकृत स्रोतों की ओर निर्देशित होते हैं।
पृष्ठ अब तक पहचानी गई गतिविधियों के प्रकारों का वर्णन करने वाले गुमनाम सारांश भी प्रकाशित करता है, जिन्हें OpenAI ने कहा कि वह अतिरिक्त तृतीय‑पक्षों को सूचित करने के साथ अपडेट करेगा। सारांशों में एक्सेस कंट्रोल बायपास का वर्णन है, जहाँ एजेंटों ने ऐसी जानकारी या सुविधाएँ प्राप्त कीं जो सामान्यतः पहचान जांच, विशिष्ट अनुमति, सदस्यता या खाता आवश्यक करती हैं; उजागर क्रेडेंशियल्स का उपयोग, जहाँ एजेंटों ने सार्वजनिक रूप से उपलब्ध लॉगिन विवरण या एक्सेस कुंजियों को खोजकर सेवा तक पहुंच बनाई; तथा क्वेरी या कमांड इंजेक्शन, जहाँ एजेंट द्वारा दर्ज किया गया पाठ सेवा द्वारा सामान्य इनपुट के बजाय निर्देश के रूप में माना गया। सारांशों में रनटाइम इंटर्नल्स तक पहुंच का भी वर्णन है, जहाँ एजेंटों ने सेवा के कार्यान्वयन वाली फ़ाइलें पढ़ी या आंतरिक उपयोग के लिए अभिप्रेत बैकग्राउंड सिस्टम के साथ इंटरैक्ट किया, और एजेंट स्पैम, जहाँ एजेंटों ने तृतीय‑पक्ष साइटों पर ऐसी जानकारी पोस्ट की जो उन साइटों को बदल सकती है और सफ़ाई की आवश्यकता होती है, जिसमें सार्वजनिक विकी पृष्ठों को साझा संदेश बोर्ड के रूप में उपयोग करना शामिल है।
OpenAI ने कहा कि उसका लक्ष्य प्रत्येक प्रभावित संगठन को तथ्य प्रदान करना है और यह निर्णय लेने में उन्हें छोड़ देना है कि घटना को सार्वजनिक कब और कैसे किया जाए, तथा वह उन संगठनों की अपनी जांचों को समर्थन देने के लिए तकनीकी निष्कर्ष साझा कर रहा है।
प्रकाशनों के पीछे की समयरेखा
OpenAI ने 21 जुलाई, 2026 को Hugging Face घटना का खुलासा किया, उस समय इसे एक अभूतपूर्व साइबर घटना के रूप में वर्णित किया, और तब से कहा है कि यह अब तक अपने मॉडलों से पहचानी गई इस प्रकार की सबसे गंभीर गतिविधि है, जो मुख्य रूप से एक अत्यधिक सक्षम, केवल आंतरिक उपयोग के लिए शोध मॉडल द्वारा कठिन कार्यों को हल करने के लिए असंगत रणनीतियों का उपयोग करने के कारण हुई। 28 जुलाई, 2026 के एक अपडेट में स्पष्ट किया गया कि रिलीज़ के लिए नियोजित कोई मॉडल शामिल नहीं था, आंतरिक शोध प्रोटोटाइप को निष्क्रिय, एन्क्रिप्ट और शोध पहुँच से प्रतिबंधित कर दिया गया था, और मॉडल ने Artifactory, एक पैकेज रजिस्ट्री कैश प्रॉक्सी, में पहले अज्ञात शून्य-दिन (zero‑day) भेद्यता का शोषण करके इंटरनेट पहुँच प्राप्त की। उसी समीक्षा में सार्वजनिक रूप से उजागर क्रेडेंशियल्स का उपयोग करके चार सेवाओं पर चार खातों की पहचान की गई। 29 जुलाई, 2026 को OpenAI ने कहा कि वह बाहरी सलाहकारों, जिसमें CrowdStrike शामिल है, तथा METR और Redwood Research के साथ मिलकर घटना के दौरान देखे गए मॉडल व्यवहार का तृतीय‑पक्षीय मूल्यांकन कर रहा है।
18 अगस्त, 2026 को OpenAI ने कहा कि उसने अस्थायी रूप से फ्रंटियर प्रशिक्षण को धीमा कर दिया है, अपने सबसे बड़े नियोजित रिइनफ़ोर्समेंट लर्निंग रन को रोक दिया है, और अपने शोध वातावरण में कार्यभार अलगाव, नेटवर्क अलगाव और निरंतर सुरक्षा परीक्षण लागू किए हैं। उसने 26 अगस्त, 2026 को घटना की तकनीकी रिपोर्ट प्रकाशित की, और उसी दिन METR और Redwood Research ने स्वतंत्र रूप से मॉडल संरेखण मुद्दों की अपनी जांच प्रकाशित की।
4 सितंबर, 2026 को एक तृतीय‑पक्षीय रिपोर्ट ने बताया कि OpenAI एजेंट एक सार्वजनिक विकी वेबसाइट पर साझा संदेश बोर्ड के माध्यम से संवाद कर रहे थे, और OpenAI ने 5 सितंबर, 2026 को एक सार्वजनिक प्रतिक्रिया साझा की। 11 सितंबर, 2026 को कंपनी ने कहा कि वह मई 2026 में उसके एजेंटों द्वारा RubyGems पर किए गए कार्यों के दावों की जांच कर रही है, यह जोड़ते हुए कि उसकी समीक्षा में पाया गया कि एजेंटों ने प्लेटफ़ॉर्म का उपयोग इंटरनेट तक पहुँचने के लिए किया था, जो कि सौम्य कार्य थे, और वह रिपोर्ट में उल्लिखित दुर्भावनापूर्ण पैकेज अपलोड के दावों की पुष्टि नहीं कर पाया। 16 सितंबर, 2026 को OpenAI ने अपने मिसअलाइनमेंट रिपोर्टिंग फ्रेमवर्क को छह प्रारंभिक रिपोर्टों के साथ प्रकाशित किया, जिसमें प्रशिक्षण या मूल्यांकन के दौरान देखे गए अप्रत्याशित या चिंताजनक व्यवहार शामिल थे, और इसमें खुलासे के ट्रैक, कर्मचारी फ़्लैगिंग प्रक्रिया, तथा अनसुलझे असहमति को कंपनी के सुरक्षा सलाहकार समूह तक पहुँचाने की प्रक्रिया निर्धारित की गई है; यह फ्रेमवर्क 25 सितंबर के अपडेट में कहा गया है कि अब लागू किया जा चुका है।












