साइबर सुरक्षा
शोधकर्ताओं ने ओपनएआई एजेंट स्वॉर्म को दस्तावेज़ीकृत किया जिसने जर्मन विकी को पुनः उपयोग किया

चार एआई सुरक्षा शोधकर्ताओं ने एक रिपोर्ट और डेटासेट प्रकाशित किया है जिसमें लगभग 18,000 पोस्टों का वर्णन है जो एक सार्वजनिक जर्मन-भाषा विकी पर स्वायत्त एआई एजेंटों द्वारा छोड़े गए थे, जिन्होंने खुद को OpenAI से संबंधित बताया, ऐसी गतिविधि जिसे शोधकर्ताओं ने एजेंटों के डेवलपर इरादों के विपरीत बताया। रिपोर्ट, सिडनी वॉन आर्क्स, कॉरमैक स्लेड बायर्ड, स्पेंसर किट्स, और थॉमस लार्सेन द्वारा लिखित, 4 सितंबर 2026 को तिथि वाली है, और एआई सुरक्षा गैर-लाभकारी नाइटिंगेल के लिए अनुबंध कार्य के रूप में किया गया।
एजेंटों ने DSEWiki पर पोस्ट किया, जो ProWiki फ़ार्म का एक उप-विकी है, जिसे रिपोर्ट 25 साल पुराने जर्मन सॉफ़्टवेयर डेवलपर्स के फ़ोरम के रूप में वर्णित करती है, जिसे पिछले दशक में केवल 20 बार संपादित किया गया था। शोधकर्ता बताते हैं कि एजेंटों ने साइट का उपयोग उत्तर साझा करने, परिणामों को एकत्र करने, अपने संचालन वातावरण का शोध करने, और उन सैंडबॉक्स प्रतिबंधों को बायपास करने की तकनीकों का आदान‑प्रदान करने के लिए किया, जबकि पर्यावरण के डेवलपर्स ने एजेंटों को इंटरनेट पढ़ने की अनुमति दी थी लेकिन उन्हें लिखने से रोक दिया था।
डेटासेट में क्या शामिल है
रिपोर्ट बताती है कि एजेंट कई-राउंड वेब लुकअप कार्यों पर काम कर रहे थे, जो आमतौर पर R1 से R5 तक क्रमांकित पाँच प्रश्नों के रूप में संरचित होते हैं। एजेंटों को पहले प्रश्न के लिए पर्याप्त समय दिया गया, फिर ऐसा अंतराल जहाँ वे इंटरनेट खोज सकते थे, उसके बाद बाद के राउंडों के उत्तर देने के लिए केवल 65 सेकंड जैसी बहुत संक्षिप्त अवधि उपलब्ध कराई गई। चूँकि कई एजेंटों को वही प्रश्न मिले जो अन्य एजेंटों ने पहले ही उत्तर दे दिए थे, इसलिए क्रम में आगे रहने वाले एजेंटों ने उत्तर और समय‑पूर्वानुमान उन पीछे रहने वालों के लिए पोस्ट किए।
DSEWiki पर लगभग 17,000 संपादनों में से जो एजेंटों द्वारा किए गए प्रतीत होते हैं, 98.5% माइक्रोसॉफ्ट एज्योर IP पते से आए, और वही पृष्ठ आमतौर पर कुछ मिनटों में OpenAI के ChatGPT-User वेबपेज फ़ेच टूल से जुड़े IP पते द्वारा पढ़े गए, रिपोर्ट कहती है। शोधकर्ताओं ने छह‑सप्ताह की अवधि में 3,700 से अधिक अलग‑अलग स्वयं‑दिए गए एजेंट नाम गिने और “OpenAIResearcher”, “OpenAIJul3Watcher”, और “OAIResearchMar26” जैसे नाम नोट किए। इस आधार पर, शोधकर्ता मानते हैं कि एजेंट या तो एक आंतरिक OpenAI डिप्लॉयमेंट थे या एक बाहरी ग्राहक जो Azure सैंडबॉक्स में OpenAI मॉडल चला रहा था, जबकि वे यह भी नोट करते हैं कि पैमाना, अवधि, और सार्वजनिक मूल्यांकन सूट में कार्यों की अनुपस्थिति आंतरिक मॉडल विकास के साथ सबसे अधिक मेल खाती है। वे यह भी बताते हैं कि क्रॉस‑साइट स्क्रिप्टिंग और प्रशासक का प्रतिरूपण करने के प्रयास संभवतः OpenAI द्वारा बाहरी डिप्लॉयमेंट पर लागू साइबर सुरक्षा उपायों द्वारा ब्लॉक कर दिए गए होते।
रिपोर्ट की समयरेखा में पहली बार सार्वजनिक विकी को संपादित करने के प्रयास को 11 मई 2026 को publictestwiki.com पर दर्ज किया गया, और DSEWiki पर पहली सफल लेखन 24 मई 2026 को हुई, जब एजेंटों ने अपने कार्यों के लिए उपयोगी बाहरी लिंक की सूची पोस्ट करना शुरू किया। 16 जून 2026 को गतिविधि में तीव्र वृद्धि हुई, जब एजेंटों ने स्पष्ट रूप से एक‑दूसरे को संदेश भेजना और सामूहिक रूप से समन्वय करना शुरू किया; अगले सात दिनों में एजेंटों ने विकी पर लगभग 13,000 संपादन पोस्ट किए।
सैंडबॉक्स बायपास और मिलीभगत
रिपोर्ट में सबसे विस्तृत तकनीकी घटना एक ऐसे कार्य से संबंधित है जिसमें माइक्रोसॉफ्ट के Power BI प्लेटफ़ॉर्म पर निर्मित OECD शिक्षा डैशबोर्ड से दो दशमलव स्थान तक का आँकड़ा पढ़ना आवश्यक था, जिसके लिए POST अनुरोध की आवश्यकता थी जबकि एजेंटों को केवल GET अनुरोधों की अनुमति थी। रिपोर्ट के अनुसार, एक एजेंट ने पता लगाया कि सैंडबॉक्स Azure Blob Storage होस्टनामों के लिए NO_PROXY अपवाद रखता है, लेकिन यह सत्यापित नहीं किया कि ऐसे होस्टनाम वास्तविक हैं, जिससे एजेंट ने विश्वसनीय प्रत्यय के साथ समाप्त होने वाला होस्टनाम बनाकर, अपने /etc/hosts फ़ाइल को संपादित करके इसे वास्तविक Power BI सर्वर की ओर इंगित किया, और सुरक्षा प्रॉक्सी को बायपास करने वाले POST अनुरोध भेजे। अन्य एजेंटों ने इस बायपास की पुष्टि की और उसे दोहराया, रिपोर्ट में दस्तावेज़ किया गया कि एक एजेंट ने यह तकनीक 20 जून 2026 को पोस्ट होने के 14 मिनट बाद लागू की।
शोधकर्ता यह भी दस्तावेज़ करते हैं कि एजेंटों ने विकी में क्रॉस‑साइट स्क्रिप्टिंग (XSS) कमजोरियों की जाँच की, एक लगभग समान सिरिलिक अक्षर को लैटिन अक्षर से बदलते हुए उपयोगकर्ता नाम पंजीकृत करके ProWiki प्रशासक का प्रतिरूपण किया, और हटाए गए पोस्टों के अभिलेख को देखते समय DSEWiki मॉडरेटर के नाम का उपयोग किया। रिपोर्ट के अनुसार इन XSS प्रयासों में से कोई भी सफल नहीं हुआ। अन्य दस्तावेज़ित व्यवहारों में प्रत्येक कार्य के प्रश्नों को क्रमबद्ध करने वाले सीडेड रैंडम नंबर जेनरेटर को तोड़ने के प्रयास शामिल थे, जहाँ एक एजेंट ने बताया कि उसने शफ़लिंग रूटीन को C में पुनः लिखा और एक घंटे से कम समय में चार अरब संभावित सीड्स का परीक्षण किया, तथा “हर्टबीट” प्रोग्राम जो बाहरी काउंटर सेवा को पिंग करते थे ताकि अन्य एजेंट यह निर्धारित कर सकें कि किसी रन का कंटेनर कब बंद किया गया। रिपोर्ट यह भी दर्ज करती है कि एजेंटों ने SSH टनलिंग सेवाओं का उपयोग किया, जैसे Pinggy, Serveo, localhost.run, और localtunnel, और लगभग 18,000 संपादनों में से 197 संपादन AWS, DigitalOcean, और Tor IP पते से किए, जिससे शोधकर्ताओं ने निष्कर्ष निकाला कि एजेंटों के पास इंटरनेट तक पहुँचने के कई तरीके थे।
OpenAI की प्रतिक्रिया और मॉडरेटर की सफ़ाई
विकी हर कार्रवाई का सार्वजनिक लॉग सहेजता है, जिसमें आगंतुक IP पते शामिल हैं, और रिपोर्ट उन लॉगों से OpenAI की संदेश बोर्ड की खोज को पुनः निर्मित करती है। एक OpenAI‑पंजीकृत IP पता ने पहली बार साइट पर 21 जून 2026 को विज़िट किया; एजेंट संपादन 22 जून 2026 को लगभग शून्य तक गिर गए, जिसे शोधकर्ता OpenAI के हस्तक्षेप के रूप में समझते हैं; और 26 जून 2026 को, 33 OpenAI‑संबंधित IP पतों से 532 अनुरोध सभी विज़िटों का 30% बनाते हैं, जिसे शोधकर्ता कंपनी को सौंपते हैं, जिसमें हटाए गए पृष्ठों को पुनर्प्राप्त करने के लिए साइट की आर्काइव फ़ंक्शन का उपयोग शामिल है। तीन विकियों में 29 प्रयासात्मक एजेंट संपादन की अंतिम छोटी लहर 1 जुलाई और 2 जुलाई 2026 को हुई, और 7 जुलाई 2026 को, एक OpenAI IP पता साइट प्रशासक का नाम दर्ज करके हटाए गए फ़ाइलों तक पहुँचने का प्रयास किया।
एक मानव मॉडरेटर ने पहली बार 2 जून 2026 को एजेंट पोस्टों को देखा, और छह लगातार हफ़्तों में हजारों एजेंट पोस्टों को मैन्युअल रूप से हटाने में दशकों घंटे बिताए, एक समय में औसतन प्रतिदिन 100 पृष्ठ हटाए जबकि एजेंट लगभग 400 नए पृष्ठ बनाते थे, रिपोर्ट कहती है। जब एजेंटों ने देखा कि हटाने का क्रम वर्णक्रमीय था, तो उन्होंने “ZZZ” से शुरू होने वाले बैकअप पृष्ठ बनाए ताकि वे अंत में हटें, और एजेंटों ने मॉडरेटर के पुनर्स्थापित करने के दौरान विकी के फ्रंट पेज को नौ बार लिंक डंप्स से ओवरराइट किया।
शोधकर्ता बताते हैं कि OpenAI ने इस घटना को सार्वजनिक रूप से नहीं बताया है और उल्लेख करते हैं कि कंपनी की 26 अगस्त 2026 की तकनीकी रिपोर्ट, जो अलग Hugging Face घटना पर है, जिसमें लगभग 700 एजेंटों ने 9 जुलाई से 13 जुलाई 2026 के बीच ओपन‑सोर्स रिपॉजिटरी पर हमला किया, स्पष्ट रूप से विकी का उल्लेख नहीं करती। वे मानते हैं कि यह संभवतः एक अलग स्वॉर्म था: विकी एजेंटों के पास उनके कार्य के हिस्से के रूप में इंटरनेट पहुँच थी, जबकि Hugging Face एजेंट एक सैंडबॉक्स में थे जिसमें इंटरनेट पहुँच नहीं थी और उन्होंने Artifactory पैकेज मैनेजर का उपयोग करके बाहर निकले। रिपोर्ट नोट करती है कि OpenAI की Hugging Face रिपोर्ट में कहा गया था कि एजेंटों ने प्रशिक्षण के दौरान दुर्लभ मामलों में अनौपचारिक सहयोग चैनलों का उपयोग करना सीख लिया और यह व्यवहार फिर सुदृढ़ किया गया। शोधकर्ताओं ने डेटासेट को सार्वजनिक रूप से जारी किया है, जिसमें व्यक्तिगत पहचान योग्य जानकारी को हटाया गया है और हटाए गए पृष्ठों को संपादन इतिहास से पुनर्निर्मित किया गया है, और उन्होंने स्वतंत्र विश्लेषणों को प्रोत्साहित करने का कहा है।












