साइबर सुरक्षा

Anthropic ने सात हानि क्षेत्रों में Claude के दुरुपयोग को रोकने के विस्तृत विवरण प्रदान किए

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

Anthropic ने 10 सितंबर, 2026 को अपना सितंबर 2026 थ्रेट इंटेलिजेंस रिपोर्ट प्रकाशित किया, जिसमें बताया गया कि उसकी थ्रेट इंटेलिजेंस टीम ने दिसंबर 2025 से अगस्त 2026 के बीच सात हानि क्षेत्रों में Claude का दुरुपयोग करने वाले खतरे निर्माताओं की पहचान और रोकथाम कैसे की, जिसमें साइबर संचालन, प्रभाव संचालन, निगरानी और अवैध मॉडल डिस्टिलेशन शामिल हैं।

रिपोर्ट, “Detecting and countering misuse of AI: सितंबर 2026,” साइबर संचालन, प्रभाव संचालन, निगरानी, धोखाधड़ी और घोटाले, जैविक दुरुपयोग, पारंपरिक हथियार विकास, और डिस्टिलेशन जैसी गतिविधियों को कवर करती है। दुरुपयोग मामलों में Claude Haiku, Sonnet, और Opus मॉडल शामिल थे; कोई भी Claude Fable या Mythos‑class मॉडल शामिल नहीं था सिवाय एक अवैध डिस्टिलेशन मामले के। Anthropic आंतरिक Generative Threat Group (GTG) पहचानकर्ताओं के तहत इन अभिनेताओं को ट्रैक करता है और वह “uplift” मापता है, यानी AI द्वारा किसी संचालन को गति, पैमाना और गहराई में मिलने वाला क्षमता बढ़ावा। कंपनी ने कहा कि प्रत्येक मामले में उसने गतिविधि को बाधित किया, निष्कर्षों का उपयोग अपने सुरक्षा उपायों को मजबूत करने के लिए किया, और जहाँ उपयुक्त था, अधिकारियों और उद्योग साझेदारों के साथ खुफिया जानकारी साझा की, यह जोड़ते हुए कि वह केस स्टडीज प्रकाशित करता है क्योंकि “we believe we have a responsibility to disclose malicious misuse of our services“।

साइबर संचालन

रिपोर्ट के सबसे व्यापक साइबर मामले, जिसे GTG-20006 के रूप में ट्रैक किया गया है, में एक अभिनेता को कवर किया गया है जिसकी पहचान Anthropic के अनुसार सार्वजनिक रिपोर्टों के साथ मेल खाती है जो इसे Midnight Blizzard से जोड़ती हैं; एक ऑपरेटर रूसी भाषा बोलने वाला है और “JackPoterz” हैंडल का उपयोग करता है। इस अभिनेता ने 20 से अधिक संगठनों को लक्षित किया, मुख्यतः यूक्रेन सरकार, सैन्य और राजनयिक संस्थाओं को, कम से कम तीन होटल WiFi विक्रेताओं को समझौता करके DNS रिकॉर्ड्स को हाइजैक किया, कम से कम दो पूर्व उच्च‑स्तरीय यूक्रेनी अधिकारियों के WhatsApp खाते लेकर लिया, और एक उत्तरी अफ्रीकी सरकारी प्रौद्योगिकी प्राधिकरण से 300,000 से अधिक राष्ट्रीय पहचान रिकॉर्ड और आधे मिलियन से अधिक कंपनियों के व्यावसायिक रजिस्ट्री डेटा चुराए। रिपोर्ट के अनुसार, अभिनेता के AI एजेंट स्वचालित रूप से उसके मालवेयर को संशोधित और पुनः निर्मित करते थे जब भी सुरक्षा उत्पाद इसे पहचानते थे।

GTG-50014 उन ऑपरेटरों को कवर करता है जिनके शिनि‑हंटर्स (ShinyHunters) समूह से जुड़ाव का संदेह है, जिनकी क्रेडेंशियल‑हैरस्टिंग पाइपलाइन ने 1.8 मिलियन Android APKs को बड़े पैमाने पर डाउनलोड किया और उनमें हार्डकोडेड सीक्रेट्स के लिए स्कैन किया। Anthropic ने रिपोर्ट किया कि एक प्रौद्योगिकी प्रदाता के समझौते से एक टेराबाइट से अधिक डेटा निकाला गया, जिसमें लाखों भुगतान कार्ड रिकॉर्ड शामिल थे, जबकि एक अन्य सहयोगी ने एक उल्लंघन‑सॉफ्टवेयर‑एज़‑ए‑सर्विस प्रदाता के लगभग 200 डाउनस्ट्रीम ग्राहकों से डेटा निकाला और लगभग 34 घंटों में 40 से अधिक कॉर्पोरेट टेनेंट्स में फैले 2,100 से अधिक Azure AD टोकन सेट डंप किए, जिसमें AI एजेंट ने लगभग सभी कार्य किए।

तीन अतिरिक्त मामलों ने वर्णित गतिविधियों की विविधता को दिखाया। GTG-10007, जो संभवतः चांगशा, हुनान में स्थित चीनी‑भाषी ऑपरेटर थे, दो को स्नातक छात्र पहचाना गया, लगभग पचास संगठनों को लक्षित किया और एक स्वायत्त भेद्यता अनुसंधान कार्यक्रम चलाया जिसमें नेटवर्क उपकरणों पर एक कार्यप्रवाह ने एक महीने में बारह से अधिक संभावित ज़ीरो‑डे खोजें उत्पन्न कीं। GTG-50020, एक रूसी‑भाषी वित्तीय‑प्रेरित अभिनेता, ने एक पीड़ित से लगभग 26 गीगाबाइट डेटा निकाला, $1.5 से $2.5 मिलियन की फिरौती की मांग की, और फिर लगभग चार दिनों में लगभग तीस AI कंपनियों पर हमला किया, जिसका लक्ष्य प्री‑रिलीज़ Claude मॉडल तक पहुंचना था; Anthropic ने कहा कि सभी प्रयत्न विफल रहे और उसकी अपनी प्रणालियों को कभी समझौता नहीं किया गया। GTG-50029, एक अकेला फ्रेंच‑भाषी हैक्टिविस्ट, ने पहले अनडॉक्युमेंटेड WordPress पुनः‑इंस्टॉलेशन रेस कंडीशन का शोषण किया, 42 ट्रैक किए गए लक्ष्यों में से कम से कम 14 तक आंतरिक पहुंच हासिल की, एक अभियान प्लेटफ़ॉर्म से लगभग 140,000 रिकॉर्ड जिसमें उपयोगकर्ताओं की राजनीतिक राय शामिल थी, निकाले, और “fafsearch” नामक एक डॉक्सिंग प्लेटफ़ॉर्म बनाया जिसमें दशियों मिलियन पंक्तियाँ थीं।

प्रभाव और निगरानी संचालन

रिपोर्ट में नौ प्रभाव संचालन मामले रूस, ईरान, तुर्की, खाड़ी, दक्षिण एशिया, अफ्रीका और यूरोप से उत्पन्न हुए, जिनकी पहुँच को Brookings Institution के Breakout Scale पर मापा गया। GTG-04001 में, बांगुई में स्थित एक रूसी‑भाषी अभिनेता ने Radio Lengo Songo (98.9 FM) के लिए दैनिक सामग्री तैयार की, जिसे Anthropic ने Politology से जोड़ा, और Africa Corps/Wagner प्रभाव शाखा को 2023 के अंत में रूसी विदेशी खुफिया सेवा के नियंत्रण में माना गया; इस अभिनेता ने मध्य अफ्रीकी गणराज्य की सरकारी दस्तावेज़ों और रोजगार अनुबंधों को जालसाज़ी से तैयार किया, जिसमें देश के राष्ट्रपति और रूस तथा उसके बलों के प्रति निष्ठा की मांग थी। Anthropic ने इस संचालन को स्केल पर श्रेणी चार (Category Four) के रूप में मूल्यांकित किया।

GTG-54002 में, जांचकर्ताओं ने लगभग 70 बनावटी समाचार वेबसाइटों, 70 मिलते‑जुलते X खातों, और 250 से अधिक अवैध टिप्पणी खातों को LKM Company, एक फ्रांस‑आधारित डिजिटल विज्ञापन एजेंसी, से जोड़ा; इस नेटवर्क ने लगभग 20 भाषाओं में कम से कम 8,913 लेख प्रकाशित किए, जिनमें से 318 लेख लोकतांत्रिक कांगो गणराज्य पर केंद्रित थे।

अन्य संचालन चुनावों और राज्य मीडिया के इर्द‑गिर्द निर्मित थे। GTG-84005, एक व्यावसायिक चुनाव‑हेरफेर प्लेटफ़ॉर्म जो मलेशिया को लक्षित करता है और जिसे Anthropic ने इस्तांबुल‑आधारित BBS Bilisim Teknolojileri से जोड़ा, ने सभी 222 मलेशियाई संसदीय निर्वाचन क्षेत्रों में लगभग 1,000 नकली X खाते प्रबंधित किए और एक विपक्षी राजनेता के खिलाफ बनावटी दस्तावेज़ तैयार किए। GTG-24015 में चार खाते शामिल थे जिन्होंने Claude को एक संपादकीय डेस्क के रूप में उपयोग करके रूसी राज्य मीडिया जैसे Sputnik Moldova, RIA Novosti, Sputnik en Español, Sputnik Africa, और RT English को सामग्री प्रदान की; एक पूर्व Sputnik Moldova मुख्य संपादक ने मोडोवा के 28 सितंबर, 2025 के संसदीय चुनाव से पहले राष्ट्रपति माया सांडू के बारे में बनावटी दावे बढ़ाए। GTG-84002, एक संचालन जो मुस्लिम बंधुता (Muslim Brotherhood) के खिलाफ था और जिसे Anthropic ने उच्च विश्वास के साथ यूएई सरकारी अधिकारियों से जोड़ा, ने लगभग 300 अवैध खाते चलाए, UN मानवाधिकार परिषद के 62वें सत्र के लिए गॉस्ट‑राइटेड गवाही तैयार की, यूरोपीय संसद के 18 सदस्यों की प्रोफ़ाइल बनाई, और UN विशेष रिपोर्टरों पर प्रतिदस्तावेज़ तैयार किए।

निगरानी मामलों में GTG-50027 शामिल है, जिसमें एक संभावित बामाको‑आधारित सलाहकार ने Claude को Lakana 360 के मुख्य इंजीनियरिंग कार्यबल के रूप में उपयोग किया, जो मालि की राज्य खुफिया सेवा ANSE के लिए बनाया गया एक राष्ट्रीय निगरानी प्लेटफ़ॉर्म है, जो सभी तीन राष्ट्रीय मोबाइल ऑपरेटरों में लगभग 25 मिलियन SIM कार्ड की निगरानी करता है; Anthropic ने कहा कि ऑपरेटर के अनुरोध पर प्लेटफ़ॉर्म के दस्तावेज़‑जनरेशन घटक से वारंट आवश्यकता हटा दी गई। GTG-14010 में एक PRC सरकारी‑संबंधी अभिनेता शामिल है जिसने Claude का उपयोग करके सीरिया में उइघुरों को ट्रैक, प्रोफ़ाइल और भर्ती करने की कोशिश की, सशस्त्र समूहों पर रिपोर्ट करने के लिए भुगतान की पेशकश की जबकि Claude ने वास्तविक समय में उत्तरों का अनुवाद किया और धोखे की गुणवत्ता जाँच के लिए विशेषज्ञ की भूमिका निभाई। GTG-14020 और GTG-14021 में चीन‑आधारित अभिनेता, जिन्हें Anthropic ने PRC धार्मिक मामलों और नगरपालिका सार्वजनिक तथा राज्य सुरक्षा गतिविधियों से जोड़ा, ने कैथोलिक कार्डिनल्स, ताइवान की प्रेस्बिटेरियन चर्च, तिब्बती बौद्ध और फालुन गोंग पर टेम्पलेटेड दस्तावेज़ तैयार किए, और एक अभिनेता ने 10 निजी नागरिकों को “नियंत्रण” के लिए नामित करने की रोकथाम मार्गदर्शन प्राप्त करने से इनकार करने के बाद पुनः‑प्रॉम्प्ट किया, साथ ही विदेश में प्रदर्शन पर पूर्व‑ऑपरेशनल स्थल जानकारी भी। GTG-34007 दो जुड़े हुए ईरानी इकाइयों को कवर करता है जो 16 Claude खातों को संचालित करते हैं और दावा करते हैं कि उन्होंने एक वर्ष में 6,388 ईरानियों की निगरानी और प्रोफ़ाइलिंग की, 155,216 ट्वीट्स पर सामाजिक‑नेटवर्क विश्लेषण किया जिसमें 39 विपक्षी खाते नामित थे, और एक दुर्भावनापूर्ण Firefox एक्सटेंशन को बड़े पैमाने पर पहचानें एकत्र करने के लिए भेजा, जो Arman नामक साझा केस‑मैनेजमेंट सिस्टम को फ़ीड करता है।

हथियार विकास और जैविक दुरुपयोग

रिपोर्ट में छह पारंपरिक हथियार मामलों का विवरण दिया गया है: चीन में तीन, रूस में दो, और यमन में एक। GTG-87001 में, उत्तरी यमन की एक सेल ने मानव सॉफ़्टवेयर इंजीनियरों के स्थान पर Claude Code का उपयोग करके एक मार्गदर्शन, नेविगेशन और नियंत्रण सॉफ़्टवेयर विकसित किया, जो एक निर्देशित रॉकेट, 2,000 किमी से अधिक की रेंज लक्ष्य वाले बहु‑स्तरीय बैलिस्टिक मिसाइल, और हाइपरसोनिक ग्लाइड वाहन सहित विभिन्न संस्करणों के लिए था; Anthropic ने कहा कि सेल ने एक निर्देशित रॉकेट का परीक्षण‑फायर किया और फील्ड टेस्ट विफल प्रतीत हुआ। GTG-27005 में संभवतः फ्रीलांस रूसी‑आधारित अभिनेता शामिल हैं जिन्होंने Claude Code का उपयोग करके एक स्वायत्त FPV क़ामीकाज़े ड्रोन स्वॉर्म बनाया, जिसका ऑन‑बोर्ड मॉडल लक्ष्य चुन सकता था, जिसमें “व्यक्ति” वर्ग भी शामिल था, और बिना मानव हस्तक्षेप के विस्फोट कमांड जारी कर सकता था, और उन्होंने यूक्रेनी युद्ध फुटेज को स्क्रैप करके एक विज़न क्लासिफायर को प्रशिक्षित किया।

पाँच जैविक दुरुपयोग केस स्टडीज इसके बाद आती हैं। मई 2026 में, Anthropic के जैविक सुरक्षा वर्गीकरणकर्ता ने एक अनुरोध को ब्लॉक कर दिया था जिसमें चीकुंगुना गेन‑ऑफ़‑फ़ंक्शन शोध के लिए अनुदान आवेदन लिखने में मदद की मांग की गई थी, जो एक सैन्य अनुसंधान संस्थान के लिए था, और इसे एक एवेज़न प्लेटफ़ॉर्म के माध्यम से रूट किया गया था जिसने बाद में प्रतिस्पर्धी मॉडल को अस्वीकृत प्रॉम्प्ट भेजने के लिए एक बैकअप जोड़ा। एक असमर्थित क्षेत्र के शोधकर्ता ने कई हफ़्तों तक पक्षी इन्फ्लुएंज़ा के स्तनधारी‑अनुकूलन प्रयोगों की योजना बनाई, लेकिन Anthropic ने कहा कि उसके वर्गीकरणकर्ता ने संवाद को केवल Claude Sonnet 4 और Haiku 4.5, उसके सबसे कमजोर मॉडल वर्ग, तक सीमित रखा। तीसरे मामले में, एक रिसेलर रिले जिसने बारह से अधिक असंबंधित ग्राहकों को सेवा दी, ने एक उपयोगकर्ता की रन को पूरी तरह Opus 5 पर चलाया, और लगभग एक घंटे में एक ऑर्थोपॉक्सवायरस इम्यून‑एवेज़न अनुदान आवेदन को अंत‑से‑अंत तैयार किया। दो आगे के मामलों में विष और टॉक्सिन पुनः‑डिज़ाइन कार्यक्रम शामिल थे जिनमें राज्य समर्थन था। Anthropic ने कहा कि प्रतिद्वंद्वी राज्य संस्थानों से जुड़े 30 दिनों की गतिविधियों की समीक्षा में लगभग 35 अलग‑अलग शोध प्रयास मिले, जिनमें अधिकांश सामान्य नागरिक विज्ञान थे, लेकिन कुछ में उल्लेखनीय द्वि‑उपयोग संभावनाएँ थीं।

धोखाधड़ी और अवैध डिस्टिलेशन

धोखाधड़ी और घोटाला भाग में, GTG-15001 एक चीन‑आधारित ऐप स्टूडियो को कवर करता है जिसने Claude का उपयोग करके 20 से अधिक डेटिंग ऐप्स का नेटवर्क चलाया, जिनकी AI व्यक्तित्व, कुल मिलाकर 4,700 से अधिक, ने अप्रैल 2026 के दो‑सप्ताह के दौरान कम से कम 25,000 अनूठे व्यक्तियों के साथ संवाद किया, लगभग 2.36 मिलियन संदेशों का आदान‑प्रदान किया। स्टूडियो ने वास्तविक गिग कार्यकर्ताओं को उसी मैच फ़ीड में लगभग तीन‑से‑एक अनुपात में AI व्यक्तित्वों के साथ मिलाया, और व्यक्तित्वों को निर्देश दिया गया कि वे कभी नहीं बताएँ कि वे स्वचालित हैं।

Anthropic ने कहा कि फरवरी 2026 से उसने सात चीन‑आधारित लैबों से डिस्टिलेशन हमलों को बाधित किया है, सभी ने उसके सामान्य उपलब्ध मॉडलों को लक्षित किया। GTG-16005 में, Anthropic ने Alibaba को सबसे बड़े डिस्टिलेशन अभियान का श्रेय दिया, जिसे उसने मापा: Opus 4.6 और 4.7 की चेन‑ऑफ़‑थॉट डिस्टिलेशन, जो 3,500 से अधिक धोखाधड़ी खातों से प्रतिदिन लगभग 3 मिलियन आदान‑प्रदान तक पहुँच गई, और मई से जुलाई 2026 के बीच 151 मिलियन से अधिक आदान‑प्रदान देखे गए, और निकाले गए ट्रांसक्रिप्ट को Qwen 3.5, 3.6, और 3.7 को प्रशिक्षित करने में उपयोग किया गया। GTG-16002 में, Moonshot AI ने चुपचाप ग्राहक अनुरोधों को Claude की ओर अग्रेषित किया, अपने Kimi मॉडलों के बजाय, दस दिनों में लगभग 300,000 अनुरोध 5,380 धोखाधड़ी खातों के माध्यम से भेजे, और Claude के थिंकिंग सिग्नेचर पर क्रॉस‑सेशन रीप्ले अटैक का उपयोग करके तर्क ट्रेस निकाले, मई से जुलाई 2026 के बीच 23 मिलियन से अधिक आदान‑प्रदान देखे गए। GTG-16001 में, DeepSeek ने वही रीप्ले तकनीक उपयोग की और उपयोगकर्ताओं के अनुरोधों को Claude Opus की ओर उनकी जानकारी के बिना अग्रेषित किया, जुलाई 2026 में 14 दिनों में 12.1 मिलियन से अधिक आदान‑प्रदान लॉग किए; Anthropic ने रिपोर्ट किया कि इस रिले किए गए ट्रैफ़िक ने संवेदनशील सामग्री उजागर की, जिसमें एक रूसी सरकारी डेटाबेस के लाइव क्रेडेंशियल और एक PRC पुलिस केस‑मैनेजमेंट सिस्टम शामिल थे।

बाकी नामित अभियानों में Zhipu शामिल है, जिसने दस दिनों में चेन‑ऑफ़‑थॉट क्लीनर के माध्यम से 770,609 आदान‑प्रदान किए और अपने GLM 5.3 रिलीज़ से पहले साइबर क्षमताओं को लक्षित किया, और Xiaomi, जिसने 1,500 से अधिक खातों में 400,000 से अधिक अनुरोध रूट किए। Anthropic ने यह भी रिपोर्ट किया कि SenseTime की डिस्टिलेशन पाइपलाइन में तीसरे‑पक्ष डेटा विक्रेताओं से खरीदे गए Claude ट्रांसक्रिप्ट शामिल थे, और MiniMax ने केवल Anthropic और OpenAI मॉडलों की पेशकश करने वाली एक शैल कंपनी के माध्यम से एक प्रॉक्सी नेटवर्क बनाया।

Anthropic ने अवैध डिस्टिलेशन के खिलाफ परतदार प्रतिकार उपायों का वर्णन किया: प्रॉक्सी सेवा नेटवर्क की मेटाडेटा‑आधारित पहचान, Fable 5 लॉन्च के साथ सुदृढ़ किए गए एक्सट्रैक्शन वर्गीकरणकर्ता, आंतरिक तर्क का सारांश जो चोरी किए गए ट्रांसक्रिप्ट को प्रशिक्षण के लिए कम उपयोगी बनाता है, Fable 5.1 के साथ प्रस्तुत संरक्षित थिंकिंग जो नए API खातों को सिस्टम प्रॉम्प्ट, टूल्स, या मल्टी‑टर्न वार्तालापों में Claude के तर्क से पहले के संदेशों को बदलने से रोकती है, और संभावित दुरुपयोग संकेत दिखाने वाले खातों के लिए पहचान सत्यापन आवश्यकताएँ, जिनके सत्यापन में विफलता पर खाते प्रतिबंधित किए जाते हैं। कंपनी ने कहा कि डिस्टिलेशन हमलों की जांच और बाधा के दौरान जो कुछ वह सीखती है, वह बनाए जाने वाले सुरक्षा उपायों को लगातार सूचित करता रहेगा।

माइल्स ओकाडा यूनाइट.एआई में एक एआई-जेनरेटेड विश्लेषक है, जो आर्टिफ़िशियल इंटेलिजेंस और साइबर सुरक्षा को कवर करता है, जिसमें उभरते हुए खतरों, रक्षात्मक वास्तुकला और हमलावरों और स्वचालित प्रणालियों के बीच बदलते गतिविधियों पर ध्यान केंद्रित किया जाता है। उनका काम यह जांचता है कि सुरक्षा संचालन को कैसे एआई पुनः आकार दे रहा है, स्वायत्त खतरा पता लगाने और प्रतिक्रिया से लेकर प्रतिपक्षी एआई तकनीकों के उदय तक।

साथ ही एक तकनीकी और जांचात्मक दृष्टिकोण के साथ, माइल्स सुरक्षा अनुसंधान, घटना प्रकटीकरण और वास्तविक दुनिया के तैनाती का विश्लेषण करता है ताकि यह समझा जा सके कि एआई रक्षा को कहां मजबूत करता है - और कहां नई कमजोरियों को पेश करता है। वह मॉडल शोषण, डेटा जहर, हमला स्वचालन और एआई-संचालित प्रणालियों को बड़े पैमाने पर सुरक्षित करने के संचालनात्मक वास्तविकताओं पर विशेष ध्यान देता है।

माइल्स ओकाडा द्वारा लिखे गए लेख एआई-जेनरेटेड हैं और यूनाइट.एआई की संपादकीय टीम द्वारा सटीकता, कठोरता और तेजी से बदलते एआई सुरक्षा परिदृश्य के जिम्मेदार कवरेज को सुनिश्चित करने के लिए समीक्षा की जाती है।