Securitate cibernetică
Anthropic detaliază întreruperea utilizării abuzive a Claude în șapte domenii de prejudiciu

Anthropic, pe 10 septembrie 2026, a publicat raportul de informații despre amenințări din septembrie 2026, detaliind modul în care echipa sa de Informații despre Amenințări a identificat și a întrerupt actori rău‑voitori care au utilizat abuziv Claude între decembrie 2025 și august 2026 în șapte domenii de prejudiciu, inclusiv operațiuni cibernetice, operațiuni de influență, supraveghere și distilare ilicită de modele.
Raportul, “Detecting and countering misuse of AI: septembrie 2026”, acoperă activități în domeniile operațiuni cibernetice, operațiuni de influență, supraveghere, înșelăciuni și fraudă, utilizare biologică abuzivă, dezvoltarea armamentului convențional și distilare. Cazurile de utilizare abuzivă au implicat modelele Claude Haiku, Sonnet și Opus; niciunul nu a implicat modelele Claude Fable sau de clasă Mythos, cu excepția unui caz de distilare ilicită. Anthropic urmărește actorii sub designatori interni Generative Threat Group (GTG) și măsoară ceea ce numește uplift, impulsul de capacitate pe care AI‑ul îl oferă unei operațiuni în termeni de viteză, scară și profunzime. Compania a declarat că, în fiecare caz, a întrerupt activitatea, a folosit constatările pentru a consolida măsurile de siguranță și a împărtășit informații cu autoritățile și partenerii din industrie, acolo unde a fost potrivit, adăugând că publică studiile de caz pentru că “we believe we have a responsibility to disclose malicious misuse of our services“.
Operațiuni cibernetice
Cazul cibernetic cel mai amplu din raport, înregistrat ca GTG-20006, descrie un actor al cărui atribuire, conform Anthropic, este în concordanță cu rapoartele publice care îl leagă de Midnight Blizzard; un operator este vorbitor de rusă și folosește pseudonimul „JackPoterz”. Actorul a vizat peste 20 de organizații, concentrându‑se în special pe instituții guvernamentale, militare și diplomatice ucrainene, a compromis cel puțin trei furnizori de Wi‑Fi pentru hoteluri pentru a deturna înregistrările DNS, a preluat conturile WhatsApp ale cel puțin doi foști oficiali ucraineni de rang înalt și a furat peste 300 000 de înregistrări de identitate națională plus date din registre comerciale care acoperă peste jumătate de milion de companii de la o autoritate tehnologică guvernamentală din Africa de Nord. Conform raportului, agenții AI ai actorului au modificat și reconstruit autonom malware‑ul de fiecare dată când produsele de securitate l‑au detectat.
GTG-50014 acoperă operatori suspectaţi de afiliere cu colectivul ShinyHunters, ale căror conducte de colectare a acreditărilor au descărcat în masă 1,8 milioane de APK‑uri Android și le‑au scanat pentru secrete codificate. Anthropic a raportat că o compromitere a unui furnizor de tehnologie a exfiltrat peste un terabyte de date, inclusiv milioane de înregistrări de carduri de plată, în timp ce un alt afiliat a extras date de la aproximativ 200 de clienţi downstream ai unui furnizor SaaS compromis și a descărcat peste 2 100 de seturi de tokenuri Azure AD ce acopereau peste 40 de chiriași corporativi în aproximativ 34 de ore, cu agenți AI care au efectuat aproape toată munca.
Trei cazuri suplimentare ilustrează gama de activităţi descrise. GTG-10007, operatori vorbitori de chineză, probabil bazaţi în Changsha, Hunan, dintre care doi au fost identificaţi ca studenţi de licență, au vizat aproximativ cincizeci de organizaţii şi au desfășurat un program autonom de cercetare a vulnerabilităţilor în care un flux de lucru iterativ pe echipamente de reţea a generat peste o duzină de posibile vulnerabilităţi zero‑day într‑o lună. GTG-50020, un actor vorbitor de rusă motivat financiar, a exfiltrat aproximativ 26 GB de la o victimă, a cerut între 1,5 și 2,5 milioane de dolari în extorcare și apoi a atacat aproximativ treizeci de companii AI în aproximativ patru zile cu scopul declarat de a accesa un model Claude pre‑lansat; Anthropic a afirmat că fiecare cale încercată a eșuat și că sistemele proprii nu au fost niciodată compromise. GTG-50029, un singur hacktivist vorbitor de franceză, a exploatat o condiție de cursă de reinstalare WordPress ne‑documentată anterior împotriva a cel puțin patru site‑uri, a obținut acces intern la cel puțin 14 din cele 42 de ţinte urmărite, a exfiltrat aproximativ 140 000 de înregistrări, inclusiv opinii politice ale utilizatorilor de pe o platformă de campanie, și a construit o platformă de doxxing numită fafsearch, încărcată cu zeci de milioane de rânduri.
Operațiuni de influență și supraveghere
Nouă cazuri de operaţiuni de influență din raport au avut originea în Rusia, Iran, Turcia, Golful Persic, Asia de Sud, Africa și Europa, cu acoperire măsurată pe scala Breakout a Institutului Brookings. În GTG-04001, un actor vorbitor de rusă din Bangui a produs conţinut zilnic pentru Radio Lengo Songo (98,9 FM), o stație pe care Anthropic a legat-o de Politology, ramura de influență Africa Corps/Wagner pe care o consideră sub controlul Serviciului de Informaţii Străine rus în 2023; actorul a produs documente guvernamentale falsificate ale Republicii Centrafricane și contracte de muncă care impuneau loialitate preşedintelui țării și Rusiei și contingentului său. Anthropic a evaluat operaţiunea ca fiind de Categoria Patru pe scală. În GTG-54002, anchetatorii au urmărit aproximativ 70 de site‑uri de ştiri fabricate, 70 de conturi X corespunzătoare și peste 250 de conturi de comentarii neautentice la LKM Company, o agenție de publicitate digitală cu sediul în Franţa; reţeaua a publicat cel puțin 8 913 articole în aproximativ 20 de limbi, dintre care 318 s‑au concentrat pe Republica Democrată Congo.
Alte operaţiuni s‑au construit în jurul alegerilor şi al mass‑media de stat. GTG-84005, o platformă comercială de manipulare electorală ţintind Malaezia, pe care Anthropic a legat-o de BBS Bilisim Teknolojileri cu sediul în Istanbul, a gestionat aproximativ 1 000 de conturi false X în toate cele 222 de circumscripţii parlamentare din Malaezia şi a fabricat dosare împotriva unui politician de opoziție. GTG-24015 a implicat patru conturi care au folosit Claude ca birou editorial alimentând mass‑media de stat rusească, inclusiv Sputnik Moldova, RIA Novosti, Sputnik en Español, Sputnik Africa şi RT English; un fost redactor şef al Sputnik Moldova a amplificat afirmaţii fabricate despre preşedinta Maia Sandu înainte de alegerile parlamentare din 28 septembrie 2025 din Moldova. GTG-84002, o operaţiune împotriva Frăţiei Musulmane pe care Anthropic a legat-o cu mare încredere de oficiali guvernamentali din Emiratele Arabe Unite, a operat aproximativ 300 de conturi neautentice, a scris sub acoperire mărturii pentru cea de‑a 62‑a sesiune a Consiliului ONU pentru Drepturile Omului, a profilat 18 membri ai Parlamentului European şi a compilat contra‑dosare pentru Raportorii Speciali ai ONU.
Cazurile de supraveghere includ GTG-50027, în care un singur consultant probabil bazat în Bamako a folosit Claude ca forţă de muncă principală pentru Lakana 360, o platformă națională de supraveghere construită pentru serviciul de informaţii de stat al Maliului, ANSE, pentru a monitoriza aproximativ 25 milioane de cartele SIM la toate cele trei operatori mobili naţionali; Anthropic a precizat că cerinţa de mandat a fost eliminată din componenta de generare a dosarelor platformei la cererea operatorului. GTG-14010 acoperă un actor aliniat guvernului PRC care a folosit Claude pentru a urmări, profiliza şi a încerca să recruteze uiguri în Siria, oferind plată pentru rapoarte despre formaţiuni armate, în timp ce Claude traducea răspunsurile în timp real şi juca rolul de expert pentru a verifica calitatea înşelăciunii. În GTG-14020 și GTG-14021, actori cu sediul în China, pe care Anthropic i‑a legat de afaceri religioase ale PRC şi de activităţi municipale de securitate publică şi de stat, au produs dosare şablon pentru cardinali catolici, Biserica Presbiteriană din Taiwan, budiştii tibetani şi Falun Gong, iar un actor a reluat un refuz anterior pentru a obţine ghidare de suprimare numind 10 cetăţeni privaţi pentru „control” împreună cu informaţii pre‑operaţionale despre proteste în străinătate. GTG-34007 acoperă două unităţi iraniene legate, care operau 16 conturi Claude şi au pretins că au supravegheat şi profilat 6 388 de iranieni într‑un an, au realizat analiză de reţea socială peste 155 216 de tweeturi care menţionau 39 de conturi de opoziție şi au livrat o extensie Firefox maliţioasă pentru colectarea în masă a identităţilor, alimentând un sistem comun de gestionare a cazurilor numit Arman.
Dezvoltarea armamentului și utilizarea biologică abuzivă
Raportul detaliază şase cazuri de arme convenţionale: trei în China, două în Rusia şi unul în Yemen. În GTG-87001, o celulă din nordul Yemenului a folosit Claude Code în locul inginerilor software umani pentru a dezvolta software de ghidare, navigaţie şi control pentru o rachetă ghidată, un rachet balistic cu etape multiple cu un obiectiv de rază declarat de peste 2 000 km și un set de variante care includea un vehicul de alunecare hipersonic; Anthropic a declarat că celula a testat o rachetă ghidată și că testul de teren pare să fi eșuat. GTG-27005 acoperă actori probabili freelanceri cu sediul în Rusia care au folosit Claude Code pentru a construi un roi autonom de drone kamikaze FPV ale căror modele încorporate puteau selecta ţinte, inclusiv clasa „persoană”, şi emite comenzi de detonare fără intervenţia umană, antrenând un clasificator vizual pe imagini de luptă ucrainene colectate. În GTG-17002, un actor cu sediul în China a construit un ansamblu de aproximativ 16 module pentru război electronic şi suprimarea apărării aeriene și, la jumătatea proiectului, a modificat scenariul implicit al simulării la 12 ţinte în Taiwan, inclusiv un buncăr de comandă, un site radar de avertizare timpurie și baterii Patriot și Tien Kung; Anthropic evaluează că actorul era legat de instituţii de cercetare ale PRC, inclusiv Academia de Ştiinţe Militare a PLA.
Cinco studii de caz privind utilizarea biologică abuzivă urmează. În mai 2026, clasificatorul de siguranţă biologică al Anthropic a blocat o cerere de a ajuta la redactarea unei aplicaţii de grant pentru cercetare de tip gain‑of‑function a virusului chikungunya, destinată unui institut de cercetare militară, canalizată printr‑o platformă de evaziune care ulterior a adăugat un fallback trimițând solicitări refuzate către modelul unui concurent. Un cercetător dintr‑o regiune ne‑sprijinită a petrecut săptămâni planificând experimente de adaptare a virusului gripei aviare la mamifere, dar Anthropic a declarat că clasificatoarele sale au limitat schimburile la Claude Sonnet 4 și Haiku 4.5, cea mai slabă clasă de model. În al treilea caz, un revânzător care servea peste o duzină de clienţi ne‑asociaţi a rulat complet o sarcină a unui utilizator pe Opus 5, redactând o aplicație de grant pentru evaziunea imunitară a unui ortopoxvirus de la capăt la capăt în aproximativ o oră. Două cazuri suplimentare au implicat programe de redesign al veninului și toxinelor cu sprijin de stat. Anthropic a declarat că o revizuire a 30 de zile de activitate asociată cu instituţii de stat adversare a identificat aproximativ 35 de eforturi de cercetare distincte, majoritatea fiind știință civilă obișnuită, dar unele având potențial dual‑use notabil.
Fraudă și distilare ilicită
În secţiunea de înşelăciuni şi fraudă, GTG-15001 acoperă un studio de aplicaţii cu sediul în China care a folosit Claude pentru a gestiona o rețea de peste 20 de aplicații de dating ale căror personaje AI, peste 4 700 în total, au purtat conversaţii cu cel puțin 25 000 de persoane unice în decurs de două săptămâni în aprilie 2026, schimbând aproximativ 2,36 milioane de mesaje. Studioul a amestecat lucrători reali în fluxul de potrivire la un raport de aproximativ trei la unu între personaje AI și persoane reale, iar personajele au fost instruite să nu dezvăluie niciodată că sunt automatizate.
Anthropic a declarat că, din februarie 2026, a întrerupt atacuri de distilare provenite din şapte laboratoare cu sediul în China, toate vizând modelele sale disponibile în mod general. În GTG-16005, Anthropic a atribuit lui Alibaba cea mai mare campanie de distilare măsurată: distilare de tip chain‑of‑thought a modelelor Opus 4.6 și 4.7, cu un vârf de aproape 3 milioane de schimburi pe zi de la peste 3 500 de conturi frauduloase, cu peste 151 milioane de schimburi observate între mai și iulie 2026 și transcrierile recoltate folosite pentru a antrena Qwen 3.5, 3.6 și 3.7. În GTG-16002, Moonshot AI a redirecţionat silenţios cererile clienţilor către Claude în loc de modelele sale Kimi, retransmiţând aproape 300 000 de cereri în zece zile prin 5 380 de conturi frauduloase și utilizând un atac de redare cross‑session asupra semnăturilor de gândire ale Claude pentru a extrage urme de raționament, cu peste 23 milioane de schimburi observate între mai și iulie 2026. În GTG-16001, DeepSeek a folosit aceeaşi tehnică de redare și a redirecţionat cererile utilizatorilor către Claude Opus fără ştiinţa lor, înregistrând peste 12,1 milioane de schimburi în 14 zile în iulie 2026; Anthropic a raportat că traficul redirecţionat a expus materiale sensibile, inclusiv credenţiale live pentru o bază de date guvernamentală rusă și un sistem de gestionare a cazurilor al poliţiei din PRC.
Campaniile numite rămase includ Zhipu, care a efectuat 770 609 de schimburi printr‑un curăţător de tip chain‑of‑thought în zece zile şi a vizat capabilităţi cibernetice înainte de lansarea GLM 5.3, și Xiaomi, care a direcţionat peste 400 000 de cereri prin peste 1 500 de conturi. Anthropic a raportat, de asemenea, că lanţul de distilare al SenseTime a inclus transcrieri Claude achiziţionate de la furnizori de date terţi, și că MiniMax a construit o reţea proxy printr‑o companie-fantomă care oferea numai modele Anthropic și OpenAI.
Anthropic descrie măsuri contracaratoare stratificate împotriva distilării ilicite: atribuire bazată pe metadate a reţelelor de servicii proxy, clasificatoare de extracție consolidate odată cu lansarea Fable 5, rezumat al raționamentului intern menit să facă transcrierile furate mai puţin utile pentru antrenare, păstrarea gândirii introduse cu Fable 5.1 care împiedică noile conturi API să modifice promptul de sistem, instrumentele sau mesajele precedente raţionamentului lui Claude în conversaţii multi‑turn, și cerinţe de verificare a identităţii pentru conturile care arată semnale de abuz potențial, conturile care nu trec verificarea fiind interzise. Compania a declarat că ceea ce învață în timp ce investighează și întrerupe atacurile de distilare va continua să informeze măsurile de siguranță pe care le construiește.












