Securitate cibernetică

Anthropic Expune Primul Atac Cibernetic la Scară Largă Bazat pe Automatizarea Inteligenței Artificiale

mm
Adaugă Unite.AI la sursele tale preferate pe Google

Anthropic a dezvăluit că un grup de hackeri, pe care îi suspectează a fi o grupare sponsorizată de statul chinez, a desfășurat primul atac cibernetic la scară largă documentat, executat cu intervenție umană minimă, utilizând instrumentul Claude Code pentru a automatiza 80-90% din campanie.

Atacatorii au vizat aproximativ 30 de organizații din marile companii de tehnologie, instituții financiare, producători de chimicale și agenții guvernamentale. Deși majoritatea atacurilor au fost blocate, campania a reușit într-un număr mic de cazuri. Claude Code a efectuat recunoașterea, testarea vulnerabilităților, colectarea de credențiale și extragerea de date în mare parte autonom, cu operatori umani necesari doar la punctele de decizie critice.

Puteți citi raportul complet al Anthropic aici.

Metode de Atac și Manipulare a Inteligenței Artificiale

Hackerii au ocolit sistemele de securitate ale lui Claude prin inginerie socială sofisticată. Ei au înșelat sistemul de inteligență artificială, pretinzând a fi angajați ai unei companii de securitate cibernetică legitime care efectuează teste defensive. Atacatorii au fragmentat operațiunile în sarcini mici, aparent inofensive, care au furnizat lui Claude contextul incomplet despre scopul malign general.

Claude Code a inspectat sistemele organizațiilor vizate pentru a identifica bazele de date de înaltă valoare, a efectuat recunoașterea mai rapid decât hackerii umani ar fi putut, și a cercetat și scris cod de exploatare personalizat pentru a testa vulnerabilitățile de securitate. Sistemul a colectat nume de utilizator și parole pentru accesul suplimentar la rețea, apoi a extras și a categorisit datele private în funcție de valoarea lor de informații. Atacatorii au putut executa campania cu practic un singur clic, după care inteligența artificială a funcționat în mare parte singură, la viteze imposibile pentru echipele umane – adesea trimițând mii de solicitări pe secundă.

Imagine: Anthropic

Detectare și Răspuns al Companiei

Anthropic a detectat atacul la mijlocul lunii septembrie 2025 și a lansat imediat o investigație. În decurs de 10 zile, compania a oprit accesul grupului la Claude, a contactat organizațiile afectate și a notificat autoritățile. Compania a extins de atunci capacitățile sale de detectare și dezvoltă metode suplimentare pentru a investiga și detecta atacurile la scară largă și distribuite.

Acest incident urmează unor cazuri anterioare de abuz documentate de Anthropic în 2025. În luna august, Raportul de Informații cu Privire la Amenințări al companiei a detaliat o operațiune de extorcare de date, urmărită sub numele de cod GTG-2002, care a utilizat Claude Code pentru a comite furt la scară largă, vizând cel puțin 17 organizații din domeniul sănătății, serviciilor de urgență, guvernului și instituțiilor religioase. Acest criminal a cerut răscumpărări care depășeau 500.000 de dolari, amenințând să expună datele furate, în loc să utilizeze criptarea tradițională a ransomware-ului.

Infrastructura de detectare a Anthropic se bazează pe tehnici în straturi multiple, incluzând analiza comportamentală pentru a monitoriza modelele de utilizare pe milioane de solicitări API, detectarea anomaliilor pentru a identifica secvențe de operațiuni inconsistente cu utilizarea legitimă și potrivirea șablonului pentru a recunoaște tehnici de manipulare cunoscute și noi. Compania utilizează clasificatori specializați care analizează intrările utilizatorilor pentru solicitări potențial dăunătoare și evaluează răspunsurile lui Claude înainte sau după livrare.

Implicații pentru Industrie

Campania a implicat un nivel fără precedent de autonomie a inteligenței artificiale în atacurile cibernetice și marchează ceea ce experții în securitate consideră a fi un punct de cotitură în spionajul cibernetic. Capacitatea sistemelor de inteligență artificială de a desfășura atacuri sofisticate la viteza mașinilor, cu supraveghere umană minimă, ridică noi provocări pentru apărătorii securității cibernetice.

Dezvăluirea Anthropic vine într-un moment în care companiile de inteligență artificială se confruntă cu presiuni crescânde pentru a preveni utilizarea abuzivă a modelelor lor. Compania menține un program cuprinzător de informații cu privire la amenințări și măsuri de securitate pentru a detecta și contracara abuzul de inteligență artificială, cu incidente de securitate documentate pe tot parcursul anului 2025. În luna martie, compania a identificat o operațiune de influență sub formă de serviciu care a utilizat Claude pentru a automatiza interacțiunea cu zeci de mii de conturi de social media din multiple țări și limbi.

Incidentul subliniază sofisticarea crescândă a instrumentelor bazate pe inteligență artificială și provocările de a preveni abuzul lor, menținând în același timp utilitatea pentru utilizatorii legitimi. Anthropic a interzis conturile asociate și continuă să îmbunătățească capacitățile sale de detectare și atenuare pentru a aborda evoluția peisajului amenințărilor.

Alex McFarland este un jurnalist și scriitor de inteligență artificială, care explorează cele mai recente dezvoltări în domeniul inteligenței artificiale. El a colaborat cu numeroase startup-uri de inteligență artificială și publicații din întreaga lume.