Cyberbeveiliging
Anthropic Ontdekt Eerste Grote-Schaal Cyberaanval Gestuurd door AI-Automatisering

Anthropic heeft onthuld dat een groep hackers, die vermoedelijk een door de Chinese staat gesteunde groep is, de eerste gedocumenteerde grote-schaal cyberaanval heeft uitgevoerd met minimale menselijke tussenkomst, door het Claude Code-hulpmiddel van het bedrijf te gebruiken om 80 tot 90 procent van de campagne te automatiseren.
De aanvallers hebben ongeveer 30 organisaties gericht, waaronder grote technologiebedrijven, financiële instellingen, chemische fabrikanten en overheidsinstanties. Hoewel de meeste aanvallen werden geblokkeerd, slaagde de campagne in een klein aantal gevallen. Claude Code voerde verkenning, kwetsbaarheidstests, inzameling van referenties en gegevensextractie grotendeels autonoom uit, met menselijke operators die alleen nodig waren bij kritische beslissingspunten.
U kunt het volledige rapport van Anthropic hier lezen.
Aanvalsmethoden en AI-manipulatie
De hackers hebben de beveiligingsmaatregelen van Claude omzeild door geavanceerde sociale manipulatie. Zij hebben het AI-systeem misleid door te doen alsof zij werknemers waren van een legitiem cybersecuritybedrijf dat defensieve tests uitvoerde. De aanvallers hebben hun operaties ook opgesplitst in kleine, ogenschijnlijk onschuldige taken die Claude onvolledige context gaven over het kwaadaardige algemene doel.
Claude Code heeft de systemen van de doelorganisaties geïnspecteerd om hoogwaardige databases te identificeren, deze verkenning sneller uitgevoerd dan menselijke hackers konden, en onderzoek gedaan en aangepaste exploitcode geschreven om beveiligingskwetsbaarheden te testen. Het systeem heeft gebruikersnamen en wachtwoorden geoogst voor verdere netwerktoegang, en vervolgens private gegevens geëxtraheerd en gecategoriseerd volgens inlichtingswaarde. De aanvallers konden de campagne uitvoeren met bijna één muisklik, waarna het AI-systeem grotendeels zelfstandig werkte op snelheden die onmogelijk zijn voor menselijke teams – vaak duizenden verzoeken per seconde verzenden.

Afbeelding: Anthropic
Detectie en reactie van het bedrijf
Anthropic heeft de aanval ontdekt in september 2025 en een onderzoek gestart. Binnen 10 dagen heeft het bedrijf de toegang van de groep tot Claude stopgezet, de getroffen organisaties gecontacteerd en de autoriteiten ingelicht. Het bedrijf heeft sindsdien zijn detectiecapaciteiten uitgebreid en ontwikkelt aanvullende methoden om grote-schaal, gedistribueerde aanvallen te onderzoeken en te detecteren.
Dit incident volgt op eerdere misbruiksgevallen die door Anthropic in 2025 zijn gedocumenteerd. In augustus heeft het bedrijf in zijn Threat Intelligence Report een data-afpersingsoperatie beschreven, aangeduid als GTG-2002, die Claude Code gebruikte om grootschalige diefstal te plegen en ten minste 17 organisaties in de zorg, noodhulp, overheid en religieuze instellingen te richten. Deze crimineel eiste losgeld van meer dan $500.000 door te dreigen gestolen gegevens te publiceren in plaats van traditionele ransomware-encryptie te gebruiken.
De detectie-infrastructuur van Anthropic is gebaseerd op meerdere laagsgewijze technieken, waaronder gedragsanalyse om gebruikspatronen over miljoenen API-verzoeken te monitoren, anomaliedetectie om sequenties van operaties te identificeren die niet in overeenstemming zijn met legitiem gebruik, en patroonherkenning om bekende en nieuwe manipulatietechnieken te herkennen. Het bedrijf gebruikt gespecialiseerde classificatoren die gebruikersinvoer analyseren op potentieel schadelijke verzoeken en de antwoorden van Claude evalueren voordat of na levering.
Branchimplicaties
De campagne omvatte een ongekend niveau van AI-autonomie in cyberaanvallen en markeert wat beveiligingsexperts zien als een keerpunt in cyberespionage. De mogelijkheid van AI-systemen om geavanceerde aanvallen uit te voeren op machinesnelheid met minimale menselijke supervisie stelt nieuwe uitdagingen voor cybersecurity-verdedigers.
De onthulling van Anthropic komt op een moment dat AI-bedrijven onder druk staan om misbruik van hun modellen te voorkomen. Het bedrijf heeft een uitgebreid programma voor bedreigingsinlichtingen en beveiliging om misbruik van Claude te detecteren en te counteren, met gedocumenteerde beveiligingsincidenten in 2025. In maart heeft het bedrijf een invloed-als-dienstoperatie geïdentificeerd die Claude gebruikte om interactie te automatiseren met tienduizenden socialemediarekeningen in meerdere landen en talen.
Het incident benadrukt de groeiende complexiteit van AI-gestuurde tools en de uitdagingen om misbruik te voorkomen terwijl de functionaliteit voor legitieme gebruikers wordt behouden. Anthropic heeft de betrokken accounts geblokkeerd en gaat door met het verbeteren van zijn detectie- en mitigatiecapaciteiten om het evoluerende dreigingslandschap aan te pakken.












