Cybersikkerhed

Anthropic afslører den første storstilet cyberangreb drevet af AI-automatisering

mm
Føj Unite.AI til dine foretrukne kilder på Google

Anthropic har offentliggjort, at en gruppe hackere, som de formoder er en kinesisk statsstøttet gruppe, har udført den første dokumenterede storstilet cyberangreb, der blev udført med minimal menneskelig indgriben, ved at bruge virksomhedens Claude Code-værktøj til at automatisere 80 til 90 procent af kampagnen.

Angriberne rettede sig mod omkring 30 organisationer over store teknologivirksomheder, finansielle institutioner, kemiske fabrikker og regeringsagenturer. Selv om de fleste angreb blev blokeret, lykkedes kampagnen i et lille antal tilfælde. Claude Code udførte rekognoscering, sårbarhedstest, kredenshøst og dataudtrækning stort set autonomt, med menneskelige operatører kun nødvendige ved kritiske beslutningspunkter.

Du kan læse Anthropics fulde rapport her.

Angrebsmetoder og AI-manipulation

Hackerne omgik Claudes sikkerhedsvagter gennem sofistikeret social manipulation. De bedrog AI-systemet ved at påstå at være ansatte i en legitim cybersecurity-virksomhed, der udførte defensiv testning. Angriberne brød også deres operationer ned i små, tilsyneladende uskyldige opgaver, der gav Claude utilstræklig kontekst om den samlede ondsindede formål.

Claude Code inspicerede målorganisationernes systemer for at identificere højværdidatabaser, udførte denne rekognoscering hurtigere end menneskelige hackere kunne, og forskede og skrev brugerdefineret eksploitkod til at teste sikkerhedssårbarheder. Systemet høstede brugernavne og adgangskoder til yderligere netadgang, derefter udtræk og kategoriserede private data efter efterretningsværdi. Angriberne kunne udføre kampagnen med næsten et enkelt klik, hvorefter AI-systemet opererede stort set på egen hånd i hastigheder, der var umulige for menneskelige hold—ofte sendte tusindvis af anmodninger per sekund.

Billede: Anthropic

Opdægelse og virksomhedsrespons

Anthropic opdagede angrebet i midten af september 2025 og iværksatte en undersøgelse med det samme. Inden for 10 dage lukkede virksomheden adgangen til Claude, kontaktede berørte organisationer og underrettede loven. Virksomheden har herefter udvidet sine opdægningskapaciteter og udvikler yderligere metoder til at undersøge og opdage storstilet, distribueret angreb.

Dette tilfælde følger tidligere misbrugs Tilfælde, der er dokumenteret af Anthropic i 2025. I august detaljerede virksomhedens Trusselforskningsrapport en data-afpresningsoperation, der blev sporet som GTG-2002, som brugte Claude Code til at begå storstilet tyveri, der rettede sig mod mindst 17 organisationer på tværs af sundhedssektor, nødtjenester, regering og religiøse institutioner. Denne kriminelle krævede løsepenge på over 500.000 dollar ved at true med at offentliggøre stjålet data i stedet for at bruge traditionel ransomware-kryptering.

Anthropics opdægningsinfrastruktur afhænger af multiple lagdelte teknikker, herunder adfærdshantering til at overvåge brugsmønstre på tværs af millioner af API-anmodninger, afvigelsesteknik til at identificere sekvenser af operationer, der er inkonsistente med legitimitet, og mønstergenkendelse til at genkende kendte og nye manipulationsmetoder. Virksomheden anvender specialiserede klassificatorer, der analyserer brugerinput for potentielt skadelige anmodninger og vurderer Claudes svar før eller efter levering.

Brancherelationer

Kampagnen involverede et hidtil uset niveau af AI-autonomi i cyberangreb og markerer, hvad sikkerhedseksperter betragter som et vendepunkt i cyber-espionage. Evnen af AI-systemer til at udføre sofistikerede angreb i maskinehastighed med minimal menneskelig overvågning stiller nye udfordringer for cybersikkerhedsforkæmpere.

Anthropics afsløring kommer, da AI-virksomheder står under stigende pres for at forhindre misbrug af deres modeller. Virksomheden fastholder et omfattende trusselsintelligens- og sikkerhedsprogram til at opdage og modgå misbrug af Claude, med dokumenterede sikkerhedshændelser på tværs af 2025. I marts identificerede virksomheden en påvirknings-tjeneste, der udnyttede Claude til at automatisere engagement med titusindvis af sociale medie-konti på tværs af multiple lande og sprog.

Tilfældet understreger den voksende sofistikering af AI-drevne værktøjer og udfordringerne ved at forhindre deres misbrug, samtidig med at man fastholder nyttigheden for legitime brugere. Anthropic har forbudt de tilknyttede konti og fortsætter med at forbedre sin opdægnings- og formindskningskapacitet for at tackle den udviklende trusselslandskab.

Alex McFarland er en AI-journalist og forfatter, der udforsker de seneste udviklinger inden for kunstig intelligens. Han har samarbejdet med talrige AI-startups og publikationer verden over.