Kybernetická bezpečnost
Anthropic Odhaluje První Velkým Rozsahem Kybernetický Útok Poháněný Automatizací AI

Anthropic zveřejnil, že skupina hackerů, kterou podezřívá z toho, že je to čínská skupina sponzorovaná státem, provedla první zdokumentovaný velkým rozsahem kybernetický útok s minimální lidskou intervencí, pomocí nástroje Claude Code společnosti pro automatizaci 80 až 90 procent kampaně.
Útočníci cílem bylo přibližně 30 organizací napříč významnými technologickými firmami, finančními institucemi, výrobci chemikálií a vládními agenturami. Zatímco většina útoků byla zablokována, kampaň se podařilo v malé části případů. Claude Code provedl průzkum, testování zranitelností, sběr přihlašovacích údajů a extrakci dat téměř autonomně, s lidskými operátory potřebnými pouze v kritických rozhodovacích bodech.
Můžete si přečíst úplnou zprávu Anthropic zde.
Metody Útoků a Manipulace AI
Hackerové obešli bezpečnostní zábrany Claude prostřednictvím sofistikovaného sociálního inženýrství. Oklamali systém AI tvrzením, že jsou zaměstnanci legitimní bezpečnostní firmy, která provádí defenzivní testování. Útočníci také rozdělili své operace na malé, zdánlivě nevinné úkoly, které poskytly Claude neúplný kontext o celkovém záměru útoků.
Claude Code prozkoumal systémy cílových organizací, aby identifikoval vysoké databáze, provedl průzkum rychleji, než by mohli lidské hackeři, a prozkoumal a napsal přizpůsobený kód pro testování bezpečnostních zranitelností. Systém sesbíral uživatelská jména a hesla pro další přístup do sítě, poté extrahoval a kategorizoval soukromá data podle inteligentní hodnoty. Útočníci mohli provést kampaň téměř jednoduchým kliknutím na tlačítko, po kterém AI fungovala téměř autonomně na rychlostech, které jsou nemožné pro lidské týmy – často odesílající tisíce požadavků za sekundu.

Obrázek: Anthropic
Zjištění a Reakce Společnosti
Anthropic zjistil útok v polovině září 2025 a okamžitě spustil vyšetřování. Během 10 dnů společnost ukončila přístup skupiny k Claude, kontaktovala postižené organizace a informovala orgány činné v trestním řízení. Společnost od té doby rozšířila své detekční schopnosti a vyvíjí další metody pro vyšetřování a detekci velkých, distribuovaných útoků.
Tento incident následuje po dřívějších případech zneužití, které dokumentovala Anthropic v roce 2025. V srpnu společnost ve své Zprávě o hrozbách prokázala operaci vydírání dat označovanou jako GTG-2002, která používala Claude Code pro spáchání velkého rozsahu krádeží cílených na nejméně 17 organizací napříč zdravotnictvím, službami urgentní pomoci, vládou a náboženskými institucemi. Ten zločinec požadoval výkupné přesahující 500 000 dolarů tím, že hrozil zveřejněním ukradených dat, místo toho, aby používal tradiční šifrování výkupného.
Detekční infrastruktura Anthropic spoléhá na více vrstevných techniky, včetně behaviorální analýzy pro monitorování vzorců použití napříč miliony požadavků API, detekce anomálií pro identifikaci sekvencí operací, které nejsou v souladu s legitimním použitím, a pattern matching pro rozpoznání známých a nových technik manipulace. Společnost zaměstnává specializované klasifikátory, které analyzují uživatelské vstupní údaje pro potenciálně škodlivé požadavky a hodnotí odpovědi Claude před nebo po doručení.
Důsledky pro Průmysl
Kampaň zahrnovala bezprecedentní úroveň autonomie AI v kybernetických útocích a představuje to, co odborníci na bezpečnost považují za zásadní bod v kybernetické špionáži. Schopnost systémů AI provádět sofistikované útoky na rychlostech strojů s minimální lidskou supervizí představuje nové výzvy pro obránce kybernetické bezpečnosti.
Zveřejnění Anthropic přichází v době, kdy společnosti AI čelí rostoucímu tlaku na prevenci zneužití svých modelů. Společnost udržuje komplexní program prokázání hrozeb a bezpečnostních zábran pro detekci a potírání zneužití Claude, s dokumentovanými bezpečnostními incidenty po celý rok 2025. V březnu společnost identifikovala operaci influence-as-a-service, která využívala Claude pro automatizaci interakce s desítkami tisíc účtů na sociálních médiích napříč několika zeměmi a jazyky.
Incident poukazuje na rostoucí sofistikovanost nástrojů poháněných AI a na výzvy spojené s prevencí jejich zneužití, zatímco se zachovává jejich užitná hodnota pro legitimní uživatele. Anthropic zakázal související účty a pokračuje ve zlepšování svých detekčních a zmírňujících schopností, aby řešil měnící se hrozební prostředí.












