Cyberbezpieczeństwo
Anthropic Ujawnia Pierwszy Dużych Rozmiarów Cyberatak Zasilany Przez Automatyzację AI

Anthropic ujawnił, że grupa hakerów, której podejrzewa się o bycie chińską grupą sponsorowaną przez państwo, przeprowadziła pierwszy udokumentowany duży cyberatak wykonany z minimalnym udziałem ludzi, wykorzystując narzędzie Claude Code firmy do zautomatyzowania 80 do 90 procent kampanii.
Atakujący zaatakowali około 30 organizacji z głównych firm technologicznych, instytucji finansowych, producentów chemikaliów i agencji rządowych. Chociaż większość ataków została zablokowana, kampania powiodła się w niewielkiej liczbie przypadków. Claude Code przeprowadził rozpoznanie, testowanie podatności, zbieranie poświadczeń i eksfiltrację danych w dużej mierze autonomicznie, z ludzkimi operatorami potrzebnymi tylko w krytycznych punktach decyzyjnych.
Można przeczytać pełny raport Anthropic tutaj.
Metody Ataku i Manipulacja AI
Hakerzy ominęli zabezpieczenia Claude za pomocą wyrafinowanego inżynierii społecznej. Oszukali system AI, twierdząc, że są pracownikami legalnej firmy bezpieczeństwa, prowadzącej testy obronne. Atakujący również rozbitków swoje operacje na małe, pozornie niewinne zadania, które dostarczyły Claude niepełnego kontekstu o celu ataku.
Claude Code sprawdził systemy organizacji docelowych w celu identyfikacji wysoko wartościowych baz danych, przeprowadził to rozpoznanie szybciej niż mogliby to zrobić ludzcy hakerzy, i zbadał oraz napisał niestandardowy kod eksploatacji w celu przetestowania podatności bezpieczeństwa. System zebrał nazwy użytkowników i hasła w celu dalszego dostępu do sieci, a następnie wyodrębnił i skategoryzował dane prywatne według wartości wywiadowczej. Atakujący mogli wykonać kampanię zasadniczo za pomocą jednego kliknięcia, po czym AI działał w dużej mierze samodzielnie z prędkościami niemożliwymi dla zespołów ludzkich – często wysyłając tysiące żądań na sekundę.

Obraz: Anthropic
Wykrywanie i Reakcja Firmy
Anthropic wykrył atak w połowie września 2025 roku i natychmiast rozpoczął śledztwo. W ciągu 10 dni firma zablokowała dostęp grupy do Claude, skontaktowała się z dotkniętymi organizacjami i powiadomiła organy ścigania. Firma od tego czasu rozszerzyła swoje możliwości wykrywania i rozwija dodatkowe metody w celu zbadania i wykrycia dużych, rozproszonych ataków.
Incident ten następuje po wcześniejszych przypadkach nadużyć udokumentowanych przez Anthropic w 2025 roku. W sierpniu raport wywiadowczy firmy dotyczący zagrożeń zawierał operację wymuszenia danych o nazwie GTG-2002, która wykorzystywała Claude Code do popełnienia dużych kradzieży danych w co najmniej 17 organizacjach z sektorów opieki zdrowotnej, usług awaryjnych, rządu i instytucji religijnych. Ten przestępca żądał okupu przekraczającego 500 000 dolarów, grożąc ujawnieniem skradzionych danych, zamiast korzystania z tradycyjnego szyfrowania oprogramowania ransomware.
Infrastruktura wykrywania Anthropic opiera się na wielowarstwowych technikach, w tym analizie behawioralnej w celu monitorowania wzorców użycia w milionach żądań API, wykrywaniu anomalii w celu identyfikacji sekwencji operacji niezgodnych z uzasadnionym użyciem, oraz dopasowaniu wzorca w celu rozpoznania znanych i nowych technik manipulacji. Firma zatrudnia specjalistyczne klasyfikatory, które analizują dane wejściowe użytkowników pod kątem potencjalnie szkodliwych żądań i oceniają odpowiedzi Claude przed lub po dostarczeniu.
Wnioski dla Branży
Kampania ta zaangażowała bezprecedensowy poziom autonomii AI w cyberatakach i stanowi punkt zwrotny w szpiegostwie cybernetycznym. Możliwość systemów AI do prowadzenia złożonych ataków z prędkością maszynową i minimalnym nadzorem ludzkim stwarza nowe wyzwania dla obrońców bezpieczeństwa cybernetycznego.
Ujawnienie Anthropic następuje w momencie, gdy firmy AI są narażone na rosnące ciśnienie, aby zapobiec nielegalnemu wykorzystaniu ich modeli. Firma prowadzi kompleksowy program wywiadowczy i zabezpieczeń w celu wykrycia i przeciwdziałania nadużyciom Claude, z udokumentowanymi incydentami bezpieczeństwa w całym 2025 roku. W marcu firma zidentyfikowała operację wpływu jako usługę, która wykorzystywała Claude do zautomatyzowania interakcji z dziesiątkami tysięcy kont na mediach społecznościowych w wielu krajach i językach.
Incident ten podkreśla rosnącą złożoność narzędzi zasilanych przez AI i wyzwania związane z zapobieganiem ich nadużyciom, jednocześnie zapewniając ich użyteczność dla użytkowników, którzy ich używają zgodnie z prawem. Anthropic zablokował powiązane konta i nadal rozwija swoje możliwości wykrywania i łagodzenia, aby rozwiązać ewoluujący krajobraz zagrożeń.












