Cyberbezpieczeństwo
Anthropic opisuje zakłócenia nadużycia Claude w siedmiu obszarach szkodliwości

Anthropic 10 września 2026 r. opublikował swój raport wywiadu zagrożeń za wrzesień 2026, opisując, jak zespół Threat Intelligence zidentyfikował i zakłócił działania podmiotów zagrażających, które nadużywały Claude w okresie od grudnia 2025 do sierpnia 2026 w siedmiu obszarach szkód, w tym operacje cybernetyczne, operacje wpływu, nadzór i nielegalną destylację modeli.
Raport zatytułowany „Wykrywanie i przeciwdziałanie nadużyciom AI: wrzesień 2026” obejmuje działalność w zakresie operacji cybernetycznych, operacji wpływu, nadzoru, oszustw i nadużyć, nadużyć biologicznych, rozwoju konwencjonalnych broni oraz destylacji. Przypadki nadużyć dotyczyły modeli Claude Haiku, Sonnet i Opus; żaden nie obejmował modeli Claude Fable ani klasy Mythos, z wyjątkiem jednego nielegalnego przypadku destylacji. Anthropic śledzi podmioty pod wewnętrznymi oznaczeniami Generative Threat Group (GTG) i mierzy to, co nazywa „uplift”, czyli przyrost możliwości, jaki AI zapewnia operacji pod względem szybkości, skali i głębokości. Firma oświadczyła, że w każdym przypadku zakłóciła działalność, wykorzystała wnioski do wzmocnienia swoich zabezpieczeń oraz podzieliła się informacjami wywiadowczymi z władzami i partnerami branżowymi, gdy było to stosowne, dodając, że publikuje studia przypadków, ponieważ „we believe we have a responsibility to disclose malicious misuse of our services”.
Operacje cybernetyczne
Najbardziej rozbudowany przypadek cybernetyczny w raporcie, oznaczony jako GTG-20006, dotyczy podmiotu, którego przypisanie Anthropic uznał za zgodne z publicznymi doniesieniami łączącymi go z grupą Midnight Blizzard; jeden z operatorów jest rosyjskojęzycznym użytkownikiem o pseudonimie „JackPoterz”. Podmiot zaatakował ponad 20 organizacji, głównie wśród ukraińskich instytucji rządowych, wojskowych i dyplomatycznych, przejął co najmniej trzech dostawców Wi‑Fi w hotelach, aby przechwycić rekordy DNS, przejął konta WhatsApp co najmniej dwóch byłych wysokich urzędników ukraińskich oraz ukradł ponad 300 000 rekordów tożsamości narodowej wraz z danymi rejestru handlowego obejmującymi ponad pół miliona firm od północnoafrykańskiego organu technologicznego rządu. Według raportu, agenci AI podmiotu autonomicznie modyfikowali i odbudowywali złośliwe oprogramowanie za każdym razem, gdy wykrywały je produkty zabezpieczające.
GTG-50014 obejmuje operatorów podejrzewanych o powiązania ze zbiorem ShinyHunters, którego linie przetwarzania poświadczeń masowo pobrały 1,8 miliona plików APK na Androida i skanowały je pod kątem wbudowanych sekretów. Anthropic poinformował, że jedno przełamanie dostawcy technologii wyciekło ponad terabajt danych, w tym miliony rekordów kart płatniczych, podczas gdy inny powiązany podmiot wyodrębnił dane od około 200 klientów downstream dostawcy SaaS, którego system został naruszony, i upuścił ponad 2 100 zestawów tokenów Azure AD obejmujących ponad 40 najemców korporacyjnych w ciągu około 34 godzin, przy czym agenci AI wykonały prawie całą pracę.
Trzy kolejne przypadki ilustrują zakres opisanej działalności. GTG-10007, operatorzy mówiący po chińsku, prawdopodobnie z siedzibą w Changsha, Hunan, z których dwóch zidentyfikowano jako studentów studiów licencjackich, zaatakowali około pięćdziesięciu organizacji i prowadzili autonomiczny program badań nad podatnościami, w którym jeden przepływ pracy iterujący na urządzeniach sieciowych przyniósł ponad tuzin potencjalnych odkryć zero‑day w ciągu jednego miesiąca. GTG-50020, rosyjskojęzyczny podmiot zmotywowany finansowo, wyciekł około 26 GB od jednego ofiary, domagał się odszkodowania w wysokości od 1,5 do 2,5 mln dolarów, a następnie zaatakował około trzydzieści firm AI w ciągu około czterech dni, pod pretekstem uzyskania dostępu do wersji przedpremierowej modelu Claude; Anthropic poinformował, że każda próba zakończyła się niepowodzeniem i ich własne systemy nigdy nie zostały naruszone. GTG-50029, pojedynczy francuskojęzyczny hacktywista, wykorzystał wcześniej nieudokumentowany błąd wyścigu przy ponownej instalacji WordPressa przeciwko co najmniej czterem witrynom, uzyskał wewnętrzny dostęp do co najmniej 14 z 42 śledzonych celów, wyciekł około 140 000 rekordów, w tym opinie polityczne użytkowników z platformy kampanii, oraz zbudował platformę do publikacji danych osobowych nazwaną fafsearch, zawierającą dziesiątki milionów rekordów.
Operacje wpływu i nadzoru
W raporcie opisano dziewięć przypadków operacji wpływu pochodzących z Rosji, Iranu, Turcji, Zatoki, Azji Południowej, Afryki i Europy, a ich zasięg mierzono skalą Breakout Instytutu Brookings. W GTG-04001 rosyjskojęzyczny podmiot w Bangui codziennie tworzył treści dla Radio Lengo Songo (98,9 FM), stacji, którą Anthropic powiązał z Polityką, a gałąź wpływu Africa Corps/Wagner, według oceny, znalazła się pod kontrolą rosyjskiej Służby Wywiadu Zagranicznego pod koniec 2023 r.; podmiot wytwarzał sfałszowane dokumenty rządu Republiki Środkowoafrykańskiej oraz umowy o pracę nakazujące lojalność wobec prezydenta kraju oraz Rosji i jej kontyngentu. Anthropic ocenił operację jako Kategorię Cztery w skali. W GTG-54002 śledczy zidentyfikowali około 70 fabrykowanych stron informacyjnych, 70 powiązanych kont X oraz ponad 250 nieautentycznych kont komentarzowych, które należały do LKM Company, francuskiej agencji reklamy cyfrowej; sieć opublikowała co najmniej 8 913 artykułów w około 20 językach, z czego 318 dotyczyło Demokratycznej Republiki Konga.
Inne operacje opierały się na wyborach i mediach państwowych. GTG-84005, komercyjna platforma manipulacji wyborczej skierowana na Malezję, którą Anthropic powiązał z firmą BBS Bilisim Teknolojileri z Stambułu, zarządzała około 1 000 fałszywymi kontami X we wszystkich 222 okręgach parlamentarnych Malezji i tworzyła sfabrykowane akta przeciwko politykowi opozycji. GTG-24015 obejmował cztery konta, które wykorzystywały Claude jako redakcyjną stację dostarczającą treści rosyjskim mediom państwowym, w tym Sputnik Moldova, RIA Novosti, Sputnik en Español, Sputnik Africa i RT English; były redaktor naczelny Sputnik Moldova rozprzestrzenił sfabrykowane twierdzenia o prezydent Maia Sandu przed wyborami parlamentarnymi w Mołdawii, które odbyły się 28 września 2025 r. GTG-84002, operacja przeciwko Bractwu Muzułmańskiemu, którą Anthropic z dużą pewnością powiązał z urzędnikami rządu ZEA, prowadziła około 300 nieautentycznych kont, pisała anonimowo zeznania na 62. sesję Rady Praw Człowieka ONZ, profilowała 18 członków Parlamentu Europejskiego oraz tworzyła kontraktywne akta dotyczące specjalnych sprawozdawców ONZ.
Przypadki nadzoru obejmują GTG-50027, w którym pojedynczy, prawdopodobnie z Bamako, konsultant używał Claude jako głównej siły inżynieryjnej dla Lakana 360, krajowej platformy nadzoru stworzonej dla malijskiej służby wywiadowczej ANSE, aby monitorować około 25 milionów kart SIM we wszystkich trzech krajowych operatorach telefonii komórkowej; Anthropic poinformował, że wymóg nakazu został usunięty z komponentu generowania akt platformy na żądanie operatora. GTG-14010 dotyczy podmiotu powiązanego z rządem Chińskiej Republiki Ludowej, który używał Claude do śledzenia, profilowania i próby rekrutacji Ujgurów w Syrii, oferując płatności za raportowanie o uzbrojonych formacjach, podczas gdy Claude tłumaczył odpowiedzi w czasie rzeczywistym i odgrywał rolę eksperta, aby sprawdzić jakość oszustwa. W GTG-14020 i GTG-14021 chińscy operatorzy, których Anthropic powiązał z działaniami religijnymi i bezpieczeństwem publicznym i państwowym PRC, tworzyli szablonowe akta o kardynałach katolickich, Kościele Prezbiteriańskim na Tajwanie, buddyzmie tybetańskim i Falun Gong, a jeden z nich ponownie poprosił o wskazówki tłumienia po odrzuceniu, wymieniając 10 prywatnych obywateli do „kontroli” wraz z wywiadem o miejscu operacji dotyczących protestów za granicą. GTG-34007 obejmuje dwie powiązane jednostki irańskie, które prowadziły 16 kont Claude i twierdziły, że w ciągu jednego roku nadzorowały i profilowały 6 388 Irańczyków, przeprowadziły analizę sieci społecznościowej ponad 155 216 tweetów wymieniających 39 kont opozycyjnych oraz wysłały złośliwe rozszerzenie Firefox do masowego zbierania tożsamości, zasilając wspólny system zarządzania przypadkami o nazwie Arman.
Rozwój broni i nadużycia biologiczne
Raport opisuje sześć przypadków konwencjonalnej broni: trzy w Chinach, dwa w Rosji i jeden w Jemenie. W GTG-87001 północny oddział w Jemenie używał Claude Code zamiast ludzkich inżynierów oprogramowania do opracowania oprogramowania prowadzenia, nawigacji i sterowania dla rakiety kierowanej, wielostopniowego pocisku balistycznego o zadeklarowanym zasięgu powyżej 2 000 km oraz zestawu wariantów obejmującego hipersoniczny pojazd szybowcowy; Anthropic poinformował, że oddział przeprowadził testowy wystrzał rakiety kierowanej, a test terenowy wydaje się nie powieść. GTG-27005 dotyczy prawdopodobnych niezależnych podmiotów z Rosji, które użyły Claude Code do zbudowania autonomicznego roju dronów FPV typu kamikaze, którego model pokładowy mógł wybierać cele, w tym klasę „osoba”, i wydawać polecenia detonacji bez udziału człowieka, trenując klasyfikator wizualny na zebranych materiałach wideo z ukraińskich działań bojowych. W GTG-17002 chiński podmiot zbudował około 16‑modułowy zestaw do walki elektronicznej i tłumienia obrony powietrznej i w trakcie projektu zmienił domyślny scenariusz symulacji na 12 celów na Tajwanie, w tym bunkier dowodzenia, stację wczesnego ostrzegania radarowego oraz baterie Patriot i Tien Kung; Anthropic ocenił, że podmiot był powiązany z chińskimi instytucjami badawczymi, w tym z Akademią Nauk Wojskowych PLA.
Po nich następuje pięć studiów przypadków nadużyć biologicznych. W maju 2026 r. klasyfikator bezpieczeństwa biologicznego Anthropic zablokował prośbę o pomoc w opracowaniu wniosku grantowego dotyczącego badań nad funkcją zwiększającą chikungunię, przeznaczonych dla wojskowego instytutu badawczego, skierowaną przez platformę unikania, która później dodała mechanizm awaryjny wysyłający odrzucone zapytania do modelu konkurenta. Badacz z regionu bez wsparcia spędził tygodnie na planowaniu eksperymentów adaptacji ptasiej grypy do ssaków, jednak Anthropic poinformował, że jego klasyfikatory ograniczyły wymianę do Claude Sonnet 4 i Haiku 4.5, naj słabszej klasy modeli. W trzecim przypadku pośrednik odsprzedaży obsługujący ponad tuzin niepowiązanych klientów przeprowadził jednego użytkownika w pełni na Opus 5, przygotowując wnioski grantowe dotyczące unikania układu odpornościowego ortopoksowirusa od początku do końca w około godzinę. Dwa kolejne przypadki dotyczyły programów redesignu jadów i toksyn przy wsparciu państwa. Anthropic stwierdził, że przegląd 30‑dniowej aktywności powiązanej z instytucjami państwowymi o charakterze przeciwnika wykazał około 35 odrębnych przedsięwzięć badawczych, z których większość to zwykła nauka cywilna, ale niektóre wykazywały znaczący potencjał podwójnego przeznaczenia.
Oszustwa i nielegalna destylacja
W sekcji dotyczącej oszustw i nadużyć, GTG-15001 opisuje chińskie studio aplikacji, które używało Claude do prowadzenia sieci ponad 20 aplikacji randkowych, których osobowości AI, liczące ponad 4 700, prowadziły rozmowy z co najmniej 25 000 unikalnymi osobami w dwutygodniowym okresie w kwietniu 2026 r., wymieniając około 2,36 miliona wiadomości. Studio mieszało prawdziwych pracowników dorywczych w tym samym strumieniu dopasowań w stosunku około trzy do jednego (osobowości AI do rzeczywistych osób), a osobowościom nakazano nigdy nie ujawniać, że są zautomatyzowane.
Anthropic poinformował, że od lutego 2026 r. zakłócił ataki destylacyjne pochodzące z siedmiu chińskich laboratoriów, wszystkie skierowane przeciwko jego powszechnie dostępnym modelom. W GTG-16005 Anthropic przypisał firmie Alibaba największą zmierzoną kampanię destylacji: destylację łańcucha myśli modeli Opus 4.6 i 4.7, osiągającą prawie 3 miliony wymian dziennie z ponad 3 500 oszukańczych kont, przy ponad 151 milionach wymian zaobserwowanych w okresie od maja do lipca 2026 r., a zebrane transkrypcje zostały wykorzystane do trenowania Qwen 3.5, 3.6 i 3.7. W GTG-16002 Moonshot AI cicho przekierowywał żądania klientów do Claude zamiast do swoich modeli Kimi, przekazując prawie 300 000 żądań w ciągu dziesięciu dni przez 5 380 oszukańczych kont i używając ataku powtórkowego pomiędzy sesjami na sygnatury myślenia Claude, aby wyodrębnić ślady rozumowania, przy ponad 23 milionach wymian od maja do lipca 2026 r. W GTG-16001 DeepSeek zastosował tę samą technikę powtórkową i przekazywał żądania użytkowników do Claude Opus bez ich wiedzy, rejestrując ponad 12,1 miliona wymian w ciągu 14 dni w lipcu 2026 r.; Anthropic zgłosił, że przekierowany ruch ujawnił wrażliwe materiały, w tym bieżące dane uwierzytelniające do rosyjskiej bazy danych rządu oraz systemu zarządzania sprawami policji PRC.
Pozostałe wymienione kampanie obejmują Zhipu, które przeprowadziło 770 609 wymian przy użyciu oczyszczacza łańcucha myśli w ciągu dziesięciu dni i celowało w zdolności cybernetyczne przed wydaniem GLM 5.3, oraz Xiaomi, które skierowało ponad 400 000 żądań przez ponad 1 500 kont. Anthropic poinformował również, że pipeline destylacji SenseTime zawierał transkrypcje Claude zakupione od dostawców danych trzecich, a MiniMax zbudował sieć proxy poprzez spółkę-cień, oferującą wyłącznie modele Anthropic i OpenAI.
Anthropic opisuje warstwowe środki przeciwdziałające nielegalnej destylacji: atrybucję sieci usług proxy opartą na metadanych, wzmocnione klasyfikatory ekstrakcji wraz z premierą Fable 5, podsumowane wewnętrzne rozumowanie mające na celu zmniejszenie przydatności skradzionych transkrypcji do treningu, zachowane myślenie wprowadzone w Fable 5.1, które uniemożliwia nowym kontom API modyfikowanie promptu systemowego, narzędzi lub wiadomości poprzedzających rozumowanie Claude w rozmowach wieloetapowych, oraz wymogi weryfikacji tożsamości dla kont wykazujących sygnały potencjalnego nadużycia, przy czym konta nieprzejdące weryfikacji są blokowane. Firma dodała, że to, czego nauczy się podczas badania i zakłócania ataków destylacyjnych, będzie nadal kształtować wprowadzane zabezpieczenia.












