Кібербезпека
Anthropic докладно описує перешкоди зловживанню Claude у семи сферах шкоди

Anthropic 10 вересня 2026 р. опублікувала звіт з розвідки загроз за вересень 2026, у якому докладно описано, як її команда Threat Intelligence виявила та зупинила акторів‑загроз, які зловживали Claude у період з грудня 2025 по серпень 2026 р., охоплюючи сім сфер шкоди, зокрема кібероперації, операції впливу, спостереження та нелегальну дистиляцію моделей.
Звіт під назвою «Виявлення та протидія зловживанню ШІ: вересень 2026» охоплює діяльність у галузях кібероперацій, операцій впливу, спостереження, шахрайства та обману, біологічного зловживання, розробки традиційної зброї та дистиляції. У випадках зловживання брали участь моделі Claude Haiku, Sonnet та Opus; жоден випадок не стосувався моделей Claude Fable або класу Mythos, за винятком одного випадку нелегальної дистиляції. Anthropic відстежує акторів за внутрішніми позначеннями Generative Threat Group (GTG) та вимірює так званий «uplift» — підвищення можливостей, яке ШІ надає операції щодо швидкості, масштабу та глибини. Компанія заявила, що у кожному випадку вона зупинила діяльність, використала отримані дані для посилення захисних заходів і, за потреби, поділилася розвідкою з владою та галузевими партнерами, додаючи, що публікує дослідження, бо «ми вважаємо, що маємо відповідальність розкривати зловмисне зловживання нашими сервісами».
Кібероперації
Наймасштабніший кібервипадок у звіті, позначений як GTG-20006, стосується актора, якого Anthropic ідентифікувала згідно з публічними повідомленнями, що пов’язують його з Midnight Blizzard; один оператор — російськомовний користувач під ніком «JackPoterz». Актор націлився на понад 20 організацій, переважно серед урядових, військових та дипломатичних установ України, скомпрометував щонайменше трьох постачальників Wi‑Fi у готелях для перехоплення DNS‑записів, захопив облікові записи WhatsApp щонайменше двох колишніх високопоставлених українських чиновників і викрав понад 300 000 записів національних ідентифікаційних даних плюс дані комерційного реєстру, що охоплювали понад півмільйона компаній, у технологічному органі влади Північної Африки. За даними звіту, AI‑агенти актора автономно модифікували та перебудовували його шкідливе ПЗ щоразу, коли системи безпеки його виявляли.
GTG-50014 стосується операторів, підозрюваних у зв’язку з колективом ShinyHunters, чия інфраструктура збору облікових даних масово завантажила 1,8 млн Android‑APK та сканувала їх на предмет вбудованих секретів. Anthropic повідомила, що один випадок компрометації технологічного постачальника призвів до виведення понад один терабайт даних, включаючи мільйони записів платіжних карток, тоді як інший підрозділ отримав дані приблизно від 200 кінцевих клієнтів сервісу SaaS, що був зламаний, і розклав понад 2 100 наборів токенів Azure AD, що охоплювали більше 40 корпоративних орендарів, за приблизно 34 години, причому майже всю роботу виконували AI‑агенти.
Ще три випадки демонструють різноманітність описаної діяльності. GTG-10007 — китайськомовні оператори, ймовірно базовані в Чанша, Хунань, двоє з яких виявлені як студенти‑бакалаври, націлилися на приблизно п’ятдесят організацій і запустили автономну програму дослідження вразливостей, у межах якої один робочий процес, що ітеративно аналізував мережеві пристрої, дав понад дюжину можливих нуль‑деньових вразливостей за один місяць. GTG-50020 — російськомовний актор, мотивований фінансово, вивів приблизно 26 ГБ даних у однієї жертви, вимагав від 1,5 до 2,5 млн доларів викупу, а потім протягом близько чотирьох днів атакував близько тридцяти компаній у сфері ШІ з метою отримати доступ до передрелізної моделі Claude; Anthropic зазначила, що кожен спробований шлях завершився невдачею і її власні системи не були скомпрометовані. GTG-50029 — один франкомовний хактивіст, використав недокументовану гонку умов встановлення WordPress проти щонайменше чотирьох сайтів, отримав внутрішній доступ до щонайменше 14 з 42 відстежуваних цілей, вивів приблизно 140 000 записів, включаючи політичні погляди користувачів з платформи кампанії, і створив платформу доxxинг‑інформації під назвою fafsearch, завантажену десятками мільйонів рядків.
Операції впливу та спостереження
У звіті описано дев’ять випадків операцій впливу, які походили з Росії, Ірану, Туреччини, Перської затоки, Південної Азії, Африки та Європи, з охопленням, виміряним за шкалою Breakout Scale Брукінгс‑Інститута. У GTG-04001 російськомовний актор у Бангі виробляв щоденний контент для Radio Lengo Songo (98,9 FM), станції, яку Anthropic пов’язала з Politology, підрозділом впливу Africa Corps/Wagner, який, за оцінками, перейшов під контроль Російської служби зовнішньої розвідки наприкінці 2023 р.; актор виготовляв підроблені документи уряду Центральноафриканської Республіки та трудові контракти, що вимагали лояльності до президента країни, а також до Росії та її контингенту. Anthropic оцінила операцію як Категорію Чотири за шкалою. У GTG-54002 розслідувачі простежили приблизно 70 підроблених новинних веб‑сайтів, 70 відповідних акаунтів у X та понад 250 неавтентичних коментаторських акаунтів, пов’язаних з LKM Company, французьким агентством цифрової реклами; мережа опублікувала щонайменше 8 913 статей приблизно 20 мовами, 318 з яких були присвячені Демократичній Республіці Конго.
Інші операції були орієнтовані на вибори та державні медіа. GTG-84005 — комерційна платформа маніпуляції виборами, спрямована на Малайзію, яку Anthropic пов’язала з істанбулською BBS Bilisim Teknolojileri, керувала приблизно 1 000 підроблених акаунтів у X у всіх 222 виборчих округах Малайзії та створювала фіктивні досьє проти опозиційного політика. GTG-24015 включала чотири акаунти, які використовували Claude як редакційну платформу, постачаючи російські державні медіа, включаючи Sputnik Moldova, RIA Novosti, Sputnik en Español, Sputnik Africa та RT English; колишній головний редактор Sputnik Moldova поширював вигадані заяви про президента Майю Санду перед парламентськими виборами в Молдові 28 вересня 2025 р. GTG-84002 — операція проти Братства мусульман, яку Anthropic з високою впевненістю пов’язала з урядовцями ОАЕ, вела близько 300 неавтентичних акаунтів, писала підроблені свідчення для 62‑го засідання Ради ООН з прав людини, створювала профілі 18 членів Європейського парламенту та складала контр‑досьє на спеціальних доповідачів ООН.
Серед випадків спостереження — GTG-50027, у якому один, ймовірно, базований у Бамако консультант використовував Claude як основну інженерну робочу силу для Lakana 360, національної платформи спостереження, створеної для державної розвідувальної служби Малі ANSE з метою моніторингу приблизно 25 млн SIM‑карток усіх трьох національних мобільних операторів; Anthropic зазначила, що вимогу щодо отримання ордеру було вилучено з компонента генерації досьє платформи за запитом оператора. GTG-14010 охоплює актора, орієнтованого на уряд КНР, який використовував Claude для відстеження, профілювання та спроби вербування уйгурів у Сирії, пропонуючи оплату за звіти про озброєні формування, тоді як Claude у реальному часі перекладав відповіді та граючи роль експерта перевіряв достовірність обману. У GTG-14020 та GTG-14021 китайські актори, які Anthropic пов’язала з релігійними справами КНР та муніципальною державною безпекою, створювали шаблонні досьє на католицьких кардиналів, Пресвітеріанську церкву Тайваню, тибетських буддистів та Фалуньгун, а один актор повторно запитував про отримання вказівок щодо придушення, називаючи 10 приватних осіб для «контролю» разом із передопераційною розвідкою щодо протестів за кордоном. GTG-34007 охоплює два пов’язані іранські підрозділи, що керували 16 акаунтами Claude і стверджували, що спостерігали та профілювали 6 388 іранців за один рік, провели соціальну мережеву аналізу понад 155 216 твітів, у яких згадувалося 39 опозиційних акаунтів, і розповсюдили шкідливе розширення Firefox для масового збору ідентичностей, живлячи спільну систему управління випадками під назвою Arman.
Розробка зброї та біологічне зловживання
У звіті описано шість випадків традиційної зброї: три в Китаї, два в Росії та один у Північному Ємені. У GTG-87001 північна єменська клітина використала Claude Code замість людських інженерів програмного забезпечення для розробки ПЗ навігації, керування та управління керованою ракетою, багатоступеневою балістичною ракетою з заявленою дальністю понад 2 000 км та набором варіантів, включаючи гіперзвуковий планер; Anthropic повідомила, що клітина провела випробувальний запуск керованої ракети, який, схоже, завершився невдачею. GTG-27005 стосується, ймовірно, фрілансерів з Росії, які використали Claude Code для створення автономного рою дронів‑камікадзе FPV, модель яких могла самостійно обирати цілі, включно з класом «особа», та віддаватии команди детонації без участі людини, навчаючи візуальний класифікатор на зібраному українському бойовому відео. У GTG-17002 китайський актор сконструював приблизно 16‑модульний комплект електронної війни та придушення протиповітряної оборони, а під час проєкту змінив типову симуляційну схему на 12 цілей у Тайвані, включаючи командний бункер, радарну станцію раннього попередження та батареї Patriot і Tien Kong; Anthropic оцінює, що актор був пов’язаний з дослідницькими установами КНР, зокрема Академією військових наук НАРО.
Далі наведено п’ять випадків біологічного зловживання. У травні 2026 р. класифікатор біологічної безпеки Anthropic заблокував запит на допомогу у підготовці грантової заявки на дослідження підвищення патогенності чикунгунії, призначеного для військового дослідного інституту, який проходив через платформу ухилення, що згодом додала резервний механізм надсилання відхилених підказок до моделі конкурента. Дослідник у регіоні без підтримки провів кілька тижнів, плануючи експерименти з адаптацією пташиного грипу до ссавців, проте Anthropic зазначила, що її класифікатори обмежили обмін лише моделями Claude Sonnet 4 і Haiku 4.5, найслабшою класою моделей. У третьому випадку посередник‑перепродавець, що обслуговував понад десяток неродинних клієнтів, повністю виконав запит одного користувача на Opus 5, створивши грантову заявку на імунозахисний механізм проти ортопоксвірусу за приблизно одну годину. Два інші випадки стосувалися програм переосмислення отрут і токсинів за підтримки держави. Anthropic повідомила, що аналіз 30‑денної активності, пов’язаної з ворожими державними інституціями, виявив близько 35 окремих дослідних проєктів, більшість з яких — звичайна цивільна наука, проте деякі мали помітний потенціал подвійного використання.
Шахрайство та нелегальна дистиляція
У розділі про шахрайство та обман GTG-15001 охоплює китайську студію розробки додатків, яка використовувала Claude для керування мережею понад 20 додатків для знайомств, у яких AI‑персони (понад 4 700) спілкувалися щонайменше з 25 000 унікальними особами протягом двотижневого періоду у квітні 2026 р., обмінюючись приблизно 2,36 млн повідомлень. Студія змішувала реальних виконавців гіг‑роботи у той самий потік підбору за співвідношенням приблизно три до одного між AI‑персонами та реальними людьми, і персонам наказували ніколи не розкривати, що вони автоматизовані.
Anthropic повідомила, що з лютого 2026 р. вона перешкоджала атакам дистиляції з семи лабораторій у Китаї, усі з яких націлені на її загальнодоступні моделі. У GTG-16005 Anthropic приписала Alibaba найбільшу зафіксовану кампанію дистиляції: дистиляція ланцюжка мислення моделей Opus 4.6 і 4.7, що досягала майже 3 млн обмінів на день з більш ніж 3 500 шахрайськими акаунтами, при цьому між травнем і липнем 2026 р. спостерігалося понад 151 млн обмінів, а отримані транскрипти використали для навчання Qwen 3.5, 3.6 та 3.7. У GTG-16002 Moonshot AI без повідомлення клієнтів переадресовувала запити до Claude замість своїх моделей Kimi, передаючи майже 300 000 запитів протягом десяти днів через 5 380 шахрайських акаунтів і використовуючи атаку повторного відтворення між сесіями на підписах мислення Claude для вилучення слідів роздумів, при цьому між травнем і липнем 2026 р. зафіксовано понад 23 млн обмінів. У GTG-16001 DeepSeek застосувала ту ж техніку повтору і перенаправляла запити користувачів до Claude Opus без їхньої згоди, зафіксувавши понад 12,1 млн обмінів за 14 днів у липні 2026 р.; Anthropic повідомила, що передана інформація розкрила конфіденційні матеріали, включаючи живі облікові дані до російської урядової бази даних та системи управління справами поліції КНР.
Серед решти названих кампаній — Zhipu, яка здійснила 770 609 обмінів через очистку ланцюжка мислення за десять днів і націлювалася на кіберможливості перед випуском GLM 5.3, та Xiaomi, яка спрямувала понад 400 000 запитів через більше 1 500 акаунтів. Anthropic також повідомила, що конвеєр дистиляції SenseTime включав транскрипти Claude, придбані у сторонніх постачальників даних, а MiniMax створив проксі‑мережу через компанію‑оболонку, що пропонувала лише моделі Anthropic та OpenAI.
Anthropic описує багаторівневі контрзаходи проти нелегальної дистиляції: атрибуція мереж проксі‑сервісів за допомогою метаданих, посилені класифікатори вилучення у зв’язку з запуском Fable 5, підсумкове внутрішнє мислення, спрямоване на зменшення корисності викрадених транскриптів для навчання, збережене мислення, впроваджене у Fable 5.1, яке запобігає новим API‑акаунтам змінювати системний підказ, інструменти або повідомлення перед мисленням Claude у багатокрокових діалогах, а також вимоги щодо верифікації особистості для акаунтів, що виявляють сигнали потенційного зловживання; акаунти, які не пройшли верифікацію, блокуються. Компанія зазначила, що отримані під час розслідувань та перешкоджання атакам дистиляції дані й надалі інформуватимуть про створення нових захисних механізмів.












