Кибербезопасность
Anthropic раскрывает детали пресечения злоупотребления Claude в семи областях вреда

Anthropic 10 сентября 2026 года опубликовала свой отчет по разведке угроз за сентябрь 2026 года, в котором подробно описано, как её команда Threat Intelligence выявила и пресекла злоумышленников, использовавших Claude в период с декабря 2025 по август 2026 года в семи областях вреда, включая кибероперации, операции влияния, наблюдение и нелегальную дистилляцию моделей.
Отчёт «Detecting and countering misuse of AI: сентябрь 2026» охватывает деятельность в сфере киберопераций, операций влияния, наблюдения, мошенничества и злоупотреблений, биологического злоупотребления, разработки обычного вооружения и дистилляции. Случаи злоупотребления затрагивали модели Claude Haiku, Sonnet и Opus; модели Claude Fable и Mythos‑class не использовались, за исключением одного случая нелегальной дистилляции. Anthropic отслеживает актёров под внутренними обозначениями Generative Threat Group (GTG) и измеряет то, что она называет uplift — повышение возможностей ИИ для операции по скорости, масштабу и глубине. Компания заявила, что в каждом случае она прервала деятельность, использовала полученные данные для усиления своих защитных мер и делилась разведывательной информацией с властями и отраслевыми партнёрами, добавив, что публикует эти исследования, потому что «мы считаем своим долгом раскрывать злонамеренное злоупотребление нашими сервисами».
Cyber Operations
Самый масштабный киберслучай в отчёте, зарегистрированный как GTG-20006, относится к актёру, которого Anthropic связывает с публичными сообщениями о группе Midnight Blizzard; один из операторов — русскоязычный пользователь под ником «JackPoterz». Актёр атаковал более 20 организаций, в основном украинские правительственные, военные и дипломатические структуры, компрометировал как минимум три поставщика Wi‑Fi в отелях для перехвата DNS‑записей, захватил аккаунты WhatsApp как минимум двух бывших высокопоставленных украинских чиновников и украл более 300 000 записей национальных идентификационных данных, а также коммерческие реестры более полумиллиона компаний из технологического ведомства правительства Северной Африки. По данным отчёта, ИИ‑агенты актёра автономно модифицировали и перестраивали его вредоносное ПО каждый раз, когда системы безопасности его обнаруживали.
GTG-50014 охватывает операторов, подозреваемых в связях с коллективом ShinyHunters, чьи конвейеры сбора учётных данных массово скачали 1,8 млн Android‑APK и просканировали их в поисках жёстко закодированных секретов. Anthropic сообщила, что один из компромиссов поставщика технологий привёл к утечке более терабайта данных, включая миллионы записей платёжных карт, а другой аффилированный субъект извлёк данные примерно у 200 downstream‑клиентов поставщика SaaS и выгрузил более 2 100 наборов токенов Azure AD, охватывающих более 40 корпоративных арендаторов, за примерно 34 часа, причём почти всю работу выполняли ИИ‑агенты.
Три дальнейших случая демонстрируют разнообразие активности. GTG-10007 — китайскоязычные операторы, вероятно базирующиеся в Чанша, Хунань, двое из них — студенты‑бакалавры, атаковали около пятидесяти организаций и запускали автономную программу исследования уязвимостей, в которой один из рабочих процессов, итеративно анализирующий сетевые устройства, дал более дюжины потенциальных нулевых дней за один месяц. GTG-50020, русскоязычный финансово мотивированный актёр, выкачал около 26 ГБ от одной жертвы, потребовал выкуп от 1,5 до 2,5 млн $, а затем в течение четырёх дней атаковал около трёх десятков компаний, работающих в сфере ИИ, с целью доступа к предварительно выпущенной модели Claude; Anthropic заявила, что каждый попытка доступа провалилась и её собственные системы никогда не были скомпрометированы. GTG-50029, единственный франкоязычный хактивист, использовал ранее не задокументированное состояние гонки при переустановке WordPress против как минимум четырёх сайтов, получил внутренний доступ к минимум 14 из 42 отслеживаемых целей, выкачал примерно 140 000 записей, включая политические взгляды пользователей платформы кампаний, и создал платформу доосвещения под названием fafsearch, содержащую десятки миллионов строк.
Influence and Surveillance Operations
В отчёте зафиксировано девять случаев операций влияния, происходивших в России, Иране, Турции, Персидском заливе, Южной Азии, Африке и Европе; их охват измеряется по шкале Breakout Scale Института Брукингса. В GTG-04001 русскоязычный актёр в Банги произвёл ежедневный контент для Radio Lengo Songo (98,9 FM), станции, которую Anthropic связала с Politology, подразделением влияния Africa Corps/Wagner, которое, по её оценкам, попало под контроль российской Службы внешней разведки в конце 2023 года; актёр подделывал документы правительства Центрально‑африканской Республики и трудовые контракты, обязывающие лояльность президенту страны, России и её контингенту. Anthropic оценила операцию как Категорию Четыре по шкале. В GTG-54002 следователи отследили около 70 поддельных новостных сайтов, 70 соответствующих аккаунтов X и более 250 неаутентичных аккаунтов комментаторов, принадлежащих LKM Company, французскому агентству цифровой рекламы; сеть опубликовала минимум 8 913 статей примерно на 20 языках, из которых 318 были посвящены Демократической Республике Конго.
Другие операции были построены вокруг выборов и государственных СМИ. GTG-84005 — коммерческая платформа манипуляции выборами в Малайзии, которую Anthropic связала с турецкой компанией BBS Bilisim Teknolojileri из Стамбула, управляла около 1 000 фейковых аккаунтов X во всех 222 избирательных округах Малайзии и создавала фальшивые досье против оппозиционного политика. GTG-24015 включала четыре аккаунта, использовавшие Claude в качестве редакционного стола, снабжая российские государственные СМИ, включая Sputnik Moldova, RIA Novosti, Sputnik en Español, Sputnik Africa и RT English; бывший главный редактор Sputnik Moldova усилил поддельные заявления о президенте Майе Санду перед парламентскими выборами в Молдове 28 сентября 2025 года. GTG-84002, операция против Братьев‑мусульман, которую Anthropic с высокой уверенностью связала с чиновниками ОАЭ, вела около 300 неаутентичных аккаунтов, подготавливала свидетельства для 62‑й сессии Совета ООН по правам человека, профилировала 18 членов Европейского парламента и собирала контр‑досье на специальных докладчиков ООН.
К случаям наблюдения относится GTG-50027, в котором единственный, вероятно, базирующийся в Бамако консультант использовал Claude в качестве основной инженерной силы для Lakana 360, национальной платформы наблюдения, созданной для малийской государственной службы разведки ANSE, чтобы мониторить около 25 млн SIM‑карт у трёх национальных операторов мобильной связи; Anthropic сообщила, что требование о наличии ордера было удалено из компонента генерации досье платформы по запросу оператора. GTG-14010 охватывает актёра, выровненного с правительством КНР, который использовал Claude для отслеживания, профилирования и попытки вербовки уйгуров в Сирии, предлагая оплату за сообщения о вооружённых формированиях, при этом Claude в реальном времени переводил ответы и играл роль эксперта, проверяя достоверность обмана. В GTG-14020 и GTG-14021 китайские актёры, связанных Anthropic с религиозными делами КНР и муниципальной общественной и государственной безопасностью, готовили шаблонные досье на католических кардиналов, Пресвитерианскую церковь Тайваня, тибетских буддистов и Фалуньгун; один из актёров переопределил отказ, получив указания по подавлению, назвав 10 частных лиц для «контроля», а также собрав предоперационную разведку о протестах за рубежом. GTG-34007 охватывает два связанные иранские подразделения, использующие 16 аккаунтов Claude, которые заявили, что за один год наблюдали и профилировали 6 388 иранцев, провели социально‑сетевой анализ более 155 216 твитов, упомянув 39 оппозиционных аккаунтов, и распространили вредоносное расширение Firefox для массового сбора идентификаций, питая совместную систему управления делами под названием Arman.
Weapons Development and Biological Misuse
Отчёт описывает шесть случаев разработки обычного вооружения: три в Китае, два в России и один в Йемене. В GTG-87001 северояменская ячейка использовала Claude Code вместо человеческих инженеров для разработки программного обеспечения навигации, управления и контроля для управляемой ракеты, многоступенчатой баллистической ракеты с заявленным диапазоном более 2 000 км, а также варианта, включающего гиперзвуковый планирующий аппарат; Anthropic заявила, что ячейка провела тестовый запуск управляемой ракеты, который, по всей видимости, завершился неудачей. GTG-27005 охватывает, вероятно, фриланс‑актеров из России, использовавших Claude Code для создания автономного роя FPV‑камикадзе‑дронов, модель которых могла самостоятельно выбирать цели, включая класс «человек», и отдавать команды детонации без участия человека, обучая классификатор зрения на основе собранных украинских боевых видеоматериалов. В GTG-17002 китайский актёр построил примерно 16‑модульный комплект электронных средств войны и подавления ПВО и в середине проекта изменил сценарий симуляции на 12 целей в Тайване, включая командный бункер, радар раннего предупреждения и батареи Patriot и Tien Kung; Anthropic оценила, что актёр был связан с исследовательскими институтами КНР, включая Академию военных наук НОАК.
Пять исследований биологического злоупотребления следуют далее. В мае 2026 года классификатор биологической безопасности Anthropic отклонил запрос о помощи в написании грантовой заявки на исследование повышения вирулентности чикунгуньи для военного исследовательского института, запрос был направлен через платформу обхода, которая позже добавила резервный механизм отправки отклонённых запросов к модели конкурента. Исследователь в неподдерживаемом регионе провёл недели, планируя эксперименты по адаптации птичьего гриппа к млекопитающим, но Anthropic ограничила обмены моделями Claude Sonnet 4 и Haiku 4.5, самой слабой модельной категорией. В третьем случае реселлер‑посредник, обслуживая более десятка несвязанных клиентов, полностью выполнил одну задачу на Opus 5, подготовив грантовую заявку на иммунную эвазию ортопоксвируса от начала до конца за примерно час. Два остальных случая касались программ редизайна ядов и токсинов при государственной поддержке. Anthropic сообщила, что за 30‑дневный период активности, связанной с враждебными государственными институтами, было обнаружено около 35 отдельных исследовательских проектов, большинство из которых были обычными гражданскими исследованиями, но некоторые имели заметный двойной потенциал.
Fraud and Illicit Distillation
В разделе о мошенничестве и злоупотреблениях GTG-15001 описывает китайскую студию приложений, использовавшую Claude для управления сетью из более чем 20 приложений знакомств, где ИИ‑персоны, более 4 700 штук, в течение двухнедельного периода в апреле 2026 года вели диалоги с минимум 25 000 уникальными людьми, обменявшись примерно 2,36 млн сообщений. Студия смешивала реальных фрилансеров в той же ленте совпадений в соотношении примерно три к одному (ИИ‑персоны к реальным людям), и персонажам было приказано никогда не раскрывать, что они автоматизированы.
Anthropic заявила, что с февраля 2026 года она пресекла дистилляционные атаки из семи китайских лабораторий, все из которых нацеливались на её общедоступные модели. В GTG-16005 Anthropic приписала Alibaba крупнейшую зафиксированную кампанию дистилляции: цепочечная дистилляция Opus 4.6 и 4.7, достигавшая почти 3 млн обменов в день от более чем 3 500 мошеннических аккаунтов, при этом за период с мая по июль 2026 года было наблюдено более 151 млн обменов, а полученные транскрипты использовались для обучения Qwen 3.5, 3.6 и 3.7. В GTG-16002 Moonshot AI тайно перенаправляла запросы клиентов к Claude вместо своих моделей Kimi, передавая почти 300 000 запросов за десять дней через 5 380 мошеннических аккаунтов и используя атаку повторного воспроизведения сессий на подписи размышлений Claude для извлечения следов рассуждений, при этом за период с мая по июль 2026 года было зафиксировано более 23 млн обменов. В GTG-16001 DeepSeek применяла ту же технику повторного воспроизведения и перенаправляла запросы пользователей к Claude Opus без их ведома, зафиксировав более 12,1 млн обменов за 14 дней в июле 2026 года; Anthropic сообщила, что перенаправленный трафик раскрыл конфиденциальные материалы, включая живые учётные данные для российской правительственной базы данных и систему управления делами полиции КНР.
Оставшиеся названные кампании включают Zhipu, которая провела 770 609 обменов через очиститель цепочечного мышления за десять дней, нацелившись на киберспособности перед выпуском GLM 5.3, и Xiaomi, которая направила более 400 000 запросов через более чем 1 500 аккаунтов. Anthropic также сообщила, что конвейер дистилляции SenseTime включал транскрипты Claude, приобретённые у сторонних поставщиков данных, а MiniMax построила прокси‑сеть через фирму‑оболочку, предлагающую только модели Anthropic и OpenAI.
Anthropic описывает многоуровневые контрмеры против нелегальной дистилляции: атрибуцию прокси‑сетей на основе метаданных, усиленные классификаторы извлечения в сопровождении запуска Fable 5, суммирование внутреннего рассуждения, предназначенного сделать украденные транскрипты менее полезными для обучения, сохранённые размышления, введённые с Fable 5.1, которые не позволяют новым API‑аккаунтам изменять системный запрос, инструменты или сообщения, предшествующие размышлениям Claude в многотуровых диалогах, а также требования проверки личности для аккаунтов, показывающих сигналы потенциального злоупотребления; такие аккаунты, не прошедшие проверку, блокируются. Компания заявила, что полученные в ходе расследований и пресечения дистилляционных атак знания будут и дальше использоваться для совершенствования создаваемых ею защитных механизмов.












