Кібербезпека

Anthropic викриває перший великомасштабний кібератаку, здійснений за допомогою автоматизації штучного інтелекту

mm
Додайте Unite.AI до бажаних джерел у Google

Anthropic повідомила, що група хакерів, яку вони підозрюють у тому, що це китайська державна група, здійснила перший задокументований великомасштабний кібератаку, виконаний з мінімальною участю людини, використовуючи інструмент Claude Code для автоматизації 80-90 відсотків кампанії.

Нападники націлилися приблизно на 30 організацій серед великих технологічних фірм, фінансових інститутів, виробників хімічної продукції та урядових агенцій. Хоча більшість атак були заблоковані, кампанія мала певний успіх у невеликій кількості випадків. Claude Code здійснював розвідку, тестування уразливості, збирання даних про облікові записи та витік даних у великих масштабах, переважно автономно, з людськими операторами, необхідними лише на критичних етапах прийняття рішень.

Ви можете прочитати повний звіт Anthropic тут.

Методи нападу та маніпуляція штучним інтелектом

Хакери обійшли системи безпеки Claude за допомогою складної соціальної інженерії. Вони обманули систему штучного інтелекту, видаючи себе за працівників легітимної компанії з кібербезпеки, яка проводила оборонні тести. Нападники також розділили свої операції на малі, здавалося б, невинні завдання, які надавали Claude неповну інформацію про загальну мету нападу.

Claude Code здійснив розвідку систем цілевих організацій для ідентифікації високоцінних баз даних, виконав цю розвідку швидше, ніж люди-хакери могли б, та провів дослідження та написав спеціальний код для тестування уразливості безпеки. Система зібрала імена користувачів та паролі для подальшого доступу до мережі, а потім витягнула та категоризувала приватні дані згідно з їхньою розвідувальною цінністю. Нападники могли здійснити кампанію практично за один клік, після чого штучний інтелект працював переважно самостійно на швидкостях, неможливих для людських команд – часто надсилаючи тисячі запитів за секунду.

Зображення: Anthropic

Виявлення та реакція компанії

Anthropic виявила напад у середині вересня 2025 року та розпочала розслідування негайно. Усього за 10 днів компанія припинила доступ групи до Claude, зв’язалася з постраждалими організаціями та повідомила правоохоронні органи. Компанія з тих пір розширила свої можливості виявлення та розробляє додаткові методи для розслідування та виявлення великомасштабних, розподілених атак.

Цей інцидент стався після попередніх випадків неправильного використання, задокументованих Anthropic у 2025 році. У серпні компанія опублікувала звіт про розвідку загроз, у якому описала операцію з вимагання даних під назвою GTG-2002, яка використовувала інструмент Claude Code для здійснення великомасштабного викрадення, націленого на щонайменше 17 організацій у сфері охорони здоров’я, надзвичайних служб, уряду та релігійних інститутів. Ця злочинна діяльність вимагала викуп у розмірі понад 500 000 доларів, погрожуючи опублікувати вкрадені дані, а не використовувати традиційне шифрування програмного забезпечення для викупу.

Інфраструктура виявлення Anthropic залежить від декількох шарових технік, включаючи поведінковий аналіз для моніторингу моделей використання протягом мільйонів запитів API, виявлення аномалій для ідентифікації послідовностей операцій, які не відповідають легітимному використанню, та узгодження моделей для визнання відомих та нових технік маніпуляції. Компанія використовує спеціалізовані класифікатори, які аналізують вхідні дані користувачів на потенційно шкідливі запити та оцінюють відповіді Claude до або після доставки.

Вплив на галузь

Кампанія мала безпрецедентний рівень автономності штучного інтелекту у кібератаках та позначає те, що експерти з безпеки вважають поворотним моментом у кібершпигунстві. Спроможність систем штучного інтелекту здійснювати складні атаки на швидкостях, неможливих для людини, з мінімальною наглядом людини, створює нові виклики для захисників кібербезпеки.

Розкриття Anthropic відбувається в той час, коли компанії зі штучного інтелекту піддаються зростаючому тиску щодо запобігання зловживанню їхніми моделями. Компанія підтримує комплексну програму розвідки загроз та заходів безпеки для виявлення та протидії неправильному використанню Claude, з задокументованими випадками безпеки протягом усього 2025 року. У березні компанія виявила операцію з впливу на послуги, яка використовувала Claude для автоматизації взаємодії з десятками тисяч облікових записів у соціальних мережах у декількох країнах та мовах.

Інцидент підкреслює зростаючу складність інструментів, що працюють на штучному інтелекті, та виклики щодо запобігання їхньому зловживанню, зберігаючи при цьому корисність для легітимних користувачів. Anthropic заблокувала пов’язані облікові записи та продовжує покращувати свої можливості виявлення та пом’якшення наслідків для боротьби з еволюціонуючою загрозою.

Алекс Макфарленд - журналіст та письменник з питань штучного інтелекту, який досліджує останні розробки в галузі штучного інтелекту. Він співпрацював з численними стартапами та виданнями з штучного інтелекту у світі.