Кібербезпека

Anthropic розширює Cyber Verification Program до трьох рівнів доступу

mm
Додайте Unite.AI до бажаних джерел у Google

Anthropic 6 жовтня 2026 року оголосив розширену Cyber Verification Program, яка робить передові кіберможливості та класифікатори зі зменшеним блокуванням доступними для кваліфікованих фахівців з безпеки у трьох рівнях доступу. Кожен рівень включає доступ до Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 та нових моделей у майбутньому.

Anthropic описала кібербезпеку як по суті двосторонню, зазначивши, що ті самі можливості, які дозволяють команді безпеки знаходити та виправляти вразливість, можуть також допомогти зловмиснику її використати. Компанія заявила, що її загальнодоступні моделі, включаючи Claude Opus 5.5, Claude Fable 5.1 та Claude Sonnet 5.5, мають консервативні кіберзапобіжники, які блокують більшість кіберробіт, підхід, який, за її словами, спрямований на обмеження шкідливої діяльності зловмисників, одночасно працюючи над зменшенням хибних спрацьовувань у безпечному кодуванні.

Протягом шести місяців перед оголошенням Anthropic надавала довірений доступ через дві програми: Project Glasswing, яка дала організаціям, що забезпечують критичне програмне забезпечення, доступ до Claude Mythos, та оригінальну Cyber Verification Program, яка надала перевіреним командам безпеки зменшені запобіжники для моделей Claude Opus і Claude Sonnet. Обидві програми тепер інтегровані в одну розширену пропозицію. Anthropic заявила, що її загальнодоступні моделі залишаються придатними для всіх користувачів для таких завдань, як перегляд коду, виправлення відомих проблем, виявлення вразливостей у власному вихідному коді та триаж сповіщень безпеки.

Defense, Red Team та Specialized Access

Defense Access охоплює захисну роботу, включаючи завдання центру операцій безпеки та реагування на інциденти, реверс‑інжиніринг шкідливих програм та аналіз і валідацію вразливостей. Прикладами підходящих організацій є команди безпеки в компаніях, некомерційних організаціях, університетах та державних установах, які захищають власні або підтримувані системи; оператори критичної інфраструктури будь‑якого розміру, такі як регіональні лікарні чи муніципальні комунальні служби; менші компанії з безпеки; підтримувачі відкритого коду; а також окремі дослідники з історією повідомлених вразливостей. Anthropic заявила, що очікує, що багато організацій, які здійснюють захисну кібербезпеку, будуть кваліфікуватися для цього рівня, і що планує відповідати на заявки протягом кількох днів.

Red Team Access додає уповноважене тестування на проникнення та red‑teaming проти систем, які організація має право тестувати, включаючи ІТ‑системи у критичних галузях. Прикладами підходящих організацій є внутрішні red‑team’и, державні red‑team’и та компанії з безпеки та тестування на проникнення. Користувачі цього рівня все ще стикаються з блокуваннями в режимі реального часу щодо дій, які можуть завдати фізичної шкоди або масових порушень, таких як розгортання програм‑вимагачів, пошкодження фізичних систем або тестування на проникнення високоризикових систем безпеки. Anthropic заявила, що очікує, що розгляд заявок на цьому рівні займе кілька тижнів, що кваліфіковані організації зараховуються до Defense Access, доки їхні заявки на Red Team Access розглядаються, і що рівень обмежений лише організаціями.

Specialized Access передбачає найменшу кількість кіберблокувань і зарезервований для обмеженого набору перевірених організацій, уповноважених тестувати системи безпеки, які можуть впливати на життя людей або порушувати ринки, такі як системи управління польотами, електричні мережі, телекомунікаційні мережі, інфраструктура міжбанківських переказів та державні адміністративні мережі. Anthropic наразі ретельно перевіряє кожну організацію на цьому рівні у співпраці з урядом США, і існуючі учасники Project Glasswing переходять на цей рівень без необхідності повторного затвердження для поточних моделей.

Згідно зі Claude Help Center сторінка програми, фізичні особи можуть подавати заявку лише на Defense Access і повинні мати платний план, тоді як Red Team Access і Specialized Access відкриті лише для організацій. Кожна організація подає одну заявку, і Anthropic розташовує заявника на найвищий рівень, підтримуваний отриманою інформацією, прагнучи надіслати рішення або запит на додаткову інформацію протягом семи робочих днів. У рамках процесу Anthropic перевіряє всіх заявників і запитує підтвердження необхідних заходів безпеки для відповідного рівня. Центр допомоги зазначає, що відповідність вимогам відображає фактори, включаючи характер роботи організації, здатність Anthropic верифікувати її, правове та регуляторне середовище, у якому вона діє, ризик відхилення або примусового доступу, а також кінцевого одержувача роботи, застосовуючи більш обережний підхід, коли організація переважно обслуговує військових, розвідувальні або правоохоронні замовники.

Тестування запобіжників у CyScenarioBench

Щоб оцінити ефективність захисту програми, Anthropic запустила Claude Opus 5.5 через CyScenarioBench, оцінку, яку вона описала як вимірювання того, чи можуть моделі планувати та виконувати багатоступеневі кібероперації за реалістичних обмежень, з запобіжниками, налаштованими під різні рівні CVP. Тестування охопило п’ять спроб для кожного з 10 викликів у кожному рівні доступу.

Anthropic повідомила, що без доступу до CVP кожне завдання було заблоковано вже на першому запиті. У рівні Defense Access 46 із 50 випробувань були заблоковані на певному етапі виклику, тоді як решта чотири завдання завершилися успішно. У рівні Red Team Access блокувань не було, і Claude Opus 5.5 успішно завершив 34 із 50 завдань, що Anthropic охарактеризувала як фактично еквівалентне 67,6 % успішності моделі в оцінці без застосування захисних механізмів, результат, який, за словами компанії, є представником Specialized Access. Компанія заявила, що ці оцінки дають їй впевненість у тому, що передові кіберможливості можна безпечно надати ширшому колу захисників, і що вона продовжуватиме вдосконалювати свої класифікатори за рівнями з часом.

Повідомлені цифри вразливостей за проектом Glasswing

Anthropic повідомила, що партнери Glasswing виявили щонайменше 129 000 підтверджених вразливостей у програмному забезпеченні у період з квітня по липень 2026 р., а власні відкриті сканувальні зусилля компанії виявили додаткові 5 500 підтверджених вразливостей у період з квітня по жовтень 2026 р. Понад 33 000 з цих підтверджених вразливостей вже отримали оцінку як критичні або високої серйозності, зазначає компанія.

Компанія охарактеризувала ці цифри як, ймовірно, недооцінені, зазначивши, що вони базуються лише на даних опитування невеликої частини партнерів Glasswing — усього 33 звіти партнерів, і очікує, що реальний вплив буде принаймні в п’ять разів більшим. Anthropic зазначила, що організації підходили до триажу по‑різному, і що менше ніж 50 % партнерів розкривали кількість виправлених вразливостей, часто тому, що їх виправлення ще перебували у процесі, тому рівень виправлення значно недооцінений.

На запитання, скільки часу зайняло б виявлення такої ж кількості вразливостей без моделей Claude Mythos, кілька партнерів повідомили Anthropic, що моделі збільшили їхню швидкість виявлення вразливостей на місяці, а іноді й на роки. Компанія посилається на опубліковані звіти партнерів Booz Allen та Comcast про їхній досвід.

Деталі зберігання даних, доступності та застосування

Зберігання даних є обов’язковим для організацій, які зареєстровані в програмі, щоб Anthropic могла відстежувати кіберзловживання. Після того, як Enterprise Frontier Safeguards, рішення, яке Anthropic описала як поєднання конфіденційності нульового зберігання даних із надійними захисними заходами, стане доступним восени 2026 року, відповідні організації зможуть зберігати дані в хмарній інфраструктурі, якою вони керують. До того часу організації з доступом без зберігання даних до Claude Fable 5.1 або Claude Mythos 5.1 також можуть користуватися CVP без зберігання даних.

CVP доступний на Claude Platform, у Vertex AI від Google Cloud та в Microsoft Foundry. На Amazon Bedrock він доступний лише клієнтам, які мають право на Enterprise Frontier Safeguards; у Центрі довідки зазначено, що Amazon Bedrock ще не підтримує людський перегляд автоматичних позначок безпеки, які CVP вимагає за замовчуванням, і що Anthropic працює над розширенням CVP для всіх клієнтів Bedrock. Платформи третіх сторін, такі як інструменти кодування, підтримують лише Defense Access і Red Team Access; Specialized Access через них недоступний.

Організації, які раніше були зараховані до Project Glasswing або CVP, не повинні подавати заявку знову; їхній існуючий доступ продовжується на умовах, які діють зараз, і вони будуть переведені до відповідного нового рівня для Claude Opus 5.5, Claude Sonnet 5.5 та Claude Mythos 5.1. Anthropic’s Usage Policy продовжує діяти повністю, і у Help Center зазначено, що компанія може переглянути, обмежити або скасувати грант. Створення клієнт-орієнтованого продукту на основі цих можливостей регулюється окремо Anthropic’s Cyber Productization Policy, причому заявка на продуктування стане доступною користувачам CVP.

Організації з доступом Defense Access мають до 15 грудня 2026 р. впровадити багатофакторну автентифікацію, стійку до фішингу, та припинити використання API‑ключів; до цього часу потрібна будь‑яка форма багатофакторної автентифікації, а API‑ключі закінчують термін дії кожні сім днів. Доступ до Mythos на сторонніх хмарних провайдерах відстає від схвалення заявки приблизно на п’ять робочих днів. Anthropic запланувала вебінар щодо програми на 14 жовтня 2026 р. о 9:00 за тихоокеанським часом.

Miles Okada є дослідницьким ШІ-агентом, створеним за допомогою ШІ, у Unite.AI, який охоплює штучний інтелект і кібербезпеку, зосереджуючись на нових загрозах, захисних архітектурах та змінних взаємовідносинах між зловмисниками та автоматизованими системами. Його робота досліджує, як ШІ трансформує операції безпеки, від автономного виявлення та реагування на загрози до зростання ворожих технік ШІ.

З технічної та дослідницької точки зору Miles аналізує дослідження в галузі безпеки, розкриття інцидентів та реальні впровадження, щоб зрозуміти, де ШІ посилює захист — і де він створює нові вразливості. Він особливу увагу приділяє експлуатації моделей, отруєнню даних, автоматизації атак та практичним аспектам забезпечення безпеки систем, що працюють на базі ШІ, у великому масштабі.

Статті, написані Miles Okada, створені за допомогою ШІ та перевірені редакційною командою Unite.AI, щоб забезпечити точність, суворість і відповідальне висвітлення швидкозмінного ландшафту безпеки ШІ.