Кибербезопасность

Anthropic расширяет программу киберверификации до трех уровней доступа

mm
Добавьте Unite.AI в избранные источники в Google

Anthropic 6 октября 2026 года анонсировала расширенную программу киберверификации, которая делает передовые киберспособности и классификаторы с уменьшенными блокировками доступными квалифицированным специалистам по безопасности через три уровня доступа. Каждый уровень включает доступ к Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 и будущим новым моделям.

Anthropic описала кибербезопасность как по своей природе двойного назначения, заявив, что те же возможности, которые позволяют команде безопасности находить и исправлять уязвимость, могут также помочь злоумышленнику её использовать. Компания заявила, что её общедоступные модели, включая Claude Opus 5.5, Claude Fable 5.1 и Claude Sonnet 5.5, имеют консервативные киберзащиты, блокирующие большую часть киберработ, подход, который, по её словам, направлен на ограничение вредоносной активности злоумышленников, одновременно снижая количество ложных срабатываний при безопасном кодировании.

В течение шести месяцев, предшествующих объявлению, Anthropic предоставляла доверенный доступ через две программы: Project Glasswing, которая давала организациям, обеспечивающим критическое программное обеспечение, доступ к Claude Mythos, и оригинальную программу киберверификации, которая предоставляла проверенным командам безопасности уменьшенные ограничения на моделях Claude Opus и Claude Sonnet. Эти две программы теперь объединены в единое расширенное предложение. Anthropic заявила, что её общедоступные модели остаются пригодными для всех пользователей для таких задач, как проверка кода, исправление известных проблем, поиск уязвимостей в собственном исходном коде и сортировка сигналов безопасности.

Защита, Red Team и специализированный доступ

Доступ защиты охватывает защитную работу, включая задачи центра операций безопасности и реагирования на инциденты, обратный инжиниринг вредоносного ПО и анализ и проверку уязвимостей. Примерами подходящих организаций являются команды безопасности в компаниях, некоммерческих организациях, университетах и государственных учреждениях, защищающих принадлежащие им или обслуживаемые ими системы; операторы критической инфраструктуры любого размера, такие как региональные больницы или муниципальные коммунальные службы; небольшие фирмы по безопасности; сопровождающие проекты с открытым исходным кодом; а также отдельные исследователи с историей сообщённых уязвимостей. Anthropic заявила, что ожидает, что многие организации, занимающиеся защитной кибербезопасностью, смогут претендовать на этот уровень, и что она стремится отвечать на заявки в течение нескольких дней.

Red Team Access добавляет авторизованное тестирование на проникновение и red‑teaming против систем, которые организация имеет право тестировать, включая ИТ‑системы в критических отраслях. Примерами подходящих организаций являются внутренние red teams, государственные red teams и компании, занимающиеся безопасностью и тестированием на проникновение. Пользователи этого уровня всё ещё сталкиваются с блокировками в реальном времени при действиях, которые могут причинить физический вред или массовые сбои, таких как развертывание программ‑вымогателей, повреждение физических систем или тестирование на проникновение в высокорисковые системы безопасности. Anthropic заявила, что ожидает, что рассмотрение заявок на этом уровне займет несколько недель, принимает подходящие организации в Доступ защиты, пока их заявки на Red Team Access рассматриваются, и ограничивает уровень только организациями.

Специализированный доступ подразумевает наименьшее количество киберблокировок и предназначен для ограниченного набора проверенных организаций, уполномоченных тестировать системы безопасности, которые могут влиять на жизнь людей или нарушать работу рынков, такие как системы управления полётами, электросети, телекоммуникационные сети, инфраструктура межбанковских переводов и государственные административные сети. Anthropic в настоящее время тщательно проверяет каждую организацию на этом уровне в сотрудничестве с правительством США, а существующие участники Project Glasswing переходят на этот уровень без необходимости повторного одобрения для текущих моделей.

Согласно странице Claude Help Center программы, физические лица могут подавать заявки только на Доступ защиты и должны находиться на платном плане, тогда как Red Team Access и Specialized Access открыты только для организаций. Каждая организация подаёт единую заявку, и Anthropic размещает заявителя на самом высоком уровне, поддерживаемом полученной информацией, стремясь отправить решение или запрос дополнительной информации в течение семи рабочих дней. В рамках процесса Anthropic проверяет всех заявителей и запрашивает доказательства наличия требуемых мер безопасности для соответствующего уровня. Центр помощи указывает, что соответствие требованиям зависит от факторов, включая характер работы организации, способность Anthropic подтвердить её идентичность, правовую и нормативную среду, в которой она действует, риск отклонения или принудительного доступа, а также конечного получателя работы, при этом применяется более осторожный подход, если организация в основном обслуживает военные, разведывательные или правоохранительные заказчики.

Тестирование защит на CyScenarioBench

Чтобы оценить эффективность защит программы, Anthropic запустила Claude Opus 5.5 через CyScenarioBench, оценку, которую она описала как измеряющую, могут ли модели планировать и выполнять многоэтапные кибероперации в реалистичных ограничениях, с настройкой защит для разных уровней CVP. Тестирование включало пять попыток для каждой из 10 задач в каждом уровне доступа.

Anthropic сообщила, что без доступа к CVP каждая задача блокировалась уже после первого запроса. В уровне доступа Defense Access 46 из 50 испытаний были заблокированы на каком‑то этапе задачи, тогда как оставшиеся четыре задачи завершились успешно. В уровне доступа Red Team Access блокировок не было, и Claude Opus 5.5 успешно выполнил 34 из 50 задач, что Anthropic охарактеризовала как фактически эквивалентное показателю успеха модели в 67,6 % при оценке без применённых средств защиты, результат, который, по её словам, представляет уровень Specialized Access. Компания заявила, что эти оценки дают ей уверенность в том, что передовые киберспособности могут быть безопасно предоставлены более широкому кругу защитников, и что она будет продолжать совершенствовать свои классификаторы, основанные на уровнях, со временем.

Сообщённые цифры уязвимостей из Project Glasswing

Anthropic сообщила, что партнёры Glasswing обнаружили по крайней мере 129 000 проверенных уязвимостей в программном обеспечении в период с апреля по июль 2026 г., а её собственные усилия по сканированию с открытым исходным кодом нашли дополнительно 5 500 проверенных уязвимостей в программном обеспечении с апреля по октябрь 2026 г. Более 33 000 из этих проверенных уязвимостей уже оценены как критические или высоко‑серьёзные, сообщила компания.

Компания охарактеризовала эти цифры как вероятно недооценённые, отметив, что они основаны только на данных опроса части партнёров Glasswing — в общей сложности 33 отчёта партнёров, и заявила, что реальное влияние, по её оценке, как минимум в пять раз выше. Anthropic сообщила, что организации применяли разные подходы к приоритизации, и что менее 50 % партнёров раскрыли количество исправленных уязвимостей, часто потому что их исправления ещё находятся в процессе, из‑за чего коэффициент исправления существенно недооценён.

Когда спросили, сколько времени потребовалось бы найти такое же количество уязвимостей без моделей Claude Mythos, несколько партнёров сообщили Anthropic, что модели повысили их скорость обнаружения уязвимостей на месяцы, а иногда и годы. Компания сослалась на опубликованные отчёты партнёров Booz Allen и Comcast о их опыте.

Сохранение данных, доступность и детали применения

Сохранение данных требуется для организаций, участвующих в программе, чтобы Anthropic могла отслеживать киберзлоупотребления. Как только решение Enterprise Frontier Safeguards, которое Anthropic описывает как сочетание конфиденциальности нулевого сохранения данных с надёжными мерами защиты, станет доступным осенью 2026 г., соответствующие организации смогут хранить данные в облачной инфраструктуре, которой они управляют. До тех пор организации с доступом без сохранения данных к Claude Fable 5.1 or Claude Mythos 5.1 также могут использовать CVP без сохранения данных.

CVP доступна на Claude Platform, Vertex AI от Google Cloud и Microsoft Foundry. На Amazon Bedrock она доступна только клиентам, имеющим право на Enterprise Frontier Safeguards; в Служебном центре указано, что Amazon Bedrock пока не поддерживает человеческую проверку автоматических флагов безопасности, которые CVP требуют по умолчанию, и что Anthropic работает над расширением CVP для всех клиентов на Bedrock. Сторонние платформы, такие как инструменты кодирования, поддерживают только уровни доступа Defense Access и Red Team Access; уровень Specialized Access через них недоступен.

Организации, ранее участвовавшие в Project Glasswing или CVP, не обязаны подавать заявку повторно; их текущий доступ продолжит работать на условиях, действующих сейчас, и они будут переведены в соответствующий новый уровень для Claude Opus 5.5, Claude Sonnet 5.5 и Claude Mythos 5.1. Политика использования Anthropic остаётся в полной силе, а Служебный центр сообщает, что компания может пересмотреть, сузить или отозвать грант. Создание клиентского продукта на основе этих возможностей регулируется отдельно Политикой киберпродукционирования Anthropic, при этом заявка на продукционирование будет доступна пользователям CVP.

Организациям с уровнем доступа Defense Access предоставлен срок до 15 декабря 2026 г., чтобы внедрить фишинг‑устойчивую многофакторную аутентификацию и прекратить использование API‑ключей; до этого момента требуется какая‑то форма многофакторной аутентификации, а API‑ключи истекают каждые семь дней. Доступ к Mythos у сторонних облачных провайдеров отстаёт от одобрения заявки примерно на пять рабочих дней. Anthropic запланировала вебинар по программе на 14 октября 2026 г. в 9 ч. по тихоокеанскому времени.

Miles Okada — исследовательский ИИ-агент, созданный ИИ, в Unite.AI, охватывающий искусственный интеллект и кибербезопасность с акцентом на новые угрозы, защитные архитектуры и развивающуюся динамику между атакующими и автоматизированными системами. Его работа исследует, как ИИ трансформирует операции безопасности, от автономного обнаружения и реагирования на угрозы до роста враждебных техник ИИ.

С технической и исследовательской точки зрения Майлс анализирует исследования в области безопасности, раскрытия инцидентов и реальные внедрения, чтобы понять, где ИИ укрепляет защиту — и где он создаёт новые уязвимости. Он уделяет особое внимание эксплуатации моделей, отравлению данных, автоматизации атак и практическим аспектам обеспечения безопасности систем, работающих на основе ИИ, в масштабах.

Статьи, написанные Майлсом Окада, генерируются ИИ и проверяются редакционной командой Unite.AI, чтобы обеспечить точность, строгость и ответственное освещение быстро меняющегося ландшафта безопасности ИИ.