Кибербезопасность
Microsoft Помещает Свою Первую Кибермодель Внутри Проекта Perception

Microsoft (MSFT ) объявил о Проекте Perception, агентной системе безопасности, которая запускает три класса ИИ-агентов в окружении клиента, вместе с MAI-Cyber-1-Flash, первой моделью безопасности, которую компания обучила внутри. Публичная предварительная версия открывается 3 августа 2026 года.
Аргумент, который приводит Microsoft, касается цены. Hayete Gallot, который вернулся в компанию в качестве исполнительного вице-президента по безопасности в феврале 2026 года, определил аргумент для того, что Microsoft называет новым Кибер-Стеком: защита должна работать непрерывно, и непрерывная защита должна быть доступной. Направление модели на каждую задачу безопасности не может решить эту проблему, особенно когда стоимость обнаружения и использования уязвимости продолжает снижаться.
MAI-Cyber-1-Flash является ответом на это ограничение. Модель небольшая, сильно настроена на код и является потомком линии Microsoft MAI-Thinking-1. Она находится внутри MDASH, набора более 100 агентов, которые Microsoft использует для обнаружения и исправления уязвимостей программного обеспечения, и предназначена для того, чтобы поглотить до 90% работы, эскалируя только самые сложные задачи до GPT-5.4 от OpenAI.
Половина стоимости за тот же балл бенчмарка
Microsoft сообщает, что MDASH с MAI-Cyber-1-Flash и GPT-5.4 набирает 96% на CyberGym, что на 12 пунктов выше, чем у Mythos от Anthropic, и что эта пара работает примерно за половину стоимости текущей конфигурации Microsoft.
Сам балл не является изменением. На Build 2026 2 июня 2026 года Microsoft сообщил о 96,55% для MDASH, когда эта система вошла в расширенную предварительную версию. Три недели назад она сообщила о 88,45%, когда та же система обнаружила 16 уязвимостей в стеке сетевых и аутентификационных протоколов Windows, четыре из которых были критическими уязвимостями удаленного выполнения кода, которые Microsoft исправила в цикле исправлений того месяца. Кривая возможностей была плоской с начала июня. Кривая стоимости изменилась.
Эта разница является целым продуктом. CyberGym является бенчмарком UC Berkeley, который состоит из 1507 реальных уязвимостей в 188 открытых проектах, взятых из корпуса OSS-Fuzz от Google; агент получает код и описание ошибки и должен написать вход, который воспроизводит крах. Когда группа Dawn Song опубликовала его в июне 2025 года, самые сильные пары агентов и моделей, которые они измерили, прошли около 20%. Полное прохождение бенчмарка за 13 месяцев решает вопрос о возможностях. Что остается открытым для покупателей, так это вопрос о том, могут ли они запустить эту возможность против своей всей инфраструктуры каждый день, не позволяя счету токенов решать объем их сканирования.
Сравнение с Mythos несет в себе асимметрию, которую стоит назвать: Anthropic удержал эту модель от общего выпуска и распространяет ее среди проверенных оборонных партнеров через Проект Glasswing. Microsoft продает альтернативу как что-то, что предприятие может просто купить. Nvidia (NVDA ) сделал третий аргумент в тот же день, запустив альянс, построенный вокруг открытых защитных моделей и общего инструментария.
Красные, синие и зеленые агенты
Perception делит работу на три роли. Красные агенты картографируют маршруты, которые может пройти атакующий. Синие агенты работают с полученными сигналами и решают, что представляет собой реальный риск. Зеленые агенты применяют исправления и укрепляют то, к чему они прикасаются. Выходные данные передаются между ними без ручной передачи на каждом этапе, в то время как Microsoft говорит, что высокоэффективные действия остаются под человеческим контролем.
Под агентами находится слой, который определяет, работают ли экономические показатели: общий контекст безопасности. Microsoft поддерживает непрерывно обновляемую картину активов, идентификаторов, отношений и деятельности организации, поэтому агенты начинают с этой карты, а не перестраивают ее из сырых телеметрических данных на каждом запуске. Компания представляет это как выигрыш в точности и экономию вычислительных ресурсов, которые на всегда-включенной системе являются одной и той же проблемой.
Microsoft говорит, что модель была откалибрована с предвзятостью в сторону безопасности, оцененной командой ИИ Red Team через автоматическое и экспертно-ведущее тестирование, и рассмотренной внешним оценщиком. Клиенты MDASH получают изоляцию аренды, контроль доступа на основе ролей, ведение аудита и среды выполнения в песочнице без доступа к Интернету.
Что поставляется в предварительной версии
Perception прибывает внутри Microsoft Defender сначала и распространяется на остальную часть Microsoft Security со временем. Цена является потребительской и измеряется в единицах безопасности, причем более тяжелые задачи агентов требуют больше единиц, поэтому ширина сканирования становится бюджетом, а не лицензионным уровнем. Microsoft проводит четкую границу между Perception и Security Copilot, своим помощником-чатом: один действует, другой помогает.
Управление уязвимостями программного обеспечения является первым рабочим процессом, который обрабатывает MAI-Cyber-1-Flash. Microsoft говорит, что Perception будет направлять больше своих рабочих процессов безопасности через модель, когда предварительная версия расширяется, где экономика ИИ-обнаружения уязвимостей тестируется на реальных инфраструктурах клиентов, а не на задачах бенчмарка.












