사이버 보안
마이크로소프트, 프로젝트 페르셉션에 첫 사이버 모델 내장

마이크로소프트 (MSFT )는 프로젝트 페르셉션을 발표했습니다. 이는 고객의 환경에서 3가지 클래스의 AI 에이전트를 사용하는 에이전틱 보안 시스템입니다. 또한 MAI-Cyber-1-Flash를 발표했습니다. 이는 마이크로소프트에서 직접 훈련한 첫 보안 모델입니다. 공개 프리뷰는 2026년 8월 3일에 시작됩니다.
마이크로소프트는 가격에 대한 경우를 제시합니다. 2026년 2월에 회사의 보안 담당 이사로 재加入한 Hayete Gallot는 새로운 사이버 스택에 대한 논리를 제시했습니다. 이는 방어가 지속적으로 실행되어야 하며, 지속적인 방어는 경제적으로 가능해야 한다는 것입니다. 모든 보안 작업에 프론티어 모델을 사용하는 것은 이 기준을 충족하지 못합니다. 특히 취약점을 찾고 악용하는 비용이 계속 낮아지고 있습니다.
MAI-Cyber-1-Flash는 이러한 제약을 해결하는答案입니다. 이 모델은 작고, 코드에 크게 튜닝되어 있으며, 마이크로소프트의 MAI-Thinking-1 라인에서 파생되었습니다. 이는 MDASH에 내장되어 있으며, 100개 이상의 에이전트를 사용하여 소프트웨어 취약점을 찾고 수정하는 하네스를 사용합니다. 또한 90%의 작업을 흡수하여, 가장 어려운 10%의 작업만 OpenAI의 GPT-5.4로 에스컬레이션합니다.
同じ 벤치마크 점수에 대한 비용의 절반
마이크로소프트는 MDASH와 MAI-Cyber-1-Flash를 사용하여 GPT-5.4와 함께 CyberGym에서 96%의 점수를 얻었다고 보고했습니다. 이는 Anthropic의 Mythos보다 12점 높은 점수입니다. 또한 이 조합은 현재 마이크로소프트가 제공하는 구성보다 약 절반의 비용으로 실행된다고 합니다.
점수 자체는 변경되지 않았습니다. 2026년 6월 2일 Build 2026에서 마이크로소프트는 MDASH에 대한 96.55%의 점수를 보고했습니다. 3주 전에 88.45%의 점수를 보고했으며, 같은 시스템이 Windows 네트워킹 및 인증 스택에서 16개의 취약점을 발견했으며, 그 중 4개는 중요 리모트 코드 실행 취약점이었습니다. capability curve는 6월 초부터 평탄해졌습니다. 그러나 비용 곡선은 이동했습니다.
이 구별은 전체 제품입니다. CyberGym은 UC 버클리의 벤치마크로, 188개의 오픈소스 프로젝트에서 1,507개의 실제 취약점을 사용합니다. 에이전트는 코드베이스와 버그 설명을 받고, 크래시를 재현하는 입력을 작성해야 합니다. 2025년 6월에 Dawn Song의 그룹이 이를 발표했을 때, 가장 강력한 에이전트 및 모델 조합은 약 20%를 클리어했습니다. 13개월 만에 이러한 벤치마크를 포화시키는 것은 capability 질문을 해결합니다. 그러나 구매자에게 남은 것은 실제 고객 에스테이트에서 매일 이러한 capability를 실행할 수 있는지, 토큰 비용이 스캔 범위를 결정하지 않는지 여부입니다.
Mythos 비교에는 이름할 가치가 있는 비대칭성이 있습니다. Anthropic은 이 모델을 일반 출시에서 제외하고 Project Glasswing을 통해 검증된 방어 파트너에게만 배포합니다. 마이크로소프트는 이를 대체로 기업이 단순히 구매할 수 있는 것으로 판매합니다. Nvidia (NVDA )는 같은 날에 오픈 소스 방어 모델과 공유 도구를 중심으로 하는 얼라이언스를 출시했습니다.
레드, 블루, 그린 에이전트
페르셉션은 작업을 세 가지 역할로 나눕니다. 레드 에이전트는 공격자가 취할 수 있는 경로를 매핑합니다. 블루 에이전트는 결과 신호를 작업하고 실제 위험을 나타내는 것을 결정합니다. 그린 에이전트는 수정 사항을 적용하고 터치한 것을 강화합니다. 출력은 각 단계에서 인간의 핸드오프 없이 에이전트 사이에서 전달됩니다. 마이크로소프트는 고영향 동작이 인간의 승인하에 유지된다고 합니다.
에이전트 아래에는 경제가 작동하는지 여부를 결정하는 공유 보안 컨텍스트가 있습니다. 마이크로소프트는 조직의 자산, 身分, 관계 및 활동에 대한 지속적으로 업데이트되는 그림을 유지합니다. 따라서 에이전트는 원시 텔레메트리에서 각 실행마다 이를 재구성하는 대신 이 맵에서 시작합니다. 마이크로소프트는 이를 정확도 증가와 컴퓨팅 절약으로 프레임화하며, 항상 켜져 있는 시스템에서는 동일한 문제입니다.
마이크로소프트는 모델이 보안 우선 편향으로 캘리브레이션되었으며, 자동 및 전문가 주도 적대적 테스트를 통해 AI 레드 팀에 의해 평가되었으며, 외부 평가자가 검토했다고 합니다. MDASH 고객은 테넌트 분리, 역할 기반 액세스 제어, 감사 로깅 및 인터넷 액세스 없이 샌드박스化된 실행 환경을 받습니다.
미리 보기에서 제공되는 항목
페르셉션은 마이크로소프트 디펜더에서 처음 제공되며, 나중에 마이크로소프트 보안의 나머지 부분으로 확장됩니다. 가격은 소비 기반으로, 보안 컴퓨팅 단위로 측정되며, 더 무거운 에이전트 작업은 더 많은 단위를 사용하므로, 스캔 범위는 라이선스 티어가 아닌 예산 라인이 됩니다. 마이크로소프트는 페르셉션과 보안 코파일럿, 즉 채팅 어시스턴트 사이에明確한 선을 긋습니다. 하나는 행동하고, 다른 하나는 어시스트합니다.
소프트웨어 취약점 관리는 MAI-Cyber-1-Flash가 처리하는 첫 번째 워크플로입니다. 마이크로소프트는 페르셉션이 미리 보기가 확대됨에 따라 보안 워크플로우를 모델을 통해 더 많이 라우팅할 것이라고 합니다. 이는 실제 고객 에스테이트에서 벤치마크 태스크가 아닌 AI 기반 취약점 발견의 경제가 테스트되는 곳입니다.












