Cybersikkerhed
Microsoft Indsætter Dets Første Cyber Model I Project Perception

Microsoft (MSFT ) har annonceret Project Perception, et agentic sikkerhedssystem, der løser tre klasser af AI-agenter på en kundes eget miljø, sammen med MAI-Cyber-1-Flash, det første sikkerhedsmodel, som virksomheden har trænet internt. Offentlig preview åbner den 3. august 2026.
Sagen, som Microsoft fremfører, handler om pris. Hayete Gallot, der genindtrådte i virksomheden som executive vice president of security i februar 2026, fremførte argumentet for, hvad Microsoft kalder en ny Cyber Stack: forsvar skal køre kontinuerligt, og kontinuerligt forsvar skal være billig. At pege en frontier-model mod hver sikkerhedstask klarer ikke den barriere, især da omkostningerne ved at finde og udnytte en svaghed holder med at falde.
MAI-Cyber-1-Flash er svaret på den begrænsning. Modellen er lille, tilpasset kraftigt på kode, og afledt fra Microsofts MAI-Thinking-1-linje. Den sidder inde i MDASH, harnesset med over 100 agenter, som Microsoft bruger til at finde og fikse software-svagheder, og er bygget til at absorbere op til 90% af arbejdet der, og kun eskalere de hårdeste 10% af opgaverne til OpenAI’s GPT-5.4.
Halv pris for samme benchmark-score
Microsoft rapporterer, at MDASH, der kører MAI-Cyber-1-Flash med GPT-5.4, scorer 96% på CyberGym, som det placerer 12 point over Anthropics Mythos, og at parret kører til omtrent halv pris for den konfiguration, som Microsoft sender i dag.
Scoren i sig selv er ikke ændringen. Ved Build 2026 den 2. juni 2026, rapporterede Microsoft 96,55% for MDASH som harnesset indgik i udvidet preview. Tre uger tidligere havde det rapporterede 88,45%, da systemet afslørede 16 svagheder i Windows-netværks- og godkendelsesstacken, fire af dem kritiske fjern-kode-ekssekverings-svagheder, som Microsoft fiksat i den måneds patch-cyklus. Evolutionskurven har været flad siden begyndelsen af juni. Omkostningskurven er, hvad der er ændret.
Denne forskel er hele produktet. CyberGym er en UC Berkeley-benchmark på 1.507 reelle svagheder på tværs af 188 open-source-projekter, hentet fra Googles OSS-Fuzz-korpus; en agent får en kodebase og en fejlbeskrivelse og skal skrive en input, der reproducerer crashen. Da Dawn Songs gruppe offentliggjorde det i juni 2025, klarede de stærkeste agent- og model-par cirka 20%. At mætte en benchmark, der er så hård, på 13 måneder, afgør spørgsmålet om evnen. Hvad det efterlader for købere er, om de kan køre den evne mod hele deres ejendom, hver dag, uden at token-regningen bestemmer omfanget af deres scanning for dem.
Mythos-sammenligningen bærer en asymmetri, der er værd at nævne: Anthropic tilbageholdt den model fra generel udgivelse og distribuerer den til godkendte defensive partnere gennem Project Glasswing. Microsoft sælger alternativet som noget, en virksomhed kan købe. Nvidia (NVDA ) lavede en tredje argument på samme dag, hvor de lancerede en alliance bygget omkring åbne defensive modeller og fælles værktøj.
Røde, blå og grønne agenter
Perception opdeler arbejdet i tre roller. Røde agenter kortlægger ruter, en angriber kunne tage. Blå agenter arbejder med de resulterende signaler og beslutter, hvad der repræsenterer ægte risiko. Grønne agenter anvender korrektioner og forstærker, hvad de berører. Udgang passerer mellem dem uden en menneskelig aflevering på hvert stadium, mens Microsoft siger, at høj-impact-handlinger forbliver under menneskelig godkendelse.
Under agenterne ligger laget, der bestemmer, om økonomien fungerer: en fælles sikkerhedskontekst. Microsoft opretholder en kontinuerligt opdateret billed af en organisations aktiver, identiteter, relationer og aktivitet, så agenterne begynder fra den kort i stedet for at genopbygge den ud fra rå telemetri på hver kørsel. Virksomheden fremstiller dette som en nøjagtighedsgevinst og en beregningsbesparelse, som på et altid-på-system er det samme problem.
Microsoft siger, at modellen blev kalibreret med en sikkerheds-først-bias, vurderet af dens AI Red Team gennem automatiseret og ekspert-ledet adversarial testning, og gennemgået af en ekstern vurderer. MDASH-kunder får lejerkontrol, rollebaseret adgangskontrol, audit-logning og sandbox-executionsmiljøer med ingen internetadgang.
Hvad skibes i preview
Perception ankommer først i Microsoft Defender og udvides over resten af Microsoft Security over tid. Prisen er baseret på forbrug og måles i Security Compute Units, hvor tungere agent-opgaver trækker mere af dem, så scanningens bredde bliver en budgetlinje i stedet for en licensniveau. Microsoft tegner en klar linje mellem Perception og Security Copilot, dens chat-assistent: den ene handler, den anden assisterer.
Software-svaghedsstyring er den første arbejdsgang, som MAI-Cyber-1-Flash håndterer. Microsoft siger, at Perception vil lede mere af sine sikkerhedsarbejdsgange gennem modellen, når previewen udvides, hvilket er, hvor økonomien i AI-drevet svaghedsopdagelse bliver testet mod virkelige kunde-ejendomme i stedet for benchmark-opgaver.












