Kyberturvallisuus
Microsoft Laittaa Ensimmäisen Kyberturvallisuusmallinsa Project Perceptioniin

Microsoft (MSFT ) on ilmoittanut Project Perceptionista, joka on agenteerinen turvallisuusjärjestelmä, joka käyttää kolmea luokkaa tekoälyagenteja asiakkaan omassa ympäristössä, yhdessä MAI-Cyber-1-Flashin kanssa, joka on ensimmäinen turvallisuusmalli, jonka yhtiö on kouluttanut sisäisesti. Julkinen esikatselu aukeaa 3. elokuuta 2026.
Microsoft esittää tapauksen, joka koskee hintaa. Hayete Gallot, joka liittyi yhtiöön uudelleen turvallisuuden johtajana helmikuussa 2026, esitti argumentin siitä, mitä Microsoft kutsuu uudeksi Cyber Stackiksi: puolustus on toimittava jatkuvasti, ja jatkuva puolustus on oltava edullinen. Tekoälymallin käyttäminen jokaisessa turvallisuustehtävässä ei täytä tätä vaatimusta, erityisesti kun haavoittuvuuksien löytämisestä ja hyödyntämisestä aiheutuvat kustannukset laskevat.
MAI-Cyber-1-Flash on vastaus tähän rajoitteeseen. Malli on pieni, se on suunniteltu koodin ympärille ja se perustuu Microsoftin MAI-Thinking-1-malliin. Se sijaitsee MDASHissa, joka on yli 100 agentin joukko, jonka Microsoft käyttää ohjelmistovirheiden löytämiseen ja korjaamiseen, ja se on suunniteltu ottamaan vastaan jopa 90% työstä, ja siirtämään vain vaikeimmat tehtävät OpenAI:n GPT-5.4:lle.
Puoli hintaa samalle benchmark-pisteelle
Microsoft ilmoittaa, että MDASH, joka käyttää MAI-Cyber-1-Flashia ja GPT-5.4:ää, saavuttaa 96% CyberGymissä, joka on 12 pistettä Anthropicin Mythosia parempi, ja että tämä yhdistelmä toimii noin puolella nykyisen Microsoftin konfiguraation kustannuksista.
Itse piste ei ole muuttunut. Build 2026 -tapahtumassa 2. kesäkuuta 2026 Microsoft ilmoitti 96,55%:n MDASHille, kun järjestelmä siirtyi laajempaan esikatseluun. Kolme viikkoa aikaisemmin se ilmoitti 88,45%:n, kun sama järjestelmä löysi 16 haavoittuvuutta Windowsin verkkoyhteyden ja todennuksen ympärillä, neljä niistä olivat kriittisiä etäkoodin suorittamisen haavoittuvuuksia, jotka Microsoft korjasi saman kuun korjauspäivityksessä. Kykykäyrä on ollut tasainen kesäkuun alusta lähtien. Kustannuskaava on se, mikä on muuttunut.
Tämä ero on koko tuote. CyberGym on UC Berkeleyn benchmark, joka koostuu 1507 todellisesta haavoittuvuudesta 188 avoimen lähdekoodin projektissa, jotka on poimittu Googleen OSS-Fuzz-korpuksista; agentti saa koodin ja haavoittuvuuden kuvaus ja on kirjoitettava syöte, joka toistaa kaatumisen. Kun Dawn Songin ryhmä julkaisi sen kesäkuussa 2025, voimakkain agentti- ja mallipari, jonka he mitattiin, selvisi noin 20%:sta. Täyttäminen benchmarkin, joka on niin vaikea kuin 13 kuukaudessa, ratkaisee kykykysymyksen. Se jättää avoimeksi ostajille, voivatko he suorittaa kyseisen kyvyn koko omaisuuttaan vastaan joka päivä ilman, että tokenilasku päättää heidän skannauksensa laajuuden.
Mythos-verrannointi sisältää epäsymmetrian, joka on mainittava: Anthropic piti mallia pois yleisestä julkaisusta ja jakaa sitä valituille puolustuskuville Project Glasswingin kautta. Microsoft myy vaihtoehtoa jonakin, mitä yritys voi ostaa. Nvidia (NVDA ) esitti kolmannen argumentin samana päivänä, kun se lanseerasi liiton, joka perustuu avoimiin puolustusmalleihin ja jaettuihin työkaluihin.
Punaiset, siniset ja vihreät agentit
Perception jakaa työn kolmeen rooliin. Punaiset agentit kartoittavat reittejä, joita hyökkääjä voisi käyttää. Siniset agentit työskentelevät tuloksena olevien signaaleiden kanssa ja päättävät, mitä edustaa aitoa riskiä. Vihreät agentit soveltavat korjauksia ja lujittavat sitä, mihin ne koskevat. Tulosteet siirtyvät heidän välillään ilman, että ihminen osallistuu jokaisessa vaiheessa, kun taas Microsoft sanoo, että suurvaikutteiset toimet pysyvät ihmisen hyväksynnän alaisina.
Agenttien alla on kerros, joka määrittää, toimivatko taloudelliset seikat: jaettu turvallisuuskonteksti. Microsoft ylläpitää jatkuvasti päivitettyä kuvaa organisaation varoista, identiteeteistä, suhteista ja toiminnasta, jotta agentit voivat aloittaa työnsä siitä, missä he ovat, eikä heidän tarvitse rakentaa sitä uudelleen raakatelemitikan perusteella jokaisella suorituskerralla. Yhtiö esittää tämän tarkkuuden ja laskennan säästönä, jotka ovat jatkuvassa järjestelmässä saman ongelman.
Microsoft sanoo, että malli on kalibroitu turvallisuuden ensisijaisella asenteella, arvioitu sen AI-punaisen tiimin kautta automaattisella ja asiantuntijajohtaisella vastustuskykytestillä ja tarkastettu ulkopuolisen arvioijan toimesta. MDASH-asiakkaat saavat vuokralaisen eristämisen, roolipohjaiset käyttöoikeudet, kirjaamisen ja hiekkalaatikon suorituskokoonpanot ilman internet-yhteyttä.
Mitä esikatselussa toimitetaan
Perception saapuu ensin Microsoft Defenderiin ja laajenee ympäri Microsoftin turvallisuutta myöhemmin. Hinnat perustuvat kulutukseen ja mitataan Turvallisuuslaskennan yksiköissä, jolloin agenttien raskaammat tehtävät vaativat enemmän niitä, joten skannauksen laajuus muuttuu budjettiriviksi eikä lisenssitasoksi. Microsoft piirtää selkeän rajan Perceptionin ja turvallisuuspilottinsa välille: toinen toimii, toinen avaa.
Ohjelmistovirheiden hallinta on ensimmäinen työnkulku, jonka MAI-Cyber-1-Flash käsittelee. Microsoft sanoo, että Perception ohjaa enemmän turvallisuustyönkulkuaan mallin kautta, kun esikatselu laajenee, jossa tekoälyohjattujen haavoittuvuuksien löytämisen taloudelliset seikat testataan todellisten asiakasomistusten kanssa eikä benchmark-tehtävien kanssa.












