CyberbezpieczeÅstwo
Microsoft Umieszcza SwÃģj Pierwszy Model Cybernetyczny WewnÄ trz Projektu Perception

Microsoft (MSFT ) ogÅosiÅ Project Perception, system bezpieczeÅstwa oparty na agentach, ktÃģry uwalnia trzy klasy agentÃģw AI w Årodowisku klienta, wraz z MAI-Cyber-1-Flash, pierwszym modelem bezpieczeÅstwa opracowanym przez firmÄ. Publiczna wersja preview zostanie udostÄpniona 3 sierpnia 2026 r.
Argumentacja Microsoftu dotyczy ceny. Hayete Gallot, ktÃģry ponownie doÅÄ czyÅ do firmy jako wiceprezes ds. bezpieczeÅstwa w lutym 2026 r., przedstawiÅ argumentacjÄ dla nowego Cyber Stack: obrona musi dziaÅaÄ ciÄ gle, a ciÄ gÅa obrona musi byÄ przystÄpna cenowo. Wskazanie modelu frontier na kaÅžde zadanie bezpieczeÅstwa nie speÅnia tego wymogu, zwÅaszcza, Åže koszt znalezienia i wykorzystania luki bezpieczeÅstwa jest coraz niÅžszy.
MAI-Cyber-1-Flash jest odpowiedziÄ na ten ogranicznik. Model jest maÅy, zoptymalizowany pod kÄ tem kodu i wywodzi siÄ z linii Microsoftu MAI-Thinking-1. ZostaÅ umieszczony wewnÄ trz MDASH, oprzyrzÄ dowania ponad 100 agentÃģw, ktÃģrych Microsoft wykorzystuje do wyszukiwania i naprawiania luk w zabezpieczeniach oprogramowania, i zostaÅ zaprojektowany tak, aby pochÅonÄ Ä do 90% pracy, eskalujÄ c tylko najtrudniejsze zadania do modelu OpenAI GPT-5.4.
PoÅowa kosztu za ten sam wynik benchmarkowy
Microsoft podaje, Åže MDASH z MAI-Cyber-1-Flash i GPT-5.4 osiÄ ga wynik 96% w teÅcie CyberGym, co plasuje go 12 punktÃģw powyÅžej modelu Anthropic Mythos, a para ta dziaÅa przy przybliÅžonym poÅowie kosztÃģw konfiguracji, ktÃģrÄ Microsoft dostarcza obecnie.
Sam wynik nie jest zmianÄ . Na Build 2026, 2 czerwca 2026 r., Microsoft zgÅosiÅ wynik 96,55% dla MDASH jako oprzyrzÄ dowania, ktÃģre weszÅo w fazÄ rozszerzonej wersji preview. Trzy tygodnie wczeÅniej zgÅosiÅ wynik 88,45%, kiedy to ten sam system wykryÅ 16 luk w zabezpieczeniach w stosie sieciowym i uwierzytelnianiu systemu Windows, z czego cztery byÅy krytycznymi lukami umoÅžliwiajÄ cymi zdalne wykonanie kodu, ktÃģre Microsoft naprawiÅ w cyklu Åatek tego miesiÄ ca. Krzywa zdolnoÅci byÅa pÅaska od poczÄ tku czerwca. To, co siÄ zmieniÅo, to krzywa kosztÃģw.
To rozrÃģÅžnienie jest caÅy produkt. CyberGym to benchmark opracowany przez UC Berkeley, skÅadajÄ cy siÄ z 1507 realnych luk w zabezpieczeniach w 188 projektach open-source, pochodzÄ cych z korpusu OSS-Fuzz Google; agent otrzymuje kod i opis bÅÄdu, a nastÄpnie musi napisaÄ dane wejÅciowe, ktÃģre spowodujÄ awariÄ. Kiedy grupa Dawn Song opublikowaÅa go w czerwcu 2025 r., najsilniejsze pary agentÃģw i modeli, ktÃģre zmierzyli, uzyskaÅy wynik okoÅo 20%. ZapeÅnienie benchmarku w ciÄ gu trzynastu miesiÄcy rozstrzyga kwestiÄ zdolnoÅci. To, co pozostaje otwarte dla kupujÄ cych, to czy mogÄ uruchomiÄ tÄ zdolnoÅÄ wobec caÅej swojej infrastruktury, kaÅždego dnia, bez wzglÄdu na to, czy rachunek za tokeny zadecyduje o zakresie ich skanowania.
PorÃģwnanie z modelem Mythos niesie asymetriÄ wartÄ wymienienia: Anthropic wycofaÅ ten model z ogÃģlnej dystrybucji i dystrybuuje go do sprawdzonych partnerÃģw obronnych w ramach projektu Glasswing. Microsoft sprzedaje alternatywÄ jako coÅ, co przedsiÄbiorstwo moÅže po prostu kupiÄ. Nvidia (NVDA ) przedstawiÅ trzeci argument tego samego dnia, uruchamiajÄ c sojusz oparty na otwartych modelach defensywnych i udostÄpnianych narzÄdziach.
Czerwoni, niebiescy i zieloni agenci
Perception dzieli pracÄ na trzy role. Czerwoni agenci mapujÄ trasy, ktÃģrymi moÅže poruszaÄ siÄ atakujÄ cy. Niebiescy agenci pracujÄ nad wynikajÄ cymi sygnaÅami i decydujÄ , co stanowi prawdziste ryzyko. Zieloni agenci stosujÄ korekty i zabezpieczajÄ to, czego dotykajÄ . Wynik jest przekazywany miÄdzy nimi bez rÄcznego przekazania na kaÅždym etapie, podczas gdy Microsoft twierdzi, Åže dziaÅania o wysokim wpÅywie pozostajÄ pod kontrolÄ ludzi.
PoniÅžej agentÃģw znajduje siÄ warstwa, ktÃģra decyduje o tym, czy ekonomika siÄ opÅaca: wspÃģlny kontekst bezpieczeÅstwa. Microsoft utrzymuje ciÄ gle aktualizowany obraz aktywÃģw, toÅžsamoÅci, relacji i dziaÅaÅ organizacji, tak aby agenci zaczynali od tego obrazu zamiast odtwarzaÄ go z surowych danych telemetrycznych przy kaÅždym uruchomieniu. Firma traktuje to jako zysk dokÅadnoÅci i oszczÄdnoÅÄ obliczeniowÄ , co w systemie zawsze wÅÄ czonym jest tym samym problemem.
Microsoft twierdzi, Åže model zostaÅ skalibrowany z uwzglÄdnieniem bezpieczeÅstwa jako pierwszeÅstwa, oceniony przez zespÃģÅ AI Red Team za pomocÄ testÃģw adversarialnych automatycznych i prowadzonych przez ekspertÃģw, a takÅže przeanalizowany przez zewnÄtrznego oceniajÄ cego. Klienci MDASH otrzymujÄ izolacjÄ dzierÅžawcÃģw, kontrolÄ dostÄpu opartÄ na rolach, rejestrowanie inspekcji i Årodowiska wykonawcze z piaskownicÄ bez dostÄpu do Internetu.
Co jest dostÄpne w wersji preview
Perception pojawia siÄ najpierw w Microsoft Defender i rozszerza siÄ na resztÄ Microsoft Security w czasie. Cennik jest oparty na zuÅžyciu i jest mierzony w Security Compute Units, przy czym bardziej skomplikowane zadania agentÃģw wymagajÄ wiÄcej jednostek, wiÄc skanowanie staje siÄ liniÄ budÅžetowÄ , a nie poziomem licencjonowania. Microsoft rysuje wyraÅšnÄ granicÄ miÄdzy Perception a Security Copilot, swoim asystentem czatu: jeden dziaÅa, a drugi asystuje.
ZarzÄ dzanie lukami w zabezpieczeniach oprogramowania jest pierwszym procesem, ktÃģry obsÅuguje MAI-Cyber-1-Flash. Microsoft twierdzi, Åže Perception bÄdzie kierowaÅ wiÄcej swoich procesÃģw bezpieczeÅstwa przez model, gdy preview siÄ rozszerzy, co jest miejscem, w ktÃģrym ekonomika odkrywania luk w zabezpieczeniach przy uÅžyciu AI jest testowana wobec rzeczywistych majÄ tkÃģw klientÃģw, a nie zadaÅ benchmarkowych.












