Κυβερνοασφάλεια
Η Microsoft Τοποθετεί το Πρώτο Κυβερνομοντέλο της Bênά το Project Perception

Η Microsoft (MSFT ) έχει ανακοινώσει Project Perception, ένα συστηματικό σύστημα ασφαλείας που απελευθερώνει τρεις τάξεις AI agents στο δικό σας περιβάλλον, μαζί με MAI-Cyber-1-Flash, το πρώτο μοντέλο ασφαλείας που η εταιρεία έχει εκπαιδεύσει στο εσωτερικό. Η δημόσια προεπισκόπηση ανοίγει στις 3 Αυγούστου 2026.
Η περίπτωση που η Microsoft κάνει είναι για το κόστος. Ο Hayete Gallot, ο οποίος ξαναεντάχθηκε στην εταιρεία ως εκτελεστικός αντιπρόεδρος ασφαλείας τον Φεβρουάριο του 2026, έθεσε το επιχείρημα για αυτό που η Microsoft ονομάζει ένα νέο Cyber Stack: η άμυνα πρέπει να εκτελείται συνεχώς, και η συνεχής άμυνα πρέπει να είναι προσιτή. Η στρέβλωση ενός μοντέλου μετώπης σε κάθε εργασία ασφαλείας δεν ξεπερνά αυτό το εμπόδιο, ιδιαίτερα既然 το κόστος για την εύρεση και την εκμετάλλευση ενός σφάλματος συνεχίζει να μειώνεται.
Το MAI-Cyber-1-Flash είναι η απάντηση σε αυτό το περιορισμό. Το μοντέλο είναι μικρό, ρυθμισμένο βαριά στο κώδικα, και προέρχεται από τη γραμμή MAI-Thinking-1 της Microsoft. Βρίσκεται Bênά το MDASH, το χαράκωμα περισσότερων από 100 agents που η Microsoft χρησιμοποιεί για να βρει και να διορθώσει τις ευπαθειές του λογισμικού, και έχει σχεδιαστεί για να απορροφήσει μέχρι και το 90% της εργασίας εκεί, αναβαθμίζοντας μόνο τις πιο δύσκολες εργασίες στο GPT-5.4 της OpenAI.
Μισό το κόστος για το ίδιο σκορ ελέγχου
Η Microsoft αναφέρει ότι το MDASH που εκτελεί το MAI-Cyber-1-Flash με το GPT-5.4 σκορ 96% στο CyberGym, το οποίο τοποθετεί 12 πόντους πάνω από το Mythos της Anthropic, και ότι η σύνδεση εκτελείται περίπου στο μισό κόστος της διαμόρφωσης που η Microsoft στέλνει σήμερα.
Το σκορ selbst δεν είναι η αλλαγή. Στις 2 Ιουνίου 2026, στη διάρκεια του Build 2026, η Microsoft ανέφερε 96.55% για το MDASH ως το χαράκωμα που εισήλθε στην επέκταση της προεπισκόπησης. Τρεις εβδομάδες νωρίτερα είχε ανέφερε 88.45%, όταν το ίδιο σύστημα ανέφερε 16 ευπαθειές στο Windows networking και authentication stack, τέσσερις από τις οποίες ήταν κρίσιμες απομακρυσμένες-εκτέλεσης-κώδικα-ευπαθειές, τις οποίες η Microsoft διόρθωσε στη μηνιαία κυκλοφορία της. Η καμπύλη ικανότητας έχει παραμείνει επίπεδη από τις αρχές Ιουνίου. Η καμπύλη κόστους είναι αυτό που μετακινήθηκε.
Αυτή η διάκριση είναι το σύνολο του προϊόντος. CyberGym είναι ένα UC Berkeley benchmark των 1.507 πραγματικών ευπαθειών σε 188 ανοιχτού κώδικα projects, που προέρχονται από το OSS-Fuzz corpus της Google. Ένας agent λαμβάνει ένα codebase και μια περιγραφή σφάλματος και πρέπει να γράψει μια είσοδο που αναπαράγει το σφάλμα. Όταν η ομάδα του Dawn Song δημοσίευσε αυτό τον Ιούνιο του 2025, οι ισχυρότεροι agent-και-μοντέλο ζευγάρια που μετρούσαν απελευθέρωσαν περίπου 20%. Η κορύφωση ενός βENCHMARK που είναι τόσο δύσκολο σε δεκατρείς μήνες καθορίζει το ερώτημα της ικανότητας. Αυτό που αφήνει ανοιχτό για τους αγοραστές είναι εάν μπορούν να εκτελέσουν αυτήν την ικανότητα ενάντια στο σύνολο του κτήματος τους, κάθε μέρα, χωρίς το κόστος των tokens να quyếtίζει το πεδίο της σάρωσης για αυτούς.
Η σύγκριση με το Mythos φέρει μια ασυμμετρία που αξίζει να ονομαστεί: η Anthropic απέκλεισε αυτό το μοντέλο από τη γενική κυκλοφορία και το διανέμει σε ελεγμένους αμυντικούς συνεργάτες μέσω του Project Glasswing. Η Microsoft πουλάει την εναλλακτική ως κάτι που μια επιχείρηση μπορεί απλά να αγοράσει. Η Nvidia (NVDA ) έκανε ένα τρίτο επιχείρημα την ίδια μέρα, εκκινώντας μια συμμαχία που βασίζεται σε ανοιχτά μοντέλα ασφαλείας και κοινή εργαλειοθήκη.
Κόκκινοι, μπλε και πράσινοι πράκτορες
Η Perception διαιρεί την εργασία σε τρεις ρόλους. Οι κόκκινοι πράκτορες χαρτογραφούν τις διαδρομές που ένας επιτιθέμενος θα μπορούσε να ακολουθήσει. Οι μπλε πράκτορες εργάζονται τις απερχόμενες σηματοδοτήσεις και αποφασίζουν τι αντιπροσωπεύει πραγματικό κίνδυνο. Οι πράσινοι πράκτορες εφαρμόζουν διορθώσεις και σκληραίνουν αυτά που αγγίζουν. Η έξοδος περνά μεταξύ τους χωρίς ανθρώπινη μεταβίβαση σε κάθε στάδιο, ενώ η Microsoft λέει ότι οι υψηλής επίδρασης ενέργειες παραμένουν υπό ανθρώπινη έγκριση.
Κάτω από τους πράκτορες βρίσκεται το στρώμα που καθορίζει εάν οι οικονομικές εργασίες λειτουργούν: ένα κοινό περιβάλλον ασφαλείας. Η Microsoft διατηρεί μια συνεχώς ενημερωμένη εικόνα των περιουσιακών στοιχείων, ταυτοτήτων, σχέσεων και δραστηριοτήτων μιας οργάνωσης, ώστε οι πράκτορες να αρχίζουν από αυτήν την χαρτογραφία αντί να την ξαναχτίζουν από την πρώτη τηλεμετρία σε κάθε εκτέλεση. Η εταιρεία το παρουσιάζει ως μια αύξηση ακρίβειας και μια εξοικονόμηση υπολογισμού, τα οποία σε ένα σύστημα που είναι πάντα ενεργό είναι το ίδιο πρόβλημα.
Η Microsoft λέει ότι το μοντέλο ήταν καλιμπραρισμένο με μια ασφαλή-πρώτη προκατάληψη, αξιολογημένο από την AI Red Team της μέσω αυτοματοποιημένων και ειδικών-ηγετικών αντι-εξετάσεων, και αναθεωρημένο από έναν εξωτερικό αξιολογητή. Οι πελάτες του MDASH λαμβάνουν απομόνωση μισθωτή, έλεγχους πρόσβασης με βάση τον ρόλο, καταγραφή ελέγχου και περιβάλλοντα εκτέλεσης σε sandbox χωρίς πρόσβαση στο διαδίκτυο.
Τι πλοηγείται στην προεπισκόπηση
Η Perception φτάνει Bênά το Microsoft Defender πρώτα και επεκτείνεται σε όλο το Microsoft Security με τον καιρό. Η τιμολόγηση είναι με βάση την κατανάλωση και μετράται σε Μονάδες Υπολογισμού Ασφαλείας, με πιο βαριές εργασίες agent να τραβούν περισσότερες από αυτές, ώστε το πλάτος σάρωσης να γίνει μια γραμμή προϋπολογισμού αντί για μια άδεια. Η Microsoft τραβάει μια σαφή γραμμή μεταξύ Perception και Security Copilot, του βοηθού-συνομιλίας της: το ένα ενεργεί, το άλλο βοηθά.
Η διαχείριση ευπαθειών λογισμικού είναι η πρώτη ροή εργασίας που το MAI-Cyber-1-Flash χειρίζεται. Η Microsoft λέει ότι η Perception θα οδηγήσει περισσότερες από τις ροές εργασιών ασφαλείας της μέσω του μοντέλου καθώς η προεπισκόπηση επεκτείνεται, το οποίο είναι το σημείο όπου οι οικονομικές της AI-κίνητης ανακάλυψης ευπαθειών δοκιμάζονται ενάντια σε πραγματικά κτήματα πελατών αντί για εργασίες ελέγχου.












