Sicurezza informatica

Anthropic lancia Claude Mythos 5 negli strumenti di sicurezza, fondo open source da 35 milioni di dollari

mm
Aggiungi Unite.AI alle tue fonti preferite su Google

Anthropic ha dichiarato il 21 agosto 2026 che Claude Mythos 5, il modello con capacità cyber che ha limitato a difensori verificati sin da aprile 2026, ora esegue scansioni di vulnerabilità in Claude Security per i clienti Enterprise. Lo stesso annuncio espone i piani per integrare Mythos 5 nei prodotti dei partner di sicurezza, impegna 35 milioni di dollari in crediti a un nuovo fondo per la difesa open‑source e anticipa un ampliamento del Cyber Verification Program dell’azienda verso l’accesso di classe Mythos.

Le iniziative rappresentano la terza fase di un rollout che Anthropic ha deliberatamente tenuto lento. La motivazione, illustrata nell’annuncio, è che il pericolo si concentra dove un utente ha accesso diretto al modello e può tentare di indirizzarlo verso attività offensive. Quando gli utenti possono ricevere solo “output specifici, come una patch per una vulnerabilità o un avviso di sicurezza”, secondo Anthropic il rischio diminuisce notevolmente, così l’espansione amplia l’accesso a risultati difensivi mantenendo le salvaguardie intorno al modello stesso.

Quattro cambiamenti concreti compongono l’annuncio. I clienti Enterprise possono ora eseguire scansioni Claude Security su Mythos 5; Anthropic sta collaborando con partner tecnologici e di servizi di cybersecurity per integrare il modello negli strumenti che i difensori già utilizzano; il nuovo Defender Advantage Fund (0xDAF) distribuirà 35 milioni di dollari in crediti Claude a organizzazioni che proteggono software open‑source; e il Cyber Verification Program, che attualmente offre a organizzazioni verificate riduzioni delle salvaguardie sui modelli Claude Opus e Sonnet, si espanderà nelle prossime settimane per coprire capacità di doppio uso più ampie su tali modelli, con l’accesso di classe Mythos in seguito.

How Claude Security Delivers Mythos 5 Without Opening the Model

Claude Security è in beta pubblico per i clienti Claude Enterprise, e Anthropic afferma che le scansioni con Mythos 5 sono fatturate come utilizzo standard di token nei piani esistenti, senza alcun add‑on separato. Gli amministratori attivano la funzionalità nella console di amministrazione; da claude.ai/security, l’utente seleziona un repository e il modello analizza il codice alla ricerca di vulnerabilità. Ogni risultato restituisce una categoria CWE (Common Weakness Enumeration), valutazioni di fiducia e gravità, e una correzione suggerita. L’utente apre quindi Claude Code sul web per implementare la patch, e ogni patch deve essere revisionata e approvata da un umano prima di essere applicata.

Il punto cruciale è la delimitazione. La scansione Mythos 5 restituisce risultati dettagliati anziché output grezzi del modello, e l’esecuzione non estende l’accesso a Mythos su altre superfici: la correzione interattiva utilizza i modelli già presenti in Claude Code dell’organizzazione. Le integrazioni dei partner seguono lo stesso schema. Un utente finale di un prodotto partner non invoca mai direttamente Mythos 5; un’interfaccia dedicata esegue il modello in background per un compito definito e restituisce solo l’artefatto previsto, ad esempio un elenco di patch suggerite. Anthropic dichiara che lei e i suoi partner applicano misure di prevenzione degli abusi per mantenere il modello entro tale ambito, e i fornitori di prodotti di sicurezza possono registrare interesse nel programma di integrazione.

Il canale dei partner si basa su un ecosistema che Anthropic sta costruendo da maggio 2026, quando ha comunicato che aziende tra cui Wiz, Palo Alto Networks (PANW ), CrowdStrike (CRWD ) e Accenture avevano creato prodotti cyber su Claude Opus. I dati preliminari in quel post sono forniti dalle aziende stesse, non misurati in modo indipendente, ma descrivono la forma del mercato: Wiz ha dichiarato che il suo agente di test offensivo basato su Opus opera ininterrottamente su più di 150 000 asset di produzione a settimana, e Accenture ha affermato di aver portato la copertura dei test di sicurezza dal circa 10 % all’oltre 80 % su 1 600 applicazioni, riducendo i tempi di scansione da 3–5 giorni a meno di un’ora. Il capo della consulenza di CrowdStrike, Mark Manglicmot, la cui azienda vende un servizio di readiness basato su Opus, ha sintetizzato il caso del partner così: “I modelli di frontiera come Claude Opus di Anthropic stanno dando ai difensori un vantaggio di capacità che non esisteva un anno fa, spostando la gestione delle vulnerabilità completamente a sinistra.”

Palo Alto Networks ha recentemente coinvolto Anthropic, OpenAI e fornitori di controllo industriale per la difesa delle infrastrutture critiche, e fornitori come Harness hanno iniziato a distribuire agenti che scandiscono, triage e patchano le vulnerabilità a velocità di macchina.

From Project Glasswing to a Wider Defender Rollout

La prudenza di Anthropic con questa classe di modello risale al Project Glasswing, lanciato il 7 aprile 2026 con una coalizione che comprendeva Amazon Web Services, Microsoft, Google, CrowdStrike e la Linux Foundation. Il progetto ha messo Claude Mythos Preview nelle mani di un piccolo gruppo che protegge software critico, supportato da fino a 100 milioni di dollari in crediti di utilizzo e 4 milioni di dollari in donazioni dirette a organizzazioni di sicurezza open‑source. Anthropic ha dichiarato che Mythos Preview aveva già individuato migliaia di vulnerabilità ad alta gravità, incluse alcune in tutti i principali sistemi operativi e browser web: una falla attivabile da remoto in OpenBSD di 27 anni, un bug di 16 anni in una riga di FFmpeg che i test automatizzati avevano colpito cinque milioni di volte senza rilevarlo, e una catena di escalation di privilegi nel kernel Linux. Tutte e tre sono state segnalate ai manutentori e patchate prima della divulgazione. Il programma ha continuato ad aggiungere partecipanti durante l’estate, con società di sicurezza come Horizon3.ai che si è unita alla caccia alle vulnerabilità a luglio 2026.

Il 9 giugno 2026, Anthropic ha diviso il modello in due per il lancio di Fable 5 e Mythos 5. Claude Fable 5 è lo stesso modello di base con classificatori di sicurezza che indirizzano le richieste cyber, biologiche e di distillazione a Claude Opus 4.8; è stato rilasciato in disponibilità generale. Claude Mythos 5, con le salvaguardie cyber rimosse per gli utenti verificati, è stato offerto ai partner Glasswing a 10 dollari per milione di token di input e 50 dollari per milione di token di output, meno della metà del prezzo di Mythos Preview. Anthropic ha dichiarato che un bug bounty esterno non ha prodotto jailbreak universali in oltre 1 000 ore di test, e ha continuato a perfezionare i classificatori: all’inizio di agosto 2026 ha ri-tuned le salvaguardie biologiche di Fable 5, riducendo le query bloccate del 85 %. Il traffico sui modelli di classe Mythos è soggetto a una conservazione di 30 giorni, che Anthropic afferma serva a scopi di sicurezza e non a training.

Anthropic’s Cyber Defense Push by the Numbers

  • $35 million in Claude credits committed to the Defender Advantage Fund (0xDAF), for patching live vulnerabilities in widely used open-source projects, automating scanning and patching in ways other projects can replicate, and approaches that make projects resistant to whole classes of attack
  • $100 million in usage credits committed to Project Glasswing in aprile 2026, plus $4 million in direct donations: $2.5 million to Alpha-Omega and OpenSSF through the Linux Foundation, and $1.5 million to the Apache Software Foundation
  • $10 per million input tokens and $50 per million output tokens for Mythos 5, versus $25 and $125 for Mythos Preview
  • More than 40 additional organizations maintaining critical software infrastructure given access beyond Glasswing’s 12 launch partners
  • 83.1% versus 66.6%: Mythos Preview against Opus 4.6 on CyberGym vulnerability reproduction, as measured and reported by Anthropic itself

Il fondo estende il lavoro che Anthropic afferma Glasswing abbia già avviato, includendo il supporto a iniziative coordinate di correzione delle vulnerabilità come Akrites e l’iniziativa Gold Eagle della Casa Bianca Gold Eagle. Inizia con un numero limitato di sovvenzioni pilota più consistenti mentre Anthropic apprende cosa scala.

What Comes Next for Mythos-Class Access

I traguardi a breve termine sono tutti programmati. Anthropic dichiara che nelle prossime settimane il Cyber Verification Program si espanderà: capacità difensive come il triage e la validazione delle vulnerabilità passeranno ai modelli di classe Mythos, e i difensori iscritti vedranno ridotti i blocchi su Opus e Sonnet. Le organizzazioni già accettate non devono compiere alcuna azione; Anthropic le contatterà con aggiornamenti. I primi beneficiari del Defender Advantage Fund saranno annunciati nelle prossime settimane al completamento delle sovvenzioni pilota, e le integrazioni dei partner che portano Mythos 5 nei prodotti commerciali di sicurezza sono descritte come lavoro iniziale che l’azienda prevede di ampliare nel tempo. Parallelamente, Anthropic afferma di stare ampliando l’accesso a Mythos attraverso il Project Glasswing con partner governativi statunitensi, rivolto a operatori di infrastrutture critiche che soddisfano rigorosi requisiti di controllo della sicurezza.

Claude Security rimane in beta pubblico per i clienti Enterprise, con le scansioni Mythos 5 attive dal 21 agosto 2026 e fatturate come utilizzo standard di token nei piani esistenti.

Miles Okada è un analista generato da AI presso Unite.AI, che copre l'intelligenza artificiale e la sicurezza informatica con un focus su minacce emergenti, architetture difensive e dinamiche in evoluzione tra attaccanti e sistemi automatizzati. Il suo lavoro esamina come l'AI sta ridisegnando le operazioni di sicurezza, dalla rilevazione e risposta alle minacce autonome all'ascesa di tecniche di AI avversarie.
Con una prospettiva tecnica e investigativa, Miles analizza la ricerca sulla sicurezza, le dichiarazioni di incidenti e i dispiegamenti nel mondo reale per capire dove l'AI rafforza le difese e dove introduce nuove vulnerabilità. Presta particolare attenzione all'exploitazione del modello, all'avvelenamento dei dati, all'automazione degli attacchi e alle realtà operative di sicurezza dei sistemi alimentati da AI su larga scala.
Gli articoli scritti da Miles Okada sono generati da AI e revisionati dal team editoriale di Unite.AI per garantire accuratezza, rigore e copertura responsabile del paesaggio di sicurezza dell'AI in rapida evoluzione.