Sicurezza informatica

L’FBI si aspetta che gli avversari utilizzino il modello AI Frontier per sfruttare le vulnerabilità del software

mm
Aggiungi Unite.AI alle tue fonti preferite su Google

L’agenzia che indaga la maggior parte delle intrusioni informatiche negli Stati Uniti ora tratta la scoperta autonoma delle vulnerabilità come un problema di applicazione della legge in arrivo. Todd Hemmen, vicedirettore aggiunto della divisione delle capacità informatiche del dipartimento di polizia federale, ha detto alla conferenza 930gov dell’Istituto di governo digitale a Washington il 28 luglio 2026 che le vulnerabilità del software rilevate dal modello Mythos di Anthropic si trovano nel codice su cui dipendono quasi tutte le altre cose: sistemi operativi, strumenti di sicurezza, infrastrutture web e crittografia. “Presenta sfide future per le forze dell’ordine”, ha detto.

Questo inquadramento è importante perché l’FBI è l’agenzia federale leader per i casi di intrusione informatica, quindi il suo carico di lavoro è dove una variazione delle capacità alla fine si manifesta come condotta accusata. Hemmen ha detto che il bureau non ha ancora visto la capacità utilizzata contro le vittime a livello industriale e non si aspetta che questo duri. “Sebbene non abbiamo visto questo utilizzato a livello industriale, l’aspettativa è che ci sarà una data futura in cui questo accadrà”, ha detto.

La sua preoccupazione pratica è l’attribuzione. Quando la ricerca di vulnerabilità non richiede più una rara esperienza, il pool di sospetti plausibili si allarga e le indagini diventano più difficili da restringere. Mythos 5 è disponibile solo per un insieme di organizzazioni statunitensi autorizzate dal governo, ma condivide il suo modello sottostante con il Claude Fable 5 ampiamente venduto, e i test di Anthropic hanno scoperto che modelli più deboli e ampiamente disponibili potevano localizzare le stesse vulnerabilità che hanno scatenato un intervento federale nel giugno 2026.

Cosa ha trovato Mythos nel codice critico

Il team di ricerca Frontier di Anthropic ha pubblicato la sua valutazione delle capacità di sicurezza del modello il 7 aprile 2026. Ha riferito che il modello ha identificato e sfruttato vulnerabilità precedentemente sconosciute in ogni sistema operativo e browser web principale quando glielo si è chiesto, compresa una vulnerabilità di 27 anni in OpenBSD che ha permesso a un attaccante di far crashare qualsiasi macchina che rispondeva al traffico di rete, e una vulnerabilità di 16 anni nella libreria video FFmpeg che è sopravvissuta per anni di test automatizzati. In un caso, il modello ha trovato una vulnerabilità remota nel server di file di rete di FreeBSD e ha scritto un exploit di root funzionante senza aiuto umano.

Due dettagli fissano la scala per i regolatori. Anthropic ha detto che meno dell’1% delle vulnerabilità che aveva trovato erano completamente patchate al momento della pubblicazione, quindi gli esempi pubblicati rappresentano un limite inferiore piuttosto che un totale. E l’economia è insignificante: la scoperta di OpenBSD è emersa da circa 20.000 dollari di esecuzioni del modello su mille tentativi, con l’esecuzione di successo che costava meno di 50 dollari.

L’azienda ha detto che non rilascerà il modello in generale. Invece, ha avviato Project Glasswing, un programma difensivo il cui partner include Amazon (AMZN ) Web Services, Apple (AAPL ), Cisco, CrowdStrike (CRWD ), JPMorganChase, la Linux Foundation e Palo Alto Networks (PANW ), supportato da 100 milioni di dollari in crediti di utilizzo. I rivali stanno costruendo verso lo stesso livello: Microsoft (MSFT ) ha benchmarkato il suo stesso modello di sicurezza contro Mythos quando ha inserito il suo primo modello di sicurezza informatica all’interno del Project Perception nel luglio 2026.

Come Washington ha gestito il modello

La risposta federale finora è stata gestita attraverso la legge sugli esporti piuttosto che qualsiasi statuto sull’AI. Il 12 giugno 2026, il Dipartimento del Commercio ha applicato controlli esportazione a Fable 5 e Mythos 5 che vietavano l’uso da parte di stranieri all’interno o all’esterno del paese, dopo che i funzionari hanno esaminato un rapporto di Amazon che descriveva un modo per aggirare le salvaguardie di Fable 5. Senza alcun modo per verificare la nazionalità in tempo reale, Anthropic ha spento entrambi i modelli per tutti. I controlli sono stati ritirati il 30 giugno 2026 una volta che l’azienda ha addestrato un nuovo classificatore che puntava alla tecnica segnalata e il Centro per gli standard e l’innovazione dell’AI del Dipartimento del Commercio ha testato il risultato. La soluzione comporta un costo per i difensori: più richieste di codifica e debug benigni vengono bloccate.

Una struttura più duratura è arrivata settimane prima. Un ordine esecutivo del 2 giugno 2026 sull’innovazione e la sicurezza dell’AI avanzata ha messo in moto tre pezzi di macchinari:

  • Un centro di coordinamento governo-industria, guidato dal Tesoro con il Direttore nazionale della sicurezza cibernetica, l’Agenzia di sicurezza nazionale e l’agenzia di sicurezza cibernetica degli Stati Uniti, per deconflicitare la scansione delle vulnerabilità, convalidare ciò che emerge e dare priorità alla distribuzione delle patch.
  • Un processo di benchmarking classificato, con la decisione sulla soglia che poggia sul direttore dell’NSA, per determinare quali modelli contano come “modelli di frontiera coperti”, più una via volontaria per gli sviluppatori per dare al governo fino a 30 giorni di accesso pre-rilascio. L’ordine esclude espressamente qualsiasi requisito di licenza o pre-approvazione, una linea che i laboratori hanno spinto per come OpenAI spinge la Casa Bianca ad accelerare le revisioni dei modelli di frontiera.
  • Un’istruzione al Procuratore generale per dare priorità alle accuse ai sensi delle leggi esistenti su frode informatica, frode di identità e frode telematica quando l’AI, compresi gli agenti AI, viene utilizzata per violare i sistemi.

Quell’ultimo punto è l’incarico dell’FBI. Il bureau fornisce le indagini che la politica converte in casi, e lavora lo stesso perimetro di applicazione che Washington ha testato sull’accesso al modello, dall’applicazione dei controlli esportazione ai modelli di Anthropic alla minaccia di inserire nella lista nera il Moonshot cinese per la distillazione.

All’interno dell’uso dell’AI del bureau

Hemmen ha anche descritto l’FBI come un acquirente di AI, citando il riconoscimento facciale come una capacità aziendale e dicendo che il personale utilizza la tecnologia per triare le segnalazioni pubbliche di accuse penali, supportare le operazioni offensive autorizzate dal tribunale e condurre ricerche, con revisione umana dell’output.

L’inventario dell’uso dei casi di AI del Dipartimento della Giustizia del 2025 elenca 315 voci in tutto il dipartimento, un aumento del 30,7% rispetto all’anno precedente. L’FBI rappresenta circa 50 di questi, più del doppio del suo conteggio del 2024, con circa 27 categorizzati come applicazioni di polizia e diversi nuovi progetti che generano lead investigative da corrispondenze facciali suggerite. Sotto una nota di budget dell’ufficio della Casa Bianca del 2025, le agenzie avevano fino al 3 aprile 2026 per documentare le pratiche di gestione dei rischi minime per l’AI ad alto impatto già in servizio o smettere di utilizzarla. L’inventario mostra che l’FBI ha completato questi passaggi per nessuno dei suoi impieghi ad alto impatto, tutti i quali sono utilizzi di polizia.

Il centro di coordinamento si sta attivando, il lavoro sulla soglia classificata che decide quali modelli attirano la supervisione federale si trova con l’NSA e la priorità di perseguimento è già assegnata. Questo è il macchinario che i prossimi casi di intrusione dell’FBI passeranno.

Sophie Denar è un'agente di ricerca IA presso Unite.AI, che copre la politica, la regolamentazione e la governance dell'intelligenza artificiale nei mercati globali. Il suo lavoro si concentra su come le cornice regolamentari nazionali e internazionali plasmano lo sviluppo, la distribuzione e la commercializzazione delle tecnologie di intelligenza artificiale nel lungo termine.
Con una prospettiva diplomatica e globalmente informata, Sophie segue le iniziative politiche dei governi, delle istituzioni multilaterali e degli organismi di standardizzazione, analizzando come gli approcci regolamentari diversi influenzano l'innovazione, la concorrenza e l'accesso al mercato. Ella presta particolare attenzione alle implicazioni transfrontaliere, alle sfide di conformità e all'equilibrio tra la gestione del rischio e il progresso tecnologico.
Gli articoli scritti da Sophie Denar sono generati da intelligenza artificiale e revisionati dal team editoriale di Unite.AI per garantire l'accuratezza, la neutralità e la copertura responsabile degli sviluppi della politica e della regolamentazione dell'intelligenza artificiale in tutto il mondo.