Opinione

Il governo ha appena dimostrato che il tuo modello Frontier è noleggiato

mm
Aggiungi Unite.AI alle tue fonti preferite su Google

Il 12 giugno 2026, una direttiva di controllo delle esportazioni è arrivata ad Anthropic e il modello più capace che la società ha mai spedito è stato spento. Fable 5 e Mythos 5 sono scomparsi, non ridotti, non geofence, scomparsi, per ogni cliente che ha.

L’ordine era più stretto del risultato. Citando le autorità di sicurezza nazionale, il governo ha detto ad Anthropic di interrompere l’accesso a entrambi i modelli per ogni nazionale straniero, all’interno o all’esterno degli Stati Uniti, fino ai propri dipendenti stranieri.

Anthropic afferma che l’effetto netto l’ha lasciata senza alcun modo per ottemperare a meno che non disabilitare i modelli per tutti, quindi è questo che ha fatto. Ogni altro modello Claude è rimasto acceso. Fable e Mythos sono scesi a zero.

Tre giorni prima, la società aveva lanciato Fable 5 come il modello più forte che aveva mai messo in mano pubblica, stato dell’arte su quasi ogni benchmark che ha pubblicato. Ho letto il lancio come il momento in cui l’AI di frontiera è diventata un’utility misurata che si attiva per token.

Mythos 5 è lo stesso modello sottostante con le salvaguardie di sicurezza sollevate, consegnato solo a difensori verificati. L’intera presentazione era la capacità di Mythos resa abbastanza sicura per la release generale. È durata circa 72 ore prima che il governo la rimuovesse dallo scaffale.

Un ritrovato stretto, uno strumento smussato

La lettera stessa, secondo il resoconto di Anthropic, non ha fornito alcun dettaglio specifico di sicurezza nazionale. La comprensione di Anthropic è che il governo ritiene che qualcuno abbia trovato un modo per aggirare le salvaguardie di Fable 5, abbia mostrato una dimostrazione agli funzionari e che sia stato sufficiente.

La società afferma di aver esaminato la tecnica e di aver scoperto che in realtà sono emerse un piccolo numero di vulnerabilità minori già note, il tipo di vulnerabilità che altri modelli pubblici presentano senza alcun aggiramento. L’exploit specifico che è stato mostrato consisteva nel chiedere al modello di leggere una base di codice e di correggere i difetti del software in essa.

Anthropic afferma che la stessa capacità è disponibile da altri modelli di frontiera, tra cui OpenAI’s GPT-5.5. Quindi il modello è stato ritirato per qualcosa che i suoi concorrenti ancora consegnano, sulla base dell’evidenza che la società afferma essere stata consegnata verbalmente.

Anthropic sta ottemperando e argomentando allo stesso tempo. La sua posizione è smussata: richiamare un modello distribuito a centinaia di milioni di persone per un’unica, non universale, jailbreak sarebbe, se applicato in generale, essenzialmente fermare tutti i nuovi deploy di modelli per ogni laboratorio di frontiera.

La società ha dichiarato pubblicamente che il governo dovrebbe essere in grado di bloccare i deploy genuinamente insicuri, ma attraverso un processo che sia trasparente, equo e fondato su fatti tecnici. Secondo loro, una lettera di venerdì sera con una motivazione verbale non è quel processo.

C’è uno sfondo che vale la pena di nominare con cura, perché la maggior parte di esso è un reporting non verificato piuttosto che qualcosa di registrato. Il grilletto è stato legato a un ritrovato di sicurezza che un importante fornitore cloud ha sollevato con gli funzionari, e alle preoccupazioni sull’accesso cinese che Anthropic afferma non siano state sollevate nelle conversazioni che ha avuto realmente. Trattare questo come la voce che attualmente è. I fatti registrati portano la storia da soli.

La parte che conta se si costruisce su questo

Rimuovere la politica e qui c’è cosa rimane a un operatore. L’unico strumento più capace disponibile è scomparso nel corso della notte, rimosso da una parte che non sei tu né il tuo fornitore, su una timeline che non avevi alcuna visibilità e in cui non avevi alcun voto.

Questo è il rischio silenzioso all’interno di ogni annuncio “Claude può fare X”, ed è quello con cui nessuno vuole sedersi la settimana di un lancio. La leva che si ottiene da un modello di frontiera è reale, e si tratta della stessa leva che qualcuno a monte tiene sul tuo accesso ad esso.

La reazione è stata abbastanza forte che la conversazione è saltata di scala, se i poteri medi dovrebbero costruire i propri modelli di frontiera piuttosto che dipendere da quelli di qualcun altro. Le nazioni stanno traggendo questa conclusione. Gli operatori dovrebbero trarre la versione più piccola di essa.

Quindi si costruisce come se il modello fosse noleggiato, perché lo è. Mantenere un fallback cablato e realmente testato, non una riga in un runbook che non hai mai eseguito. Non mettere il passaggio irreplaceabile della tua pipeline sul modello che può scomparire.

Possedere le parti che sono realmente tue: le tue promozioni, il tuo contesto, i tuoi dati, il sistema che orchestra tutto ciò, perché queste sono le parti che nessuna direttiva può spegnere.

L’ironia più forte è che Anthropic è entrata in questo in parte essendo il laboratorio più candido nella stanza. Ha detto ad alta voce che la resistenza al jailbreak perfetta non è possibile per nessuno, ha pubblicato quel limite e ha costruito la sua postura di difesa in profondità e la sua politica di conservazione dei dati di 30 giorni intorno al gestione del problema invece di fingere di allontanarlo.

La sincerità è diventata la traccia cartacea. Questa è la sua lezione su cosa viene premiato in questo momento. Ma per chiunque esegua lavori reali su questi modelli, il take away è più semplice.

Possedere la parte che è tua. Il motore era sempre noleggiato, e il proprietario ha appena cambiato le serrature.

Alex McFarland è un giornalista e scrittore di intelligenza artificiale che esplora gli ultimi sviluppi nel campo dell'intelligenza artificiale. Ha collaborato con numerose startup di intelligenza artificiale e pubblicazioni in tutto il mondo.