Modelli e piattaforme di IA
Google annuncia il modello di frontiera Gemini 4 Argon per la programmazione e la difesa informatica

Google ha annunciato Gemini 4 Argon il 30 settembre 2026, descrivendolo come il nuovo modello di frontiera dell’azienda per l’ingegneria del software nel mondo reale, il lavoro di conoscenza aziendale come legale e finanza, e la difesa della cybersicurezza. Il modello sarà distribuito inizialmente ai difensori informatici fidati tramite il Fairwind Program di Google, a un prezzo introduttivo di $2 per milione di token di input.
In un post su The Keyword, Koray Kavukcuoglu, SVP di Google DeepMind e Chief AI Architect di Google, ha affermato che rilasciare in sicurezza capacità di frontiera a questo livello richiede un approccio graduale. Google partecipa attivamente al processo volontario del governo degli Stati Uniti per l’accesso pre‑rilascio al modello, mentre espande progressivamente l’accesso, e ha dichiarato che continuerà a raccogliere feedback dai primi tester mentre perfeziona le salvaguardie.
Il prezzo introduttivo di Argon è di $2 per milione di token di input e $10 per milione di token di output, con i token di input memorizzati nella cache scontati del 95 % rispetto al prezzo dei token di input. Una nota a piè di pagina nell’annuncio indica che, al termine del periodo introduttivo, il prezzo sarà di $4 per milione di token di input e $20 per milione di token di output.
Distribuzione interna e limiti di output ampliati
Google ha dichiarato che Argon sta già alimentando i flussi di lavoro interni, con migliaia di dipendenti che evidenziano i punti di forza del modello in compiti di programmazione specializzata, nella conduzione di ricerche più approfondite e nella produzione di scritti di qualità. L’azienda ha segnalato diversi esempi di tale distribuzione. Argon sta aiutando i ricercatori di calcolo quantistico di Google a ottimizzare le risorse spazio‑tempo (qubit × porte) delle subroutine che costituiscono colli di bottiglia per applicazioni importanti; in un caso, ha superato la baseline pubblicata del 40 % in pochi minuti. Un team di agenti Argon ha analizzato la telemetria di profilazione a livello di intera flotta per identificare e applicare autonomamente ottimizzazioni della memoria nei data center di Google, liberando più di 300 TiB di memoria una volta implementate, con una stima di risparmi totali compresi tra 500 TiB e 1 PiB.
Google ha affermato che gli agenti Argon stanno anche migrando i codebase C/C++ verso Rust in tutta l’azienda, passando da decine di migliaia di righe in librerie di base come re2 e libgav1 a oltre 800 mila righe per il kernel Zircon di Fuchsia OS. Data la criticità di molti di questi sistemi, le riscritture su larga scala sono sottoposte a rigorosi audit automatizzati e manuali, test di emulazione e revisioni prima del rilascio in produzione.
Per libgav1, il software open source di Google per la decodifica video, gli agenti Argon hanno preso una porta Rust esistente e hanno sostituito 32 mila righe di codice SIMD eseguendo cicli di esperimenti guidati dal profilo e analizzando l’output del compilatore. Google ha dichiarato che il risultato è un decoder video sicuro a livello di memoria che funziona 2,7 volte più velocemente della porta Rust, con un output video identico.
Per supportare casi d’uso più lunghi e complessi, Google ha ampliato il limite di token di output del modello a 1 milione di token, rispetto ai precedenti 64 mila token, una cifra che l’azienda definisce leader nel settore.
Benchmark aziendali e difesa della cybersicurezza
Google riferisce che Argon stabilisce un nuovo stato dell’arte su DeepSWE v1.1 con un punteggio del 77,9 %, un benchmark che misura le prestazioni su compiti di ingegneria del software a lungo termine nel mondo reale. L’azienda descrive Argon come il modello leader nel Vals Index, che misura l’impatto economico nei settori finanza, programmazione, legale e fiscale, ponderando ogni settore in base al suo contributo al PIL degli Stati Uniti, e segnala prestazioni altrettanto leader su Vals Finance Agent v2 per la ricerca finanziaria a più fasi e sul Harvey’s Legal Agent Benchmark per la ricerca e la redazione legale.
Su AutomationBench, il benchmark di Zapier che misura l’esecuzione end‑to‑end delle funzioni aziendali principali, Google riferisce che Argon si posiziona al primo posto con un punteggio del 51,3 %. Su LVBench, che misura la comprensione di video lunghi, l’azienda segnala un punteggio all’avanguardia del 91,7 % e ha affermato che Argon può supportare l’analisi professionale di grafici, identificare dettagli da video lunghi e agire in base a una serie di documenti.
Google ha dichiarato di aver addestrato Argon a individuare, convalidare e correggere autonomamente vulnerabilità software critiche, e rilascerà il modello senza salvaguardie cyber a difensori fidati e ai propri team interni. Wiz utilizza già Argon tramite la sua iniziativa Scan for Good, un programma dedicato a proteggere gratuitamente le infrastrutture pubbliche critiche individuando e rimediando a esposizioni ad alto rischio. Google ha affermato che il modello ha scoperto una vulnerabilità critica che espone informazioni personali sensibili in software sanitari utilizzati da ospedali di tutto il mondo, identificando un rischio grave che i modelli di frontiera precedenti non avevano rilevato.
Su CWE‑bench v1, che valuta la capacità di un modello di rimediare vulnerabilità di sicurezza, Google riferisce che Argon è in parità al primo posto con un punteggio massimo del 68 %. L’azienda ha dichiarato che Argon ha inoltre scoperto esposizioni in codebase complesse che coprono 20 linguaggi di programmazione nel suo benchmark interno di vulnerabilità, e ha superato Gemini 3.8 Flash Cyber nel benchmark interno di test di penetrazione black‑box di Wiz, che verifica la capacità di un modello di analizzare sistemi web live senza codice sorgente.
The Fairwind Program, lanciato da Google il 2 settembre 2026, è un programma a accesso limitato per governi e partner fidati per utilizzare gli strumenti di difesa informatica dell’azienda. Le organizzazioni partecipanti accettano standard operativi che includono la limitazione dell’accesso ai dipendenti dei team di sicurezza informatica interna, risposta agli incidenti o test di penetrazione e l’implementazione di protezioni come l’autenticazione a più fattori. Google ha dichiarato che il programma conta più di 650 partner partecipanti a livello globale, e la sua prima offerta ha accoppiato Gemini 3.8 Flash Cyber con il CodeMender harness per aiutare i difensori a individuare, verificare e correggere le vulnerabilità.
Misure di Sicurezza di Frontiera e Rilascio Graduale
Google ha dichiarato di stare rafforzando le misure di sicurezza di frontiera in quattro ambiti prima della disponibilità generale di Argon. Per la difesa contro gli abusi, il modello è progettato per rifiutare richieste dannose di tipo cyber e chimico, biologico, radiologico e nucleare, preservando al contempo la legittima ricerca scientifica a duplice uso nell’ambito del Frontier Safety Framework di Google. L’azienda ha affermato di stare migliorando le proprie tecniche per monitorare le attivazioni interne del modello al fine di individuare abusi, e che le misure di sicurezza hanno subito test di robustezza da parte di team rossi interni ed esterni, utilizzando metodi di attacco manuali e automatizzati.
Google descrive Argon come il suo modello più resiliente finora contro l’iniezione indiretta di prompt, in cui istruzioni o contesti malevoli vengono usati per dirottare il comportamento del modello, e segnala una robustezza leader nel benchmark Indirect Prompt Injection di Gray Swan grazie al red teaming automatizzato e all’addestramento avversario.
L’azienda sta inoltre implementando mitigazioni di disallineamento che monitorano il ragionamento e le azioni di Argon e interrompono l’esecuzione quando necessario. Google ha dichiarato che un sistema simile ha monitorato le sue sessioni di addestramento e inviato avvisi a un team dedicato di risposta agli incidenti, con attente precauzioni per evitare di reinserire i risultati nell’addestramento. Infine, Google ha affermato di rafforzare i suoi ambienti sandbox isolandoli e sigillandoli prima dell’inizio di addestramenti o valutazioni ad alto rischio, in linea con la sua roadmap di controllo degli agenti.
Google ha dichiarato che il feedback del primo gruppo di difensori cyber e tester fidati aiuterà a rafforzare i suoi sistemi prima che Argon venga rilasciato a sviluppatori, imprese e consumatori, a partire dai clienti API a pagamento e dagli abbonati a Google AI Ultra, il prima possibile.












