Modelli e piattaforme di IA

SpaceXAI Lancia Grok 4.6 per Agenti a Lungo Termine

mm
Aggiungi Unite.AI alle tue fonti preferite su Google

SpaceXAI, l’azienda di intelligenza artificiale precedentemente conosciuta come xAI, ha rilasciato Grok 4.6 il 12 agosto 2026, un nuovo modello flagship costruito per agenti a lungo termine e lavori interattivi e visivi più ambiziosi. Il modello è disponibile lo stesso giorno nell’editor di codice Cursor e nello strumento di costruzione Grok della società, nonché tramite la sua API, a un prezzo di partenza di 2 dollari per milione di token di input e 6 dollari per milione di token di output, secondo l’annuncio della società.

Grok 4.6 si basa su Grok 4.5 e amplia la spinta della società verso la codifica agente e il lavoro della conoscenza.

Cosa Fa Grok 4.6

La società descrive Grok 4.6 come un modello che “rimane con compiti complessi attraverso molti passaggi”, sia che si tratti di ricercare un argomento, lavorare su un codice o trasformare un’idea di prodotto in una versione funzionante di un’applicazione. Su traiettorie più lunghe, la società afferma di aver osservato più auto-test e verifica, con il modello che controlla il proprio lavoro prima di proseguire, e primi passi più forti su progetti visivi e interattivi rispetto a quelli visti con Grok 4.5.

I guadagni di capacità si basano su una corsia di addestramento supplementare più lunga rispetto a Grok 4.5. SpaceXAI ha utilizzato dati generati dal modello curati per ragionamento e concetti tecnici, un ottimizzatore migliorato e traiettorie SFT rigenerate da Grok 4.5 attraverso sforzi di ragionamento, harness di agente e domini, tra cui STEM, ingegneria del software e lavoro della conoscenza, con tracce problematiche filtrate tramite controlli basati sul modello. Il modello è stato quindi addestrato su una gamma di compiti di apprendimento per rinforzo agente, tra cui ambienti specifici del dominio per l’ottimizzazione del kernel, lo sviluppo web e la progettazione assistita da computer.

La Gara dei Benchmark

SpaceXAI riporta che Grok 4.6 corrisponde a OpenAI’s GPT-5.6 Sol sull’Artificial Analysis Intelligence Index, un composito di nove benchmark, con entrambi i modelli che segnano 61, dietro ad Anthropic’s Fable 5 Max a 62 e davanti a Grok 4.5 High a 56. La tabella di valutazione della società mostra un quadro più misto attraverso test individuali.

Sul benchmark DeepSWE v1.1 per l’ingegneria del software, Grok 4.6 ha segnato il 65,9%, in aumento rispetto al 54% di Grok 4.5 ma in ritardo rispetto a GPT-5.6 Sol Max al 73%. Su Terminal-Bench v3.0 ha raggiunto il 26%, un grande balzo rispetto al 15,7% di Grok 4.5 ma ben dietro al circa 34% segnato da GPT-5.6 Sol Max e Fable 5 Max. Ha guidato il campo su GDPVal-AA v2, una valutazione del lavoro della conoscenza, a 1753, e ha registrato guadagni su CursorBench e FrontierCode. I numeri sono quelli della società, con punteggi di modelli di terze parti tratti da risultati auto-segnalati o pubblicamente disponibili, e non è stata ancora effettuata una valutazione indipendente per confermarli.

Il lancio si inserisce in una parte affollata del mercato. Anthropic ha spinto la sua linea Opus verso l’intelligenza di frontiera a prezzi aggressivi, e la famiglia GPT-5.6 di OpenAI è il bersaglio consolidato per la codifica agente. La strategia di SpaceXAI è quella di competere su prezzo e distribuzione quanto su capacità grezza: a 2 dollari per milione di token di input, Grok 4.6 supera molti rivali di frontiera, e la società offre il doppio dell’uso incluso in Grok Build e Cursor per la prima settimana per attirare gli sviluppatori sul modello. Oltre a Cursor e Grok Build, è disponibile anche attraverso partner come OpenRouter, Vercel e Cloudflare.

Una Nuova Società dietro il Modello

Grok 4.6 è la dichiarazione di prodotto più chiara fino ad ora da parte di un’azienda che è stata completamente ristrutturata nell’ultimo anno.

Grok 4.6 è il primo modello flagship a portare il nome SpaceXAI fin dall’inizio, e il suo prezzo, la distribuzione dei partner e la focalizzazione agente mostrano la divisione che posiziona Grok come piattaforma per sviluppatori e imprese piuttosto che come funzionalità della rete sociale X.

Evan Mercer è un corrispondente generato da intelligenza artificiale presso Unite.AI, che copre startup di intelligenza artificiale, venture capital e la dinamica di finanziamento che plasma la prossima generazione di aziende tecnologiche. Le sue segnalazioni si concentrano sull'innovazione di primo stadio, sui flussi di capitale e sulle decisioni strategiche che i fondatori e gli investitori prendono mentre le aziende di intelligenza artificiale crescono da un concetto a un impatto globale.
Con una lente strategica e analitica, Evan esamina i round di finanziamento, la posizionamento sul mercato e le tendenze emergenti in tutto l'ecosistema delle startup di intelligenza artificiale. Egli segue come il venture capital, gli investimenti aziendali e i mercati pubblici si intersecano con i progressi nell'intelligenza artificiale, separando i segnali duraturi dall'ipotesi a breve termine.
Gli articoli scritti da Evan Mercer sono generati da intelligenza artificiale e revisionati dal team editoriale di Unite.AI per garantire accuratezza, contesto e copertura responsabile del paesaggio di investimento in intelligenza artificiale a livello globale