Partnership

OpenAI Sceglie Cerebras per 10 Miliardi di Dollari in Calcolo a Basso Ritardo

mm
Aggiungi Unite.AI alle tue fonti preferite su Google

OpenAI ha annunciato un accordo pluriennale con la startup di chip Cerebras Systems (CBRS ) che fornirà 750 megawatt di calcolo AI dedicato al produttore di ChatGPT, in quello che entrambe le aziende descrivono come il più grande dispiegamento di inferenza ad alta velocità mai tentato.

L’accordo, valutato oltre 10 miliardi di dollari secondo fonti familiari con i termini, segna la scommessa infrastrutturale più significativa di OpenAI al di fuori della sua relazione primaria con Microsoft (MSFT ). Cerebras costruirà e ospiterà i sistemi in fasi fino al 2028, con la prima capacità che sarà online quest’anno.

La partnership si concentra su un problema specifico: la velocità. Mentre OpenAI ha scalato ChatGPT a 800 milioni di utenti settimanali, l’azienda affronta vincoli di calcolo che rallentano i tempi di risposta – in particolare per carichi di lavoro impegnativi come la generazione di codice, i compiti agentic e l’interazione vocale in tempo reale.

“Cerebras aggiunge una soluzione di inferenza a basso ritardo dedicata alla nostra piattaforma”, ha detto Sachin Katti, che guida la strategia di calcolo di OpenAI. “Ciò significa risposte più veloci, interazioni più naturali e una base più solida per scalare l’AI in tempo reale a molte più persone.”

Perché il Silicio a Scala di Wafer è Importante

La proposta di Cerebras si concentra sui suoi processori a scala di wafer – chip delle dimensioni di un piatto da cena che eliminano i ritardi di comunicazione intrinseci ai sistemi cuciti insieme da molti piccoli GPU. L’azienda afferma che la sua architettura fornisce velocità di inferenza fino a 15 volte più veloci rispetto alle alternative basate su GPU, con modelli come GPT-OSS-120B che girano a circa 3.000 token al secondo.

Per OpenAI, quella velocità si traduce direttamente nell’esperienza dell’utente. Quando l’AI risponde in tempo reale – senza la latenza che fa sembrare le conversazioni artificiali – gli utenti si impegnano più profondamente e realizzano di più. L’azienda ha testato il silicio di Cerebras con i suoi modelli open-weight prima del Ringraziamento, e le conversazioni tecniche tra i team si sono rapidamente intensificate fino a un foglio di termini firmato, secondo il CEO di Cerebras Andrew Feldman.

“Proprio come la banda larga ha trasformato internet, l’inferenza in tempo reale trasformerà l’AI”, ha detto Feldman. “Ciò consente modi completamente nuovi per costruire e interagire con i modelli di AI.”

Il paragone non è un’esagerazione. Internet a banda larga ha supportato email e navigazione di base; la banda larga ha abilitato lo streaming video, le chiamate vocali e alla fine l’economia delle app per smartphone. OpenAI sembra scommettere che un’inferenza sufficientemente veloce sbloccherà applicazioni che la latenza attuale rende impraticabili – in particolare per gli agenti di AI che devono concatenare più operazioni senza che la pazienza umana si assottigli.

La Corsa agli Armamenti dell’Infrastruttura si Intensifica

L’accordo Cerebras arriva mentre le valutazioni dell’infrastruttura di AI sono esplose, con Databricks che ha recentemente raccolto 134 miliardi di dollari e Cerebras stesso che è presumibilmente in trattative per un nuovo finanziamento a una valutazione di 22 miliardi di dollari. Le richieste di calcolo dei modelli di AI di frontiera non mostrano segni di plateau, e le aziende stanno lottando per bloccare la capacità prima che i concorrenti lo facciano.

Per Cerebras, la partnership OpenAI risolve un problema di concentrazione aziendale. Gli Emirati Arabi Uniti di G42 rappresentavano l’87% del ricavo di Cerebras nel primo semestre del 2024 – una concentrazione di clienti che ha reso nervosi gli investitori. Aggiungere OpenAI come cliente importante prima di un possibile IPO riduce significativamente i rischi aziendali.

Per OpenAI, l’accordo diversifica la sua infrastruttura di AI al di là della piattaforma cloud di Microsoft. Mentre Microsoft rimane il principale fornitore di calcolo di OpenAI, la partnership Cerebras fornisce a OpenAI una capacità di inferenza a basso ritardo dedicata e ottimizzata specificamente per l’inferenza – un carico di lavoro diverso dalle esecuzioni di formazione che l’infrastruttura di Microsoft gestisce.

Il timing è anche importante. OpenAI ha recentemente rilasciato GPT-5.2 tra una crescente concorrenza da parte di Google’s Gemini. Mentre i modelli diventano più capaci, le aziende che li distribuiscono stanno scoprendo che l’intelligenza grezza non è sufficiente – gli utenti si aspettano anche risposte quasi istantanee. Un’AI brillante che impiega dieci secondi per rispondere sembra rotta; la stessa AI che risponde in meno di un secondo sembra

Sam Altman, CEO di OpenAI, è già un investitore in Cerebras, e OpenAI ha una volta considerato l’acquisto dell’azienda tout court. Questo accordo suggerisce che la relazione si sta evolvendo in qualcosa di più strategico: una partnership in cui le sorti di entrambe le aziende diventano intrecciate nella corsa per rendere l’AI veramente conversazionale.

Alex McFarland è un giornalista e scrittore di intelligenza artificiale che esplora gli ultimi sviluppi nel campo dell'intelligenza artificiale. Ha collaborato con numerose startup di intelligenza artificiale e pubblicazioni in tutto il mondo.