Parteneriate

OpenAI apelează la Cerebras pentru 10 miliarde de dolari în computație de joasă latență

mm
Adaugă Unite.AI la sursele tale preferate pe Google

OpenAI a anunțat un acord pe termen lung cu startup-ul de cipuri Cerebras Systems (CBRS ), care va furniza 750 de megawați de computație dedicată AI pentru producătorul de ChatGPT, în ceea ce ambele companii descriu ca cea mai mare implementare de inferență de mare viteză încercată vreodată.

Acordul, evaluat la peste 10 miliarde de dolari conform surselor familiarizate cu termenii, marchează cea mai importantă investiție a OpenAI în infrastructură în afara relației sale principale cu Microsoft (MSFT ). Cerebras va construi și găzdui sistemele în etape până în 2028, prima capacitate urmând să devină disponibilă anul acesta.

Parteneriatul vizează o problemă specifică: viteza. În timp ce OpenAI a escaladat ChatGPT la 800 de milioane de utilizatori săptămânali, compania se confruntă cu constrângeri de computație care încetinesc timpul de răspuns – în special pentru sarcini solicitante, cum ar fi generarea de cod, sarcinile agenților și interacțiunea vocală în timp real.

“Cerebras adaugă o soluție de inferență de joasă latență dedicată platformei noastre”, a spus Sachin Katti, care conduce strategia de computație a OpenAI. “Acest lucru înseamnă răspunsuri mai rapide, interacțiuni mai naturale și o bază mai solidă pentru a scala inteligența artificială în timp real pentru mult mai mulți oameni.”

De ce contează siliciul la scară de wafer

Prezentarea Cerebras se concentrează pe procesoarele sale la scară de wafer – cipuri de dimensiunea farfurilor care elimină întârzierile de comunicare inerente în sistemele asamblate din multiple GPU-uri mai mici. Compania afirmă că arhitectura sa oferă viteze de inferență de până la 15 ori mai rapide decât alternativele bazate pe GPU, cu modele precum GPT-OSS-120B care rulează la aproximativ 3.000 de tokeni pe secundă.

Pentru OpenAI, acea viteză se traduce direct în experiența utilizatorului. Când inteligența artificială răspunde în timp real – fără întârzierile care fac conversațiile să pară artificiale – utilizatorii se implică mai profund și realizează mai mult. Compania a testat siliciul Cerebras cu modelele sale deschise înainte de Ziua Recunoștinței și conversațiile tehnice între echipe s-au escaladat rapid la un contract semnat, conform CEO-ului Cerebras, Andrew Feldman.

“La fel cum broadband-ul a transformat internetul, inferența în timp real va transforma inteligența artificială”, a spus Feldman. “Acest lucru permite modalități complet noi de a construi și interacționa cu modelele de inteligență artificială.”

Comparația nu este o exagerare. Internetul de dial-up timpuriu a susținut e-mailul și navigarea de bază; broadband-ul a permis streaming de video, apeluri vocale și, în cele din urmă, economia aplicațiilor pentru smartphone. OpenAI pare să parieze pe faptul că inferența suficient de rapidă va debloca, de asemenea, aplicații care sunt impracticabile din cauza latenței actuale – în special pentru agenții de inteligență artificială care trebuie să lanseze multiple operațiuni fără a epuiza răbdarea umană.

Cursele de armament din infrastructură se intensifică

Acordul Cerebras vine în timp ce evaluările infrastructurii de inteligență artificială au explodat, cu Databricks ridicând recent 134 de miliarde de dolari și Cerebras însuși fiind, se pare, în negocieri pentru o nouă finanțare la o evaluare de 22 de miliarde de dolari. Cererile de computație ale modelelor de inteligență artificială de frontieră nu arată nici un semn de platou, iar companiile se grăbesc să-și asigure capacitatea înainte ca concurenții să o facă.

Pentru Cerebras, parteneriatul cu OpenAI rezolvă o problemă de concentrare a afacerii. Emiratelor Arabe Unite G42 a reprezentat 87% din veniturile Cerebras în primul semestru al anului 2024 – o concentrare a clienților care i-a făcut pe investitori nervoși. Adăugarea OpenAI ca client major înainte de o posibilă IPO reduce semnificativ riscurile afacerii.

Pentru OpenAI, acordul diversifică infrastructura de inteligență artificială dincolo de relația sa principală cu cloud-ul Azure al Microsoft. În timp ce Microsoft rămâne principalul furnizor de computație al OpenAI, parteneriatul cu Cerebras oferă OpenAI o capacitate dedicată de joasă latență, optimizată în mod special pentru inferență – o sarcină de lucru diferită de cele de antrenament pe care infrastructura Microsoft le gestionează.

În timp ce OpenAI a lansat recent GPT-5.2 în mijlocul competiției intensificate cu Gemini de la Google. Pe măsură ce modelele devin mai capabile, companiile care le implementează descoperă că inteligența brută nu este suficientă – utilizatorii așteaptă, de asemenea, răspunsuri aproape instantanee. O inteligență artificială genială care necesită zece secunde pentru a răspunde pare defectă; aceeași inteligență artificială care răspunde în mai puțin de o secundă pare magicală.

Sam Altman, CEO-ul OpenAI, este deja investitor în Cerebras, iar OpenAI a considerat în trecut achiziționarea companiei în totalitate. Acest acord sugerează că relația evoluează într-un parteneriat mai strategic: un parteneriat în care soarta ambelor companii devine întrepătrunsă în cursa de a face inteligența artificială să pară cu adevărat conversațională.

Alex McFarland este un jurnalist și scriitor de inteligență artificială, care explorează cele mai recente dezvoltări în domeniul inteligenței artificiale. El a colaborat cu numeroase startup-uri de inteligență artificială și publicații din întreaga lume.