Partnerskaber
OpenAI samarbejder med Cerebras om 10 milliarder dollars i lav-forsinkelses-beregning

OpenAI har annonceret en flerårig aftale med chip-startup Cerebras Systems (CBRS ), der vil levere 750 megawatt dedikeret AI-beregning til ChatGPT-udvikleren, i hvad begge selskaber beskriver som den største højhastigheds-inferens-udbredelse nogensinde forsøgt.
Aftalen, der er vurderet til over 10 milliarder dollars ifølge kilder, der er bekendt med betingelserne, markerer OpenAI’s største infrastruktur-indsats uden for dens primære forhold til Microsoft (MSFT ). Cerebras vil bygge og hoste systemerne i faser frem til 2028, med den første kapacitet, der kommer online i år.
Partnerskabet retter sig mod et specifikt problem: hastighed. Mens OpenAI har skaleret ChatGPT til 800 millioner ugentlige brugere, står selskabet over for beregningsbegrænsninger, der langsomer svarstider – især for krævende arbejdsbelastninger som kodegenerering, agente-opgaver og realtids-lydinteraktion.
“Cerebras tilføjer en dedikeret lav-forsinkelses-inferensløsning til vores platform,” sagde Sachin Katti, der leder OpenAI’s beregningsstrategi. “Det betyder hurtigere svar, mere naturlige interaktioner og en stærkere grund til at skale realtids-AI til mange flere mennesker.”
Hvorfor Wafer-Scale Silicon er vigtigt
Cerebras’ pitch handler om deres wafer-scale-processorer – chippen på størrelse med middagsplatter, der eliminerer kommunikationsforsinkelsen, der er indbygget i systemer, der er syet sammen af mange mindre GPU’er. Selskabet hævder, at deres arkitektur leverer inferenshastigheder op til 15 gange hurtigere end GPU-baserede alternativer, med modeller som GPT-OSS-120B, der kører med cirka 3.000 tokens per sekund.
For OpenAI oversætter denne hastighed sig direkte til brugeroplevelsen. Når AI svarer i realtid – uden den forsinkelse, der gør samtalerne føles kunstige – engagerer brugerne sig dybere og opnår mere. Selskabet testede Cerebras’ silicium med deres åbne-vægt-modeller før Thanksgiving, og tekniske samtaler mellem holdene eskalerede hurtigt til en underskrevet kontrakt, ifølge Cerebras’ CEO Andrew Feldman.
“Lige som bredbånd forandrede internettet, vil realtids-inferens forandre AI,” sagde Feldman. “Dette muliggør helt nye måder at bygge og interagere med AI-modeller.”
Sammenligningen er ikke overdrivelse. Tidlig dial-up-internet understøttede e-mail og grundlæggende browsing; bredbånd muliggjorde streaming-video, stemmeopkald og til sidst smartphone-app-økonomien. OpenAI synes at satse på, at tilstrækkeligt hurtig inferens vil låse op for anvendelser, som nuværende forsinkelse gør urealistiske – især for AI-agenter, der skal kæde multiple operationer sammen uden, at menneskelig tålmodighed bliver tynd.
Infrastruktur-kapløbet intensiveres
Cerebras-aftalen kommer, da AI-infrastruktur-vurderinger er eksploderet, med Databricks, der nylig har hævet 134 milliarder dollars, og Cerebras selv rapporterer at være i samtaler om frisk finansiering til en vurdering på 22 milliarder dollars. De beregningsmæssige krav til grænse-AI-modeller viser ingen tegn på at flade ud, og selskaberne kapløber for at låse kapacitet, før konkurrenterne gør det.
For Cerebras løser OpenAI-partnerskabet et forretningskoncentrationsproblem. De Forenede Arabiske Emiraters G42 stod for 87% af Cerebras’ omsætning i første halvår af 2024 – en kunde-koncentration, der gjorde investorerne nervøse. Ved at tilføje OpenAI som en stor kunde før en mulig IPO reducerer det virksomhedens risiko betydeligt.
For OpenAI diversificerer aftalen deres AI-infrastruktur ud over Microsofts Azure-cloud. Mens Microsoft fortsat er OpenAI’s primære beregningsleverandør, giver Cerebras-partnerskabet OpenAI dedikeret lav-forsinkelses-kapacitet, der er optimeret specifikt til inferens – en anden arbejdsbyrde end den træning, som Microsofts infrastruktur håndterer.
Tidspunktet er også vigtigt. OpenAI har nylig udgivet GPT-5.2 midt i intensiveret konkurrence fra Google’s Gemini. Mens modellerne bliver mere avancerede, opdager de selskaber, der implementerer dem, at ren intelligens ikke er nok – brugerne forventer også næsten øjeblikkelige svar. En briliant AI, der tager ti sekunder at svare, føles defekt; samme AI, der svarer på under en sekund, føles
Sam Altman, OpenAI’s CEO, er allerede investor i Cerebras, og OpenAI overvejede engang at købe selskabet helt. Denne aftale antyder, at forholdet udvikler sig til noget mere strategisk: et partnerskab, hvor begge selskabers skæbner bliver sammenflettet i kapløbet om at gøre AI føles sandt konversationel.












