Partnerstwa

OpenAI korzysta z Cerebras za 10 miliardów dolarów w niskiej latencji obliczeń

mm
Dodaj Unite.AI do preferowanych źródeł w Google

OpenAI ogłosiła wieloletnie porozumienie z startupem Cerebras Systems (CBRS ), które dostarczy 750 megawatów dedykowanych obliczeń AI do twórcy ChatGPT, co obie firmy opisują jako największe wdrożenie wysokich inferencji, jakie kiedykolwiek próbowano.

Umowa, wartą ponad 10 miliardów dolarów według osób zaznajomionych z warunkami, stanowi największą inwestycję infrastrukturalną OpenAI poza jej podstawową relacją z Microsoftem. Cerebras wybuduje i będzie hostować systemy w fazach do 2028 roku, z pierwszą pojemnością, która zostanie uruchomiona w tym roku.

Partnerstwo dotyczy konkretnego problemu: prędkości. Podczas gdy OpenAI skaluje ChatGPT do 800 milionów tygodniowych użytkowników, firma stoi w obliczu ograniczeń obliczeniowych, które spowalniają czasy odpowiedzi – szczególnie dla wymagających obciążeń, takich jak generowanie kodu, zadania agentywne i interakcje głosowe w czasie rzeczywistym.

“Cerebras dodaje dedykowane niskiej latencji rozwiązanie inferencyjne do naszej platformy”, powiedział Sachin Katti, który kieruje strategią obliczeniową OpenAI. “To oznacza szybsze odpowiedzi, bardziej naturalne interakcje i silniejszą podstawę do skalowania AI w czasie rzeczywistym dla wielu więcej ludzi.”

Dlaczego wafer-scale krzem jest ważny

Pitch Cerebras koncentruje się na jego procesorach wafer-scale – chipach o rozmiarze talerza, które eliminują opóźnienia komunikacyjne właściwe dla systemów zszytych z wielu mniejszych GPU. Firma twierdzi, że jej architektura dostarcza prędkości inferencji do 15 razy szybsze niż alternatywy oparte na GPU, z modelami takimi jak GPT-OSS-120B, które działają przy około 3000 tokenach na sekundę.

Dla OpenAI ta prędkość przekłada się bezpośrednio na doświadczenie użytkownika. Kiedy AI odpowiada w czasie rzeczywistym – bez opóźnień, które sprawiają, że rozmowy wydają się sztuczne – użytkownicy angażują się głębiej i osiągają więcej. Firma przetestowała krzem Cerebras z otwartymi modelami wag przed Świętem Dziękczynienia, a techniczne rozmowy między zespołami szybko eskalowały do podpisania umowy, według CEO Cerebras Andrew Feldman.

“Tak jak szybki internet przekształcił internet, inferencja w czasie rzeczywistym przekształci AI”, powiedział Feldman. “To umożliwia całkowicie nowe sposoby budowania i interakcji z modelami AI.”

Porównanie nie jest przesadzone. Wczesny internet dial-up wspierał pocztę e-mail i podstawowe przeglądanie; szybki internet umożliwił strumieniowe wideo, połączenia głosowe i ostatecznie gospodarkę aplikacji na smartfonach. OpenAI wydaje się obstawiać, że wystarczająco szybka inferencja odblokuję aplikacje, które obecna latencja czyni niepraktycznymi – szczególnie dla agentów AI, które muszą łączyć wiele operacji bez cierpliwości ludzi.

Wyścig zbrojeń w infrastrukturze nasila się

Umowa Cerebras następuje, gdy wyceny infrastruktury AI wybuchły, z Databricks, które ostatnio podniosły 134 miliardy dolarów, a Cerebras samemu donoszącemu o rozmowach na temat świeżego finansowania przy wycenie 22 miliardów dolarów. Wymagania obliczeniowe modeli AI nie pokazują żadnych oznak spowolnienia, a firmy walczą o to, by zablokować pojemność przed konkurentami.

Dla Cerebras partnerstwo z OpenAI rozwiązuje problem koncentracji biznesu. Zjednoczone Emiraty Arabskie G42 stanowiły 87% przychodu Cerebras w pierwszej połowie 2024 roku – koncentracja klienta, która sprawiła, że inwestorzy stali się nerwowi. Dodanie OpenAI jako głównego klienta przed potencjalnym IPO znacznie redukuje ryzyko biznesu.

Dla OpenAI umowa dywersyfikuje infrastrukturę AI poza chmurą Microsoft Azure. Podczas gdy Microsoft pozostaje podstawowym dostawcą obliczeń OpenAI, partnerstwo z Cerebras daje OpenAI dedykowaną niskiej latencji pojemność zoptymalizowaną specjalnie dla inferencji – innego obciążenia niż te, które obsługuje infrastruktura Microsoftu.

Czas także ma znaczenie. OpenAI niedawno wydała GPT-5.2 wśród nasilającej się konkurencji ze strony Google Gemini. Podczas gdy modele stają się coraz bardziej zaawansowane, firmy wdrażające je odkrywają, że surowa inteligencja nie jest wystarczająca – użytkownicy oczekują również odpowiedzi niemal natychmiastowych. Genialny AI, który odpowiada w ciągu dziesięciu sekund, wydaje się złamany; ten sam AI, który odpowiada w ciągu jednej sekundy, wydaje się

Sam Altman, CEO OpenAI, jest już inwestorem w Cerebras, a OpenAI kiedyś rozważała przejęcie firmy w całości. Umowa sugeruje, że relacja ewoluuje w coś bardziej strategicznego: partnerstwo, w którym losy obu firm stają się splecione w wyścigu, by uczynić AI prawdziwie konwersacyjnym.

Alex McFarland jest dziennikarzem i pisarzem zajmującym się sztuczną inteligencją, który bada najnowsze rozwoje w dziedzinie sztucznej inteligencji. Współpracował z licznymi startupami i wydawnictwami związanymi z sztuczną inteligencją na całym świecie.