Партнерства

OpenAI співпрацює з Cerebras за 10 мільярдів доларів для низьколатентного обчислення

mm
Додайте Unite.AI до бажаних джерел у Google

OpenAI оголосила про багаторічний договір з стартапом Cerebras Systems (CBRS ), який надасть 750 мегаватів专алізованого обчислення для ChatGPT, що описується як найбільша високошвидкісна інферентна розгортка, яку коли-небудь намагалися здійснити.

Договір, оцінений у понад 10 мільярдів доларів згідно з джерелами, знайомими з умовами, став найбільш значущою інфраструктурною ставкою OpenAI поза її основними відносинами з Microsoft (MSFT ). Cerebras побудує та розмістить системи у фазах до 2028 року, а перша потужність буде введена в дію цього року.

Партнерство спрямоване на вирішення конкретної проблеми: швидкості. Хоча OpenAI розширила ChatGPT до 800 мільйонів щотижневих користувачів, компанія стикається з обмеженнями обчислення, які сповільнюють час відповіді – особливо для вимогливих завдань, таких як генерація коду, агентські завдання та реальний голосовий діалог.

“Cerebras додає спеціалізоване низьколатентне інферентне рішення до нашої платформи”, – сказав Сачин Катті, який очолює стратегію обчислення OpenAI. “Це означає швидшу відповідь, більш природну взаємодію та сильнішу основу для масштабування реального часу AI для багатьох людей”.

Чому важлива кремнієва пластина великого розміру

ПITCH Cerebras центрується на його кремнієвих процесорах великого розміру – чіпах розміром з тарілки, які ліквідують затримки зв’язку, властиві системам, які складаються з багатьох малих GPU. Компанія стверджує, що її архітектура забезпечує швидкість інферентних висновків до 15 разів швидше, ніж альтернативи на основі GPU, з моделями типу GPT-OSS-120B, які працюють зі швидкістю близько 3000 токенів за секунду.

Для OpenAI ця швидкість безпосередньо перекладується на досвід користувача. Коли AI відповідає в реальному часі – без затримок, які роблять розмови штучними – користувачі взаємодіють глибше та досягають більшого. Компанія протестувала кремнієву пластину Cerebras з відкритими моделями перед Днем подяки, і технічні розмови між командами швидко перейшли до підписаного термінового листа, згідно з CEO Cerebras Ендрю Фельдманом.

“Як і широкосмуговий інтернет змінив інтернет, так і реальний час інферентних висновків змінить AI”, – сказав Фельдман. “Це дозволяє створити зовсім нові способи побудови та взаємодії з моделями AI”.

Відповідь не є перебільшенням. Ранній інтернет з вузькою смугою підтримував електронну пошту та базове просування; широкосмуговий інтернет дозволив потокове відео, голосові дзвінки та в підсумку економіку мобільних додатків. Здається, що OpenAI робить ставку на те, що достатньо швидка інферентна швидкість розблокує застосування, які поточна затримка робить недоцільними – особливо для агентів AI, які повинні ланцюжкові кілька операцій без втрати терпіння людини.

Інфраструктурна гонка озброєння посилюється

Договір з Cerebras відбувається в той час, коли оцінки інфраструктури AI вибухнули, а Databricks最近 піднявся до 134 мільярдів доларів, а Cerebras самої заяви про переговори про свіже фінансування за оцінкою 22 мільярди доларів. Обчислювальні вимоги моделей AI не показують жодних ознак сплеску, а компанії поспішно намагаються заблокувати потужність, перш ніж це зроблять конкуренти.

Для Cerebras партнерство з OpenAI вирішує проблему концентрації бізнесу. Об’єднані Арабські Емірати G42 становили 87% доходу Cerebras у першій половині 2024 року – концентрація клієнтів, яка зробила інвесторів нервовими. Додавання OpenAI як великого клієнта до потенційного IPO суттєво зменшує ризик бізнесу.

Для OpenAI договір диверсифікує її інфраструктуру AI за межі хмари Microsoft Azure. Хоча Microsoft залишається основним постачальником обчислення OpenAI, партнерство з Cerebras надає OpenAI спеціалізовану низьколатентну потужність, оптимізовану конкретно для інферентних висновків – іншого типу робочих процесів, ніж навчальні запуски, які обробляє інфраструктура Microsoft.

Час також має значення. OpenAI недавно випустила GPT-5.2 серед посилення конкуренції з боку Google Gemini. Як моделі стають більш потужними, компанії, які їх розгортають, виявляють, що сировина інтелекту недостатня – користувачі також очікують майже миттєвих відповідей. Геній AI, який відповідає за десять секунд, здається зламаним; той же AI, який відповідає менш ніж за одну секунду, здається

Сам Алтман, CEO OpenAI, вже є інвестором Cerebras, а OpenAI колись розглядала можливість придбання компанії в цілому. Цей договір свідчить про те, що відносини еволюціонують у щось більш стратегічне: партнерство, у якому долі обидвох компаній стають взаємозалежними в гонці за створення справжньої розмовної AI.

Алекс Макфарленд - журналіст та письменник з питань штучного інтелекту, який досліджує останні розробки в галузі штучного інтелекту. Він співпрацював з численними стартапами та виданнями з штучного інтелекту у світі.