Партнёрства
OpenAI сотрудничает с Cerebras за 10 миллиардов долларов для низко-задержечных вычислений

OpenAI объявила о многолетнем соглашении с стартапом Cerebras Systems (CBRS ), которое обеспечит 750 мегаватт вычислительной мощности для создателя ChatGPT, что, по мнению обеих компаний, является крупнейшим развертыванием высокоскоростных выводов, когда-либо предпринимаемым.
Сделка, оцененная в более чем 10 миллиардов долларов по данным источников, знакомых с условиями, является наиболее значительной ставкой OpenAI на инфраструктуру вне ее основной связи с Microsoft (MSFT ). Cerebras построит и разместит системы поэтапно до 2028 года, с первой мощностью, которая будет введена в эксплуатацию в этом году.
Партнерство направлено на решение конкретной проблемы: скорости. Хотя OpenAI масштабировала ChatGPT до 800 миллионов еженедельных пользователей, компания сталкивается с ограничениями вычислительной мощности, которые замедляют время ответа – особенно для требовательных рабочих нагрузок, таких как генерация кода, агентские задачи и взаимодействие с голосом в реальном времени.
“Cerebras добавляет к нашей платформе специализированное решение для низko-задержечных выводов”, – сказал Сачин Катти, который возглавляет вычислительную стратегию OpenAI. “Это означает более быстрые ответы, более естественные взаимодействия и более прочную основу для масштабирования реального времени ИИ для многих людей”.
Почему важен силикон в масштабе пластины
Предложение Cerebras сосредоточено на его процессорах в масштабе пластины – чипах размером с тарелку, которые устраняют задержки связи, присущие системам, сшитым из многих меньших GPU. Компания утверждает, что ее архитектура обеспечивает скорость вывода до 15 раз быстрее, чем альтернативы на основе GPU, с моделями, такими как GPT-OSS-120B, работающими со скоростью примерно 3000 токенов в секунду.
Для OpenAI эта скорость напрямую переводится в опыт пользователя. Когда ИИ реагирует в реальном времени – без задержки, которая делает разговоры искусственными – пользователи взаимодействуют более глубоко и достигают большего. Компания протестировала силикон Cerebras со своими открытыми моделями до Дня благодарения, и технические разговоры между командами быстро переросли в подписанный документ, согласно генеральному директору Cerebras Эндрю Фельдману.
“Как широкополосный интернет преобразовал интернет, так и вывод в реальном времени преобразует ИИ”, – сказал Фельдман. “Это позволяет создавать совершенно новые способы построения и взаимодействия с моделями ИИ”.
Сравнение не является преувеличением. Ранний интернет с модемом поддерживал электронную почту и базовое просмотр; широкополосный интернет позволил потоковое видео, голосовые звонки и в конечном итоге экономику приложений для смартфонов. OpenAI, кажется, делает ставку на то, что достаточно быстрый вывод разблокирует приложения, которые текущая задержка делает невозможными – особенно для агентов ИИ, которые должны объединять несколько операций без того, чтобы терпение человека истощилось.
Усиление инфраструктурной гонки вооружений
Сделка с Cerebras происходит на фоне взрыва оценок инфраструктуры ИИ, когда Databricks недавно привлекла 134 миллиарда долларов, а Cerebras herself, как сообщается, ведет переговоры о свежем финансировании с оценкой 22 миллиарда долларов. Вычислительные требования передовых моделей ИИ не показывают признаков плато, и компании спешат закрепить мощность до того, как это сделают конкуренты.
Для Cerebras партнерство с OpenAI решает проблему концентрации бизнеса. Объединенные Арабские Эмираты’ G42 составили 87% выручки Cerebras в первой половине 2024 года – концентрация клиентов, которая заставила инвесторов нервничать. Добавление OpenAI в качестве крупного клиента перед потенциальным IPO значительно снижает риски бизнеса.
Для OpenAI сделка диверсифицирует ее инфраструктуру ИИ за пределами облака Microsoft Azure. Хотя Microsoft остается основным поставщиком вычислительной мощности OpenAI, партнерство с Cerebras дает OpenAI специализированную низko-задержечную мощность, оптимизированную специально для вывода – другую рабочую нагрузку, чем те, которые инфраструктура Microsoft обрабатывает.
Тайминг также имеет значение. OpenAI недавно выпустила GPT-5.2 на фоне усиления конкуренции с Google’s Gemini. По мере того, как модели становятся более способными, компании, развертывающие их, обнаруживают, что сырая интеллект не достаточно – пользователям также ожидается практически мгновенный ответ. Гениальный ИИ, который отвечает за десять секунд, кажется сломанным; тот же ИИ, отвечающий менее чем за секунду, кажется магическим.
Сэм Альтман, генеральный директор OpenAI, уже является инвестором Cerebras, и OpenAI когда-то рассматривала возможность приобретения компании напрямую. Эта сделка предполагает, что отношения эволюционируют в нечто более стратегическое: партнерство, где судьбы обеих компаний становятся взаимосвязанными в гонке за создание ИИ, который действительно чувствуется как разговор.












