Модели и платформы ИИ
Cerebras представляет Qwen3‑235B: новая эра скорости, масштаба и стоимости ИИ

Cerebras Systems (CBRS ) официально запустила Qwen3‑235B, передовую модель ИИ с полной поддержкой контекста 131 000 токенов, устанавливающую новый стандарт производительности в области рассуждений, генерации кода и корпоративных приложений ИИ. Теперь доступна через Cerebras Inference Cloud, модель обеспечивает возможности, сопоставимые с самыми передовыми системами на рынке – при этом она работает в 30 раз быстрее и стоит в 10 раз дешевле, чем современные закрытые модели.
Реальное время рассуждений ИИ достигает прорывной скорости
Рассуждения ИИ исторически были медленными, с большими моделями, часто требующими минуты или более для ответа на сложные запросы. Cerebras устраняет эту проблему. Благодаря своей проприетарной Wafer-Scale Engine 3 (WSE‑3), Qwen3‑235B достигает 1500 токенов в секунду, мировой рекорд для вывода ИИ.
Такой уровень производительности преображает пользовательский опыт – сокращая задержку с 60-120 секунд до 0,6 секунды, даже при обработке сложных задач рассуждений или выполнении многоступенчатых рабочих процессов, таких как генерация с помощью извлечения (RAG). Согласно результатам бенчмарка от Artificial Analysis, в настоящее время ни один другой поставщик – открытый или закрытый – не может сравниться с этой скоростью вывода для модели уровня фронтира.
Новый стандарт контекста: 131K токенов для реальных приложений
Вместе с этим выпуском Cerebras расширила окно контекста модели с 32K до 131K токенов, поддерживаемых Qwen3‑235B. Этот скачок в размере контекста позволяет модели обрабатывать и рассуждать над огромными объемами данных – охватывая полные кодовые базы, многодокументные репозитории и длинные технические материалы.
Хотя контекст 32K позволяет выполнять базовые задачи генерации, 131K открывает дверь к производственной разработке. ИИ может теперь функционировать как глубокий сотрудник по коду, синтезируя десятки файлов и управляя сложными зависимостями в реальном времени – что делает его идеальным для корпоративных случаев использования в программной инженерии, анализе документов и научных вычислениях.
Почему Cerebras отличается: аппаратное обеспечение, разработанное для ИИ с нуля
Основанная командой пионеров компьютерной архитектуры, исследователей ИИ и системных инженеров, Cerebras Systems подошла к решению проблем масштабирования генеративного ИИ совершенно иначе. Вместо использования кластеров GPU Cerebras построила специальный суперкомпьютер ИИ вокруг своей собственной микросхемы: Wafer-Scale Engine 3.
Эта микросхема не имеет аналогов в отрасли. Она имеет размер тарелки и содержит сотни тысяч ядер ИИ с памятью на микросхеме, измеряемой десятками гигабайт. Такой дизайн позволяет объединить вычисления и память – устраняя задержку, ограничения пропускной способности и сложность оркестровки традиционных много-GPU-решений.
Кластеризуя свои CS-3 системы, Cerebras может создавать суперкомпьютеры ИИ, способные запускать модели с триллионами параметров без проблем – при этом избегая технической нагрузки распределенных вычислений. Такой унифицированный подход является основой ее рекордных скоростей вывода и нового высококонтекстного функционала.
Эффективность MoE обеспечивает драматическое снижение стоимости
Qwen3‑235B построена с использованием архитектуры микса экспертов (MoE) – модель дизайна, которая активирует только подмножество внутренних экспертов в зависимости от входных данных, что приводит к значительно улучшенной вычислительной эффективности.
Благодаря этому Cerebras может предложить модель по цене, которая значительно ниже, чем у закрытых аналогов. Конкретно, вывод доступен за 0,60 доллара за миллион входных токенов и 1,20 доллара за миллион выходных токенов, что представляет собой более чем 90-процентное снижение стоимости по сравнению с проприетарными моделями от OpenAI, Anthropic или Google.
Бесшовная интеграция с Cline в VS Code
Чтобы продемонстрировать скорость и реальное применение Qwen3‑235B, Cerebras сотрудничает с Cline, ведущим агентским инструментом кодирования внутри Microsoft Visual Studio Code, в настоящее время установленным более чем 1,8 миллионами разработчиков.
Пользователи Cline уже могут получить доступ к Qwen3‑32B с контекстом 64K в рамках бесплатного тарифного плана. С сегодняшним объявлением поддержка будет расширена для включения Qwen3‑235B и его полного контекста 131K, позволяя достичь уровня рассуждений и генерации кода в реальном времени, ранее недоступного.
Сауд Ризван, генеральный директор Cline, объяснил: “С выводом Cerebras разработчики, использующие Cline, получают взгляд в будущее, поскольку Cline рассуждает над проблемами, читает кодовые базы и пишет код почти в реальном времени. Все происходит так быстро, что разработчики остаются в потоке, итерируя с скоростью мысли. Такой быстрый вывод не просто приятен – он показывает нам, что возможно, когда ИИ действительно идёт в ногу с разработчиками.“
Открытая альтернатива закрытым моделям
Производительность Qwen3‑235B сопоставима с некоторыми из самых сложных моделей ИИ на рынке сегодня, включая Claude 4 Sonnet, Gemini 2.5 Flash и DeepSeek R1, как подтверждено независимыми бенчмарками. Однако Cerebras предлагает ее в открытом формате, предлагая прозрачность и портативность, которых не хватает закрытым моделям.
Такой открытый подход к модели дает возможность корпорациям:
- Настроить и донастроить на проприетарных данных
- Развернуть ИИ на частной инфраструктуре или в гибридных облачных средах
- Избежать привязки к поставщику и рисков, связанных с конфиденциальностью данных
В сочетании с масштабируемой облачной платформой Cerebras и возможностью развертывания систем CS-3 на месте, организации получают полный контроль над тем, как ИИ применяется к критически важным задачам.
Что это значит для отрасли
Запуск Qwen3‑235B знаменует собой поворотный момент. Cerebras переопределила границы того, что возможно с большими языковыми моделями, объединив интеллект фронтира с беспрецедентной скоростью и эффективностью стоимости.
Теперь возможно построить инструменты ИИ, которые:
- Отвечают в реальном времени на запросы разработчиков
- Рассуждают над полной документацией или базами знаний
- Генерируют и отлаживают производственный код в реальном времени внутри IDE
- Масштабируются до корпоративных случаев использования без распыления GPU или шестизначных ежемесячных счетов за вывод
По мере роста спроса на инфраструктуру ИИ Cerebras демонстрирует, что не нужно идти на компромисс между производительностью, ценой и открытостью. Ее аппаратно-программное сочетание, от Wafer-Scale Engine до Cerebras Inference Cloud, указывает на новую модель развертывания ИИ – быструю, простую и намного более доступную.
Окончательные мысли
Выпустив Qwen3‑235B с контекстом 131K, сверхбыстрым выводом и доступной стоимостью токенов, Cerebras Systems позиционирует себя как одного из немногих настоящих конкурентов GPU-ориентированным лидерам. Для корпораций, исследователей и разработчиков этот запуск – это не просто более быстрая модель – это поворотный момент, который приносит реальный, готовый к производственному использованию ИИ с открытым исходным кодом в пределах досягаемости.












