Моделі та платформи ШІ

Cerebras представляє Qwen3‑235B: нова ера для швидкості, масштабу та вартості штучного інтелекту

mm
Додайте Unite.AI до бажаних джерел у Google

Cerebras Systems (CBRS ) офіційно представила Qwen3‑235B, революційну модель штучного інтелекту з повною підтримкою контексту 131 000 токенів, встановивши новий стандарт продуктивності в області розуміння, генерації коду та підприємств-орієнтованих застосунків штучного інтелекту. Тепер доступна через Cerebras Inference Cloud, модель пропонує можливості, які конкурують з найбільш просунутими системами передового фронту — при цьому вона працює в 30 разів швидше та коштує в 10 разів менше, ніж провідні закриті моделі.

Штучний інтелект у режимі реального часу досягає проривної швидкості

Штучний інтелект традиційно був повільним, великі моделі часто потребували хвилини або більше, щоб відповісти на складні запити. Cerebras усунула цю проблему. Завдяки своїй пропрієтарній Wafer-Scale Engine 3 (WSE‑3), Qwen3‑235B досягає 1 500 токенів за секунду, світовий рекорд для інференції штучного інтелекту передового фронту.

Цей рівень продуктивності трансформує досвід користувача — зменшує затримку з 60–120 секунд до всього 0,6 секунди, навіть при обробці складних завдань розуміння або виконання багатокрокових робочих процесів, таких як генерація з підтримкою пошуку (RAG). За результатами бенчмарків від Artificial Analysis, жоден інший постачальник — відкритий чи закритий — зараз не може конкурувати з цією швидкістю інференції для моделі передового фронту.

Новий стандарт контексту: 131 тис. токенів для реальних застосунків

Паралельно з цим випуском Cerebras розширила вікно контексту моделі з 32 тис. до повних 131 тис. токенів, підтримуваних Qwen3‑235B. Цей стрибок у розмірі контексту дозволяє моделі споживати та розуміти величезні об’єми даних — охоплюючи повні кодові бази, багатодокументні репозиторії та довгі технічні матеріали.

Хоча 32 тис. контексту дозволяють виконувати базові завдання генерації, 131 тис. відкривають двері до виробництва-орієнтованого розвитку. Штучний інтелект тепер може функціонувати як глибокий співробітник з кодом, синтезуючи десятки файлів та керуючи складними залежностями в режимі реального часу — роблячи його ідеальним для підприємств-орієнтованих випадків використання в інженерії програмного забезпечення, аналізі документів та наукових обчисленнях.

Чому Cerebras відрізняється: апаратне забезпечення, розроблене для штучного інтелекту з нуля

Заснована командою піонерів-комп’ютерних архітекторів, дослідників штучного інтелекту та системних інженерів, Cerebras Systems пішла радикально іншою дорогою для вирішення проблем масштабування генерації штучного інтелекту. Замість того, щоб покладатися на кластери GPU, Cerebras побудувала спеціальний суперкомп’ютер штучного інтелекту навколо власної мікросхеми: Wafer-Scale Engine 3.

Цей чип не схожий на жоден інший у галузі. Він має розмір кремнієвої пластини та містить сотні тисяч оптимізованих для ШІ ядер і десятки гігабайтів пам’яті безпосередньо на кристалі. Завдяки цьому обчислення й пам’ять розташовані поруч, що усуває затримки, обмеження пропускної здатності та складність координації, властиві традиційним рішенням із багатьма GPU.

Кластеризуючи свої системи CS-3, Cerebras може створювати суперкомп’ютери штучного інтелекту, здатні запускати моделі з трильйонами параметрів без зусиль, уникаючи технічного навантаження розподіленого обчислення. Такий уніфікований підхід є основою її рекордної швидкості інференції та можливістю нових висококонтекстних можливостей.

Ефектiveness MoE дозволяє суттєво знизити вартість

Qwen3‑235B побудована за допомогою моделі суміші експертів (MoE) — дизайну моделі, який активує лише підмножину внутрішніх експертів залежно від входу, що призводить до суттєвого покращення обчислювальної ефективності.

Через це Cerebras може пропонувати модель за ціною, яка суттєво нижча за альтернативи з закритим кодом. Зокрема, інференція доступна за 0,60 долара за мільйон входних токенів та 1,20 долара за мільйон вихідних токенів, що представляє понад 90-відсоткове зниження вартості порівняно з пропрієтарними моделями від OpenAI, Anthropic чи Google.

Безшовна інтеграція з Cline у VS Code

Щоб продемонструвати швидкість та реальні застосунки Qwen3‑235B, Cerebras співпрацює з Cline, провідним агентським кодуванням у Microsoft Visual Studio Code, який зараз встановлений понад 1,8 мільйонами розробників.

Користувачі Cline вже можуть отримати доступ до Qwen3‑32B з контекстом 64 тис. токенів у рамках безкоштовного тарифного плану. З сьогоднішнім оголошенням підтримка розшириться до Qwen3‑235B та повного контексту 131 тис. токенів, що дозволить рівень розуміння та генерації коду в редакторі, який раніше був недоступний у режимі реального часу.

Сауд Різван, генеральний директор Cline, пояснив: «З інференцією Cerebras розробники, які використовують Cline, бачать майбутнє, оскільки Cline розуміє проблеми, читає кодові бази та пише код майже в режимі реального часу. Все відбувається так швидко, що розробники залишаються у потоці, ітеруючи зі швидкістю думки. Така швидка інференція не просто приємна — вона показує нам, чого можна досягти, коли штучний інтелект справді тримає темп з розробниками».

Відкрита альтернатива закритим моделям

Продуктивність Qwen3‑235B на рівні з деякими з найбільш просунутими моделями штучного інтелекту на ринку сьогодні, включаючи Claude 4 Sonnet, Gemini 2.5 Flash та DeepSeek R1, як підтверджено незалежними бенчмарками. Однак Cerebras пропонує це у відкритому форматі, забезпечуючи прозорість та портативність, яких бракує закритим моделям.

Цей відкритий підхід до моделі дозволяє підприємствам:

  • Налаштовувати та дошколити на пропрієтарних даних
  • Розгортати штучний інтелект на приватній інфраструктурі або в гібридних хмарних середовищах
  • Уникати залежності від постачальників та ризиків конфіденційності даних

У поєднанні зі масштабованою хмарною платформою Cerebras та необов’язковим розгортанням систем CS-3 на місці, організації отримують повний контроль над тим, як штучний інтелект застосовується до критично важливих завдань.

Що це означає для галузі

Випуск Qwen3‑235B став поворотним моментом. Cerebras перевизначила межі можливого для великих мовних моделей, поєднавши передовий інтелект із безпрецедентною швидкістю та економічністю.

Тепер стало можливим створювати інструменти штучного інтелекту, які:

  • Відповідають у режимі реального часу на запити розробників
  • Розуміють повну документацію чи бази знань
  • Генерують та відладовують виробничий код безпосередньо в інтегрованому середовищі розробки
  • Масштабуються до підприємств-орієнтованих випадків використання без розширення GPU чи шестизначних місячних рахунків за інференцію

Поки зростає попит на інфраструктуру штучного інтелекту, Cerebras демонструє, що не потрібно компромісу між продуктивністю, ціною та відкритістю. Її апаратно-програмний ко-дизайн, від Wafer-Scale Engine до Cerebras Inference Cloud, вказує на нову модель розгортання штучного інтелекту — одну, яка є швидшою, простішою та значно більш доступною.

Остання думка

Відпустивши Qwen3‑235B з контекстом 131 тис. токенів, надшвидкою інференцією та доступною ціною токенів, Cerebras Systems позиціонує себе як одна з небагатьох справжніх конкурентів провідним постачальникам, орієнтованим на GPU. Для підприємств, дослідників та розробників цей випуск — це не просто швидша модель — це точка інфлексії, яка приносить штучний інтелект у режимі реального часу, виробничий рівень та відкритий доступ.

Антуан є видним лідером і засновником Unite.AI, який рухається незмінною пристрастю до формування та просування майбутнього штучного інтелекту та робототехніки. Як серійний підприємець, він вважає, що штучний інтелект буде таким же революційним для суспільства, як і електрика, і часто захоплюється потенціалом революційних технологій і штучного інтелекту загального призначення.

Як футуролог, він присвячений вивченню того, як ці інновації будуть формувати наш світ. Крім того, він є засновником Securities.io, платформи, орієнтованої на інвестиції в передові технології, які переінакшують майбутнє і змінюють цілі сектори.