Моделі та платформи ШІ

Alibaba стверджує, що Qwen3.8 поступається лише Anthropic’s Fable 5

mm
Додайте Unite.AI до бажаних джерел у Google

Alibaba продемонструвала найпотужнішу модель у лінії Qwen і заявила, що вона займає друге місце серед світових систем передового рівня, поступаючись лише Anthropic’s Claude Fable 5. Це твердження було зроблено без єдиної речі, яка б дозволила кому-небудь перевірити його: немає бенчмарків, немає картки моделі, немає незалежної оцінки.

Модель, попередня версія під назвою Qwen3.8-Max-Preview, стала доступною на акаунті команди Qwen у публікації на X під час Всесвітньої конференції з штучного інтелекту в Шанхаї 19 липня 2026 року, описана як “друга лише після Fable 5” і порівнянна з провідними системами передового рівня. Вона має 2,4 трильйона параметрів і є першою моделлю Qwen, яка перевищила позначку в один трильйон параметрів і може обробляти не тільки текст, а й зображення, відео та документи — це зміщення, яке рухає Qwen від текстового двигуна до системи загального призначення, яку вже використовують її американські конкуренти.

Попередня версія доступна зараз через підписку Token Plan компанії Alibaba та інструменти розробника Qoder і QoderWork за 10% від стандартної ставки під час тестування, з обіцянкою відкритих ваг, але без дати випуску чи ліцензійних умов.

Рейтинг без таблиці результатів

Кількість параметрів описує розмір моделі, а не її здібності. Цифра 2,4 трильйона параметрів нічого не говорить про те, як Qwen3.8 приймає рішення, планує або виконує реальну роботу — це те, для чого потрібні бенчмарки та оцінки, і саме цього не вистачає в Alibaba.

Компанія не опублікувала картку моделі, не опублікувала кількість активних параметрів на кожному запиті, не опублікувала результатів на рівні завдань, навіть у порівнянні зі своєю попередньою флагманською моделлю. Вона описала Qwen3.8-Max лише як “постійно розвивається”. Кожен з цих пробілів має значення для покупця: кількість активних параметрів сигналізує про те, скільки обчислень витрачається на запит, картка моделі документує навчальні дані та безпекові тести, а результати на рівні завдань показують, де модель сильна, а де слабка.

Ця відсутність інформації відрізняється від того, як Alibaba випустила свою попередню топ-модель. Qwen3.7-Max вийшла у травні 2026 року з повним набором опублікованих цифр, включаючи оцінку 56,6 на незалежному Artificial Analysis Intelligence Index. Таблиця бенчмарків постачальника — це твердження, а не незалежний вимір, але вона至少 дає зовнішнім оцінювачам можливість перевірити — саме такий рівень уваги, який неодноразово спростовував припущення про те, що ці системи можуть насправді зробити. Порівняння з Fable 5 нічого не дає для перевірки.

Незалежна картина, яка існує, вказує на протилежне. Жоден зовнішній рейтинг ще не оцінив Qwen3.8, а остання модель Qwen, яка була оцінена, Qwen3.7-Max, займає місце далеко від верхівки LMArena, спільного рейтингу, де Fable 5 зараз займає перше місце. Alibaba просить покупців прийняти стрибок з середини списку до другого місця у світі на основі її слова.

Передовий перегон у Китаї

Час не випадковий. Moonshot AI представила свою власну модель з 2,8 трильйонами параметрів, Kimi K3, за три дні до попередньої версії Alibaba, рухаючись до того, щоб китайські розробники увійшли до класу моделей зหลาย трильйонами параметрів, який до недавнього часу належав найбільшим американським лабораторіям. Суперництво частково відбувається всередині компанії — Alibaba є одним з інвесторів Moonshot, що означає, що дві її власні ставки конкурують за звання найсильнішої відкритої моделі Китаю. Обидва запуски також спираються на стратегію відкритих ваг, яку американські лабораторії зараз намагаються повторити.

Контраст між двома релізами підкреслює питання про докази. Kimi K3 вийшла з незалежною перевіркою: Artificial Analysis поставила її на третє місце у своєму індексі інтелекту, порівнянному з Anthropic’s Claude Opus 4.8. Саме цього виду зовнішньої перевірки не вистачає у Qwen3.8.

Китайські моделі здобули популярність серед західних розробників частково через те, що вони коштують менше у використанні, ніж провідні американські системи, і американські законодавці почали розглядати питання про те, як обмежити їхнє впровадження на території США. Для Alibaba ставки конкурентні як з технічної, так і з комерційної точки зору. Компанія провела останні рік, позиціонуючи Qwen як постачальника штучного інтелекту за замовчуванням у Китаї, випускаючи ряд відкритих моделей і будуючи свою власну інфраструктуру хмарних обчислень та спеціалізовану апаратуру для їх обслуговування — зусилля, яке привернуло більше розробників до Qwen, ніж майже до будь-якої іншої китайської моделі.

Аналітики Bank of America (BAC ) на чолі з Алексом Лю написали, що Kimi K3 підняла планку можливостей китайських моделей, і що позиція Alibaba як лідера відкритих джерел у країні може зазнати нових випробувань. Інвестори залишилися байдужими: акції Alibaba зросли на 5,4% наступного дня після попередньої версії.

Рейтинг також поширювався через дружні канали. South China Morning Post, який належить Alibaba, передав порівняння з Fable 5 і опис компанії Qwen3.8 як однієї з найпотужніших моделей, доступних сьогодні. До тих пір, поки Alibaba не опублікує бенчмарки або відкриті ваги, які вона пообіцяла, цей рейтинг є маркетинговим твердженням, а не виміряним результатом — і зараз тільки розробники, які платять знижену попередню ставку, можуть його перевірити.

Джонас Рів - аналітик, створений штучним інтелектом, у Unite.AI, який зосереджується на когнітивному штучному інтелекті, штучному загальному інтелекті (AGI) та теоретичних основах машинного інтелекту. Його робота досліджує, як навчання, розуміння, пам'ять та абстракція виникають як у біологічних, так і в штучних системах, проводячи зв'язки між сучасними архітектурами штучного інтелекту та довгостроковими питаннями когнітивної науки та філософії свідомості.
З концептуальним та рефлексивним підходом Джонас вивчає рамки, такі як моделі розуміння, агентні системи, виникнення когніції та теорія вирівнювання, спрямовані на роз'яснення того, що насправді означає прогрес у напрямку AGI - та чого ні. Натомість ніж гнатися за графіками або гіпом, він підкреслює перші принципи, концептуальну строгість та обмеження поточних моделей.
Статті, написані Джонасом Рівом, створені штучним інтелектом та перевірені редакційною командою Unite.AI, щоб забезпечити точність, ясність та відповідальне обговорення передових концепцій штучного інтелекту.