Модели и платформы ИИ
Alibaba запускает Qwen-Image-3.0 без бенчмарков или весов

Команда Qwen от Alibaba выпустила Qwen-Image-3.0 21 июля 2026 года, третое поколение своей модели генерации изображений, и построила объявление вокруг одной цели: сделать сгенерированные изображения практичными enough для использования в качестве рабочего инструмента, а не просто приятного для просмотра. Пост представляет собой галерею того, что может нарисовать система – плотные страницы газет, много панельные инфографики и академические статьи, полные математических обозначений. Что в нем не включено, так это бенчмарк-таблица, карта модели или технический отчет, чтобы подтвердить все это.
Это отсутствие является историей. Основные претензии Qwen-Image-3.0 основаны entirely на примерах изображений, которые компания выбрала для публикации, и предыдущие модели в той же серии установили более высокую планку для доказательств, чем эта.
Что модель утверждает, что она может делать
Команда Qwen организует выпуск вокруг трех возможностей. Первая – это обработка длинных, подробных подсказок: модель принимает инструкции длиной до 4 500 токенов, что, по словам компании, позволяет ей составлять информационно-насыщенные изображения в один проход. Ее центральным примером является трехкратная сетка из несвязанных инфографик – физическая диаграмма, доказательство теории групп, биологическое объяснение и шесть других – которые, по словам Alibaba, были произведены из одной инструкции длиной 3 700 токенов, а не собраны из отдельных изображений. Другим примером является вложение интерфейсов друг в друга, размещение редактора кода вокруг окна чата вокруг приложения для обмена сообщениями.
Вторым утверждением является мелкая деталь. Alibaba говорит, что модель отображает текст размером до 10 пикселей четко и воспроизводит текстуры, такие как кожа, волосы и бумага, близко к фотографическому качеству. В посте показана полная страница академической статьи с многострочными уравнениями и симулированная газетная страница, а также задачи редактирования, такие как добавление рукописных заметок и восстановление поврежденной традиционной картины.
Третьим является то, что компания называет знаниями о мире: родная отрисовка 12 языков, воспроизведение интерфейсов, таких как веб-страницы и прямые трансляции, и возможность извлекать данные из интернета в режиме реального времени. Одним из примеров является генерация графика прогноза погоды для конкретного города и даты, необычный шаг для генератора и тот, который стирает границу между моделью изображения и инструментом дизайна, основанным на данных. Alibaba позиционирует весь пакет на работу по производству контента – макеты газет, раскадровки коротких драм, макеты интерфейса и изображения электронной коммерции – тот вид медиа-вывода, где вопрос о раскрытии роли ИИ уже актуален. Каждая из этих возможностей, однако, показана через выводы, которые компания выбрала.
Что объявление оставляет без внимания
Пост не содержит бенчмарк-таблицы, количества параметров, лицензии и загружаемых весов, и нет технического отчета, описывающего, как модель была обучена или протестирована. Пользователям предлагается обратиться к Qwen Chat, чтобы попробовать.
Это отход от того, как серия была доставлена раньше. Qwen-Image 1.0 прибыл в августе 2025 года с открытыми весами под пермиссивной лицензией Apache 2.0 и техническим отчетом в день выпуска, и Qwen-Image-2.0 последовал за своим техническим отчетом. Предыдущая версия также заявила о своих пределах: она принимала подсказки длиной до примерно 1 000 токенов, что делает скачок до 4 500 самой конкретной цифрой в новом выпуске, и это цифра, которую ни одна внешняя сторона не подтвердила.
Пробел имеет значение больше для модели изображения, чем для текстовой. Качество изображения субъективно, и отрисовка текста именно то, где генераторы обычно выглядят сильными в демонстрационных примерах и слабее при систематическом тестировании. Без весов или набора оценки единственным доказательством, на которое может опереться разработчик, является собственный ролик выводов компании. Соперники показали, что дебют только для чата – это выбор, а не ограничение: Tencent выпустила HunyuanImage 3.0 как модель с открытыми весами, и Thinking Machines Lab недавно доставила Inkling, свою первую модель многомодального ИИ с открытыми весами, веса включены.
Где предыдущее поколение заняло место
Alibaba имеет недавний и необычно откровенный показатель того, где стоят ее модели изображений. В Qwen-Image-Bench, оценке текст-изображение, которую команда Qwen сама опубликовала, предыдущая флагманская модель, Qwen Image 2.0 Pro, заняла пятое место в общем зачете. OpenAI’s GPT Image 2 возглавила рейтинг, с моделями Google Nano Banana и OpenAI’s GPT Image 1.5, заполнившие верхние четыре места. Бенчмарк полагается на автоматическую модель судьи, которую его авторы говорят, что тесно отслеживает человеческих оценщиков, но он остается собственным тестом Alibaba, и он оценил предыдущее поколение, а не 3.0.
Этот контекст работает против прочтения новой модели как прыжка в передовые позиции. Пятое место в стартовой точке оставляет Qwen-Image-3.0 место, чтобы заявить о реальных достижениях, но запуск не предлагает измеримого способа подтвердить их. Сигналы, за которыми стоит следить, являются тем, будет ли Alibaba публиковать веса и карту модели, как она делала для каждого предыдущего выпуска Qwen-Image, и будут ли независимые оценки подтверждать утверждения о длинных подсказках и мелком тексте. До тех пор, пока одно из них не будет получено, можно сказать только то, что Qwen-Image-3.0 выглядит сильным в изображениях, которые его создатель выбрал показать.












