Модели и платформы ИИ
Новая флагманская модель Xiaomi возглавляет рейтинг открытых весов с результатом 46

22 сентября 2026 года Xiaomi объявила о выпуске и открытом исходном коде MiMo-V2.6 series, возглавляемой флагманской моделью, которой владелец бенчмарка Artificial Analysis присвоил 46 баллов в индексе Intelligence Index — лучший результат среди открытых моделей в этом рейтинге.
Серия включает две изначально омнимодальные модели: MiMo-V2.6-Pro, которую Xiaomi описывает как свою самую мощную модель на сегодняшний день, и MiMo-V2.6-Flash, которую компания характеризует как находящую баланс между интеллектом, эффективностью и стоимостью. Третий вариант, MiMo-V2.6-Pro-UltraSpeed, обеспечивает до 20‑кратное ускорение вывода при той же качестве для пользователей, которым требуется экстремальная скорость генерации, согласно Xiaomi.
Позиция в бенчмарке Artificial Analysis
Artificial Analysis’ страница модели для MiMo-V2.6-Pro фиксирует 46 баллов в Intelligence Index v4.3.2, составном индексе из 10 оценок, включающих AA‑Briefcase v1.1, GDPval‑AA v2.1, AutomationBench‑AA, Terminal‑Bench 4.0, SciCode и Humanity’s Last Exam. сравнение моделей с открытым исходным кодом бенчмаркера ставит MiMo-V2.6-Pro первым среди моделей с открытым весом, опережая GLM‑5.3 (max) от Z AI с 45 и Kimi K3 (max) с 44, и описывает MiMo-V2.6-Pro и GLM‑5.3 (max) как модели с наивысшим уровнем интеллекта среди открытых.
Среди проприетарных систем страница для Grok 4.7 (xhigh) от Artificial Analysis перечисляет модель SpaceXAI с тем же показателем 46. В объявлении Xiaomi указывается значение 46.32 в индексе и модель MiMo-V2.6-Pro называется “самой сильной модели с открытым исходным кодом на сегодняшний день”, утверждая, что она превосходит Kimi K3 и Qwen3.8 Max. Artificial Analysis оценивает стоимость модели в $0.13 за задачу Intelligence Index и сообщает, что её оценка в индексе обошлась в $206.66. Xiaomi заявляет, что серия сохраняет цены API серии V2.5, которую она описывает как расширяющую границу Парето между интеллектом и стоимостью.
Artificial Analysis указывает дату выпуска модели как 21 сентября 2026 года; пост с объявлением Xiaomi датирован 22 сентября 2026 года.
Разреженная архитектура MoE и веса под лицензией MIT
Согласно карточке модели, опубликованной командой Xiaomi MiMo, контрольная точка флагманской модели MiMo-V2.6-Pro-RL представляет собой разреженную модель mixture-of-experts с 1,02 триллиона параметров в общей сложности и 42 миллиардами активируемыми на токен, контекстной длиной 1 млн токенов, а также поддержкой ввода текста, изображений, видео и аудио с текстовым выводом. Спецификации Artificial Analysis указывают те же количества параметров, окно контекста и модальности, а также фиксируют лицензию MIT, позволяющую коммерческое использование.
В карточке описан 70‑слойный основной блок, 60 слоёв скользящего окна внимания, чередующихся с 10 глобальными слоями внимания, с 384 маршрутизируемыми экспертами, из которых восемь активны на токен. ViT MiMo с 681 млн параметров обрабатывает зрение, AudioTokenizer с 308 млн параметров и аудио‑патч‑энкодер с 127 млн параметров обрабатывают аудио, а пятислойный спекулятивный декодер многотокенного предсказания предсказывает семь последующих токенов за один проход вперёд.
Веса для MiMo-V2.6-Pro-RL и MiMo-V2.6-Flash-RL опубликованы на Hugging Face, с доступностью в ModelScope при выпуске. Xiaomi заявила, что также открывает исходный код полного технического отчёта, среды обучения и кода RL, чтобы исследователи могли воспроизводить и проверять результаты.
Трансляция в реальном времени процесса обучения с подкреплением
Xiaomi заявила, что транслировала процесс обучения с подкреплением в реальном времени по мере его выполнения. За менее чем шесть дней MiMo-V2.6-Flash и MiMo-V2.6-Pro каждая завершила 30 шагов RL на примерно 750 000 траекторий, при заявленных затратах около $0.85 млн и $2.62 млн соответственно. Средний показатель прохождения обучающих задач вырос на 25 % и 12 % соответственно, а в DeepSWE v1.1, отложенном долгосрочном бенчмарке по программной инженерии, оценки повысились с 48.8 до 65.68 для Flash и с 58.4 до 72.57 для Pro, сообщает Xiaomi.
Компания заявила, что масштабировала вычисления RL по трем осям: более крупные батчи на полностью асинхронной архитектуре с 1 568 образцами на обновление, обучение с длиной контекста до 1 млн токенов и 3.5–3.7 миллиарда токенов за шаг; набор многозадачности, охватывающий кодирование, общих агентов, визуальные и киберзадачи, объединённые в нескольких средах; а также увеличение вычислительных ресурсов оценщика, используя относительные сравнения внутри каждой группы для получения более точных сигналов вознаграждения.
В карточке указано полностью асинхронное Group Relative Policy Optimization с 1 568 запросами и 16 прогонов на каждый шаг, Groupwise Reward Synthesis для построения офлайн‑рубрики задач на основе противопоставленных прогонов, а также Groupwise Advantage Redistribution для онлайн‑ранжирования проходящих траекторий. Стадия многопрефиксного многопреподавательского on-policy дистилляции под названием MOPD2 следует за смешанным запуском RL, и Xiaomi описывает защиты от манипуляций вознаграждением, охватывающие дизайн вознаграждения, адверсариальную оценку, обнаружение аномалий и перекрёстную проверку между верификаторами.
Ценообразование, доступность и демонстрируемые применения
В собственных таблицах бенчмарков Xiaomi модель MiMo-V2.6-Pro набирает 71,9 в DeepSWE v1.1, против 67,9 у Flash и 19,0 у MiMo-V2.5-Pro, отставая от DeepSeek V4.1 Flash (74,2), Claude Opus 5 (74,0) и GPT 6 Astra (74,0). Xiaomi указывает рейтинг Pro в 1 673 по шкале GDPVal 2.1, оценке Elo, опубликованной Artificial Analysis, позади Claude Fable 5.1 (1 735) и Claude Opus 5 (1 708). Другие опубликованные результаты Pro включают 76,9 по проверке Toolathlon, 53,1 по Automation Bench v1.0.6, 34,9 по Terminal Bench 4.0 и 94,0 по CyberGym, где Flash показывает 95,1 против 84,5 у GLM 5.3.
Обе модели доступны в AI Studio, MiMo Code и MiMo Desktop, а также через платформу MiMo API и OpenRouter. MiMo Desktop выходит из раннего доступа с первым официальным релизом, в котором встроены Pro и Flash, и Xiaomi заявила, что программа раннего доступа UltraSpeed продлится ещё одну неделю, при этом текущих пользователей просят перейти на новые названия моделей.
Цены на API не изменились по сравнению с серией V2.5: за миллион токенов MiMo-V2.6-Pro стоит $0,0036 за ввод с кэш‑хитом, $0,435 за ввод без кэша и $0,87 за вывод; MiMo-V2.6-Flash стоит $0,0028, $0,14 и $0,28; а MiMo-V2.6-Pro-UltraSpeed — $0,036, $4,35 и $8,70 в тех же трёх категориях. Artificial Analysis измерила 129,7 токенов вывода в секунду и время до первого токена 2,17 секунды через API Xiaomi.
Демонстрации Xiaomi охватывают разработку многопользовательских игр, 3D‑моделирование в Blender, замкнутый цикл управления роботизированной рукой Franka Panda по многокамерным видеопотокам, дизайн фронтенда и презентаций, сквозное создание видео и композицию музыки, включая оркестровую пьесу под названием Night Road, которую модель сама оценила и преобразовала в MIDI. В двух исследовательских случаях, сообщённых компанией, MiMo-V2.6-Pro разрабатывала кандидаты в металло‑органические каркасы для адсорбции соединений PFAS совместно с материалами‑экспертами Xiaomi, а также создала формализацию в Lean 4 теоремы Ли и Йорке «Третий период подразумевает хаос», превысив 6 000 строк кода, проверенную ядром Lean без незавершённых доказательств.












