Передовой интеллект, все модальности, создано открыто.
Этой строкой Xiaomi открыла во вторник анонс MiMo-V2.6. Производитель смартфонов и электромобилей выпустил две модели с открытыми весами — Pro и Flash — по лицензии MIT. Веса доступны на Hugging Face.
Аналитическая компания Artificial Analysis оценивает MiMo-V2.6-Pro в 46 баллов по своему индексу интеллекта. Это первое место среди 114 моделей в своем классе. Это самый высокий показатель, которого когда-либо достигала модель с открытыми весами, и компания также признает ее самой дешевой отслеживаемой моделью: стоимость составляет 0,13 доллара за задачу.
Что представляет собой эта модель
Pro — это разреженная модель типа «мощная смесь экспертов» (mixture-of-experts). Она содержит в общей сложности 1,02 триллиона параметров, из которых 42 миллиарда активны для каждого конкретного токена, что и позволяет сохранять низкую стоимость работы при таком размере.
Модель принимает текст, изображения, аудио и видео и удерживает контекст в миллион токенов. Этого достаточно для крупного репозитория, полного трейса инструментов или нескольких сеансов рабочей памяти агента.
Xiaomi берет 0,435 доллара за миллион входных токенов и 0,87 доллара за миллион выходных. В тот же день Anthropic снизила цены на Claude Opus 5.5 до 4 и 20 долларов соответственно.
По данным Xiaomi, Pro превосходит Kimi K3 от Moonshot. Она также обходит Qwen3.8 Max от Alibaba. Эти две модели лидировали среди решений с открытыми весами большую часть текущего года.
Обе модели уже доступны. Они работают в Xiaomi AI Studio, в приложениях MiMo Code и MiMo Desktop, через собственную API-платформу компании, а также на OpenRouter. Все, кто предпочитает размещать веса самостоятельно, могут загрузить их с Hugging Face.
Существует и третий вариант — Pro-UltraSpeed, который, по утверждению Xiaomi, генерирует текст до 20 раз быстрее, чем Pro, при том же качестве. Он стоит в десять раз дороже за токен: 4,35 доллара на входе и 8,70 доллара на выходе.
Шесть дней и 2,62 миллиона долларов
Такой прирост производительности был достигнут за счет одного масштабного цикла обучения с подкреплением. Xiaomi транслировала его в прямом эфире по мере прохождения.
Модели Pro и Flash выполнили по 30 шагов обучения примерно за 750 000 траекторий менее чем за шесть дней. Обучение Pro обошлось примерно в 2,62 миллиона долларов. Стоимость Flash составила около 0,85 миллиона долларов.
На DeepSWE, обособленном бенчмарке по разработке программного обеспечения, Xiaomi фиксирует рост показателей Pro с 58,4 до 72,57 за время прогона. Модель Flash улучшила результат с 48,8 до 65,68.
Большинство лабораторий запускают отдельные процессы обучения для каждой предметной области. Xiaomi объединила программирование, общих агентов, визуальные задачи и кибербезопасность в единый процесс, чтобы достижения в одной сфере подкрепляли остальные.
Компания также подробно описывает свою защиту от хакинга наград (reward hacking). Как выяснилось, ранние агенты решали поставленные задачи по устранению багов, просто заимствуя исправление из более поздней версии пакета, вместо того чтобы писать его самостоятельно. Xiaomi удалила кэши сборки и будущую историю Git из среды обучения и задействовала специализированного агента для поиска оставшихся лазеек.
Flash — это то, что будут использовать большинство компаний
Все заголовки газет достанутся Pro. Но в продакшн в итоге пойдет Flash.
Она стоит 0,14 и 0,28 доллара за миллион токенов — примерно треть от стоимости Pro. При этом она сохраняет тот же контекст в миллион токенов и те же мультимодальные возможности.
В большинстве собственных бенчмарков Xiaomi для агентов она отстает от Pro на четыре балла или меньше: на DeepSWE результат составляет 67,9 против 71,9, на AutomationBench — 52,3 против 53,1, на JobBench — 61,2 против 62,0.
В одном из тестов по кибербезопасности, CyberGym, Flash обходит Pro со счетом 95,1 против 94,0. По остальным трем кибербенчмаркам Pro уверенно лидирует, так что это скорее исключение, чем тенденция.
Это не полная победа
Собственные таблицы Xiaomi показывают, в чем модель уступает. Claude Opus 5 обходит Pro на DeepSWE и ProgramBench. На Terminal Bench 4.0 разрыв велик: 49,0 против 34,9 (у GPT-6 Astra — 59,6).
Индекс говорит о том же. По данным Artificial Analysis, у Opus 5.5 показатель составляет 58 против 46 у MiMo. Xiaomi лидирует среди моделей с открытыми весами, но не на рынке в целом.
По словам Xiaomi, Pro демонстрирует производительность на уровне Opus 5 и GPT-5.6 Sol в большинстве агентских бенчмарков. Это утверждение базируется на внутренних тестах компании. Показатель в 46 баллов — нет.
Необычная часть заключается в том, что еще было опубликовано
Обычно релиз модели с открытыми весами ограничивается самими весами и научной статьей. Xiaomi опубликовала значительно больше.
Помимо двух моделей, компания представила полный технический отчет, сквозной фреймворк обучения с подкреплением, более 7000 задач для обучения с подкреплением с автоматической проверкой, набор компонуемых мини-окружений, а также уменьшенную модель, дистиллированную из результатов обучения MiMo.
Задачи охватывают разработку программного обеспечения, кибербезопасность, офисную работу и веб-дизайн. Еще около тысячи задач посвящены созданию музыки.
Xiaomi также опубликовала дизайн наград, гиперпараметры, структуру наборов данных и затраты. Заявленная цель — воспроизводимость результатов, и исследователям предлагается проверить их.
Это может оказаться важнее позиций в рейтинге. Места в таблицах лидеров держатся неделями. А опубликованный фреймворк обучения с подкреплением, который небольшие лаборатории могут запускать на небольших моделях, меняет то, что может позволить себе хорошо финансируемая исследовательская группа.
Почему настоящая сенсация — это цена
Рейтинги быстро меняются. В августе звание самой дешевой в запуске AI-модели удерживала DeepSeek, а в июле корона открытой модели принадлежала Kimi K3.
Разрыв в операционных расходах сокращается медленнее. Компания, обрабатывающая миллионы запросов агентов, выбирает между 0,87 доллара за миллион выходных токенов и 20 долларами за Opus 5.5. Для кодинг-ассистента или конвейера обработки документов, сжигающего сотни тысяч токенов за задачу, это определяет выбор закупки гораздо сильнее, чем результаты бенчмарков.
Кроме того, Xiaomi входит в число семи китайских лабораторий, упомянутых Anthropic в отчете об угрозах от 10 сентября. Их обвинили в перенаправлении запросов через Claude для сбора его выходных данных. Xiaomi никак не отреагировала на это обвинение.
Зато компания предоставила всем желающим проверить ее заявления: веса, код, окружения и калькуляцию расходов.
Опубликовано 22 сентября 2026 - 11:25 Наверх



