$NAZ6 Очередная попытка деклассирования американского превосходства в ИИ
Неожиданный интеллектуальный рывок от Китая
Для США подстава появилась там, где ее ожидали меньше всего –
всеми забытая компания Xiaomi представила самую мощную на сегодняшний день LLM (MiMo-V2.6) среди китайских моделей, которая выравнивает конкуренцию с флагманами прошлого поколения от OpenAI и Anthropic, значительно превосходя вечно отстающую Google и дерзкую SpaceX, пытающуюся ворваться на Олимп.
Вчера была представлена Grok 4.7 – ничего особенного, «ползучее» продвижение на траектории закрытия технологического разрыва с флагманами, но не такой сильный рывок, как переход от Grok 4.5 к Grok 4.6 и тем более значительно скромнее, чем переход от Grok 4.3 к Grok 4.5.
В этот раз Grok 4.7 нет смысла разбирать – уровень GPT-5.6 SOL, а MiMo-V2.6 представляет сопоставимую производительность при кратно более низкой цене. Ожидания участников технологического рынка были от семейства моделей Qwen, DeepSeek, Kimi и GLM, но от Xiaomi? Это что-то новое.
Характеристика
MiMo-V2.6-Flash
MiMo-V2.6-Pro
Архитектура
Разреженная MoE
Разреженная MoE
Всего параметров
309 млрд
1,02 трлн
Активных параметров на токен
15 млрд
42 млрд
Контекст
1 млн токенов
1 млн токенов
Входные модальности
Текст, изображения, видео, аудио
Текст, изображения, видео, аудио
Лицензия опубликованных весов
MIT
MIT
Вход, $ за 1 млн токенов
0.14
0.435
Выход, $ за 1 млн токенов
0.28
0.87
Чтение кеша, $ за 1 млн токенов
0.0028
0.0036
Если не вдаваться в набор тестов –
по официальным тестам MiMo-V2.6 Pro прямой конкурент GPT-5.6 SOL и даже Opus 5, но независимое тестирование чуть менее оптимистично, ставя MiMo-V2.6 Pro на уровень Opus 5 с нагрузкой Medium и GPT-5.6 SOL с нагрузкой xHigh.
При любом угле обзора это сильнейшая или одна из сильнейших сейчас китайских моделей, которая соревнуется с флагманами США прошлого поколения.
Главная ценность сейчас MiMo-V2.6 не в интеллектуальной емкости, а в соотношении цены и качества, имея при этом полный набор мультимодальности (текст, изображения, видео, аудио), чего даже нет у SOL и Opus (решается через инструменты).
Текущая цена MiMo-V2.6 Pro более чем в
10 раз ниже на вход и в
30 раз ниже на выход по токенам в сравнении с Opus, но
главное – кэш, который практически бесплатен – 0.0036 доллара, что почти в 150 раз ниже Opus.
В ресурсоемких задачах в структуре потребления токенов около 95% занимает кэш, поэтому профучастники смотрят не на стоимость выхода (доля расходов не так велика), а на стоимость кэша.
MiMo-V2.6 Flash совсем немного уступает MiMo-V2.6 Pro и значительно сильнее, чем Claude Sonnet, а по цене в 3.1 раза дешевле MiMo-V2.6 Pro.
Если сравнить MiMo-V2.6 Pro с Grok 4.7 (сопоставимы по интеллекту), разница в цене в
4.6 раза ниже на вход, в
6.9 раза ниже на выход и в
140 раз ниже по кэшу, а это Grok, которого Маск позиционировал, как дешевую модель.
С MiMo-V2.6 Flash ценовой разрыв еще более ошеломляющий.
artificialanalysis.ai обновили методику тестирования на следующий день, а потом еще раз, когда я и еще несколько неравнодушных к объективным результатам энтузиастов били тревогу
https://t.me/spydell_finance/10106 относительно неадекватности прежней методики тестирования. Теперь баланс более или менее отражает силу моделей.
На днях китайцы представили Step 5, которая на уровне нашумевшей Kimi 3, а
еще ранее вышла Hy4 preview, которая примерно на этом же уровне.
Это означает, что у китайцев всего 7 боевых моделей (MiMo V2.6 Pro + Qwen 3.8 + GLM 5.3 + Kimi K3 + Step 5 + Hy4 preview + DeepSeek V4.1 Flash) в диапазоне американских флагманов и еще три в резерве, которые могут получить обновление (Seed 2.1 pro, Minimax M3 и Ernie 5.1).
По токенам самыми экономными являются модели OpenAI, а самыми прожорливыми – Sonnet и Qwen 3.8.
По стоимости в рамках решения задач MiMo-V2.6 Pro оказалась практически бесплатной, а самыми дорогими – модели от Anthropic и Qwen 3.8.
Все это сильно ломает экономику ИИ-индустрии, вынуждая бигтехов жестко демпинговать . Как-то так 🫠