Xiaomi оглави отворените модели с MiMo-V2.6-Pro на фона на спор с Anthropic

Публикувано от Svetni.me Editorial на 22 септември 2026 г.

Концептуална илюстрация на модела MiMo-V2.6-Pro и отворените изкуствени интелекти
Изображение: Svetni.me / Авторско изображение

Технологичният гигант Xiaomi официално представи новата си серия големи езикови модели MiMo-V2.6, оглавявана от флагмана MiMo-V2.6-Pro. Системата заема първото място сред моделите с отворен код и отворени тегла, съчетавайки висока производителност с драстично по-ниски цени на API заявките.

Според публикация на технологичното издание The Decoder [1], този технологичен напредък поставя модела на границата на Парето по отношение на съотношението между интелигентност и оперативни разходи. Успехът обаче е съпътстван от остри обвинения от страна на Anthropic, която твърди, че възможностите на модела са постигнати чрез нерегламентирано извличане на данни от Claude.

Инфографика за техническите параметри на MiMo-V2.6-Pro и спора за дестилация на данни
Изображение: Svetni.me / ИИ генерирана инфографика

Архитектура от трилион параметри и ценова революция

В тестовете на аналитичната агенция Artificial Analysis моделът MiMo-V2.6-Pro отбелязва 46 точки в индекса Intelligence Index, с което изпреварва водещите отворени конкуренти Kimi K3 и Qwen. Моделът използва архитектура със смес от експерти (Mixture-of-Experts) с общо 1.02 трилиона параметъра, от които едва 42 милиарда са активни при обработка на всяка индивидуална заявка [1].

Истинската сензация за пазара е ценовата политика: \$0.435 за милион входящи токена и \$0.87 за милион изходящи токена. По изчисления на анализаторите изпълнението на стандартна тестова задача струва само около \$0.13 — стойност в пъти по-ниска спрямо затворените комерсиални алтернативи. Успоредно с флагмана Xiaomi предлага и по-компактния модел MiMo-V2.6-Flash, както и оптимизирания вариант Pro-UltraSpeed [1].

Мащабно обучение чрез подкрепление за $2.62 милиона

Основният двигател зад технологичния скок е значително разширеното обучение чрез подкрепление (Reinforcement Learning). Компанията е мащабирала тренировъчната фаза в три ключови измерения: увеличен обем данни за всяка стъпка на оптимизация, разнообразни синтетични работни среди и сериозен изчислителен капацитет за автоматизирано валидиране на получените решения [1].

Целият процес на подкрепящо обучение е продължил по-малко от шест дни при изчислителни разходи от приблизително \$2.62 милиона за Pro и \$0.85 милиона за Flash. В бенчмарка за разработка на софтуер DeepSWE оценката на модела нараства от 58.4 до 72.6 точки. За предотвратяване на манипулации на възнагражденията (reward hacking), инженерите са замразили вътрешния механизъм за маршрутизация и са предоставили пълен пакет с инструменти и над 7000 готови тестови среди [1].

Пресечна точка на откритостта и спора за дестилация

Пълната откритост на Xiaomi контрастира остро с доклада на Anthropic за злоупотреби с модела Claude, публикуван само две седмици по-рано. В него американската лаборатория описва мащабни кампании за нерегламентирана дестилация от седем китайски организации, генерирали приблизително 190 милиона интеракции [1].

В случая с Xiaomi (регистриран под код GTG-16008) са отчетени над 400 000 сесии, в които потребителски диалози и програмни сесии от ранните версии на MiMo са били подавани към Claude през инструменти като OpenClaw и OpenCode. Конфликтът илюстрира нарастващото напрежение в глобалната индустрия около границите на синтетичните данни и защитата на интелектуалната собственост при обучението на следващото поколение модели [1].

Източници:

[1]: Xiaomi's affordable flagship AI leads the open models, and Anthropic says Claude helped get it there - The Decoder