MiMo V2.6 Pro теперь на Felo OpenAPI: ведущая модель с открытыми весами от Xiaomi
MiMo V2.6 Pro от Xiaomi, ведущая модель с открытыми весами по индексу Artificial Analysis, доступна на Felo OpenAPI по цене $0.43/$0.87 за миллион токенов.
Xiaomi выпустила MiMo V2.6 Pro 22 сентября, и модель заняла первое место в таблице открытых весов: 46 баллов по индексу Artificial Analysis Intelligence, опередив Kimi K3 и Qwen3.8 Max. Xiaomi предоставила веса, технический отчёт и код обучения вместе с моделью.
С сегодняшнего дня mimo-v2.6-pro доступна на Felo OpenAPI. Используется тот же ключ, что и для маршрутов Claude, GPT и Grok. Тот же базовый URL. В конфигурации меняется только одна строка.

В этом релизе стоит обратить внимание на ценник рядом с результатом бенчмарка. Почти пограничное рассуждение за $0.43 за миллион входных токенов и $0.87 за миллион выходных токенов меняет возможности агентных циклов.
Что именно выпустила Xiaomi
Анонс получился необычно откровенным для флагманского релиза, поэтому его легко честно резюмировать.
MiMo V2.6 Pro — флагман Xiaomi с триллионом параметров, сейчас это самая сильная модель с открытыми весами. Xiaomi заявляет это прямо, а затем сама же отмечает: разрыв с самыми сильными закрытыми моделями, Claude Fable 5.1 и GPT-6 Astra, сохраняется. На большинстве агентных бенчмарков Xiaomi заявляет паритет с Claude Opus 5 и GPT-5.6 Sol.
Это таблица самого вендора. Воспринимайте её как любую таблицу при запуске — как заявление, а не как результат. Но две вещи в этом релизе можно проверить, чего обычно не бывает с бенчмарками.
Веса открыты. MiMo V2.6 Pro и Flash вышли с открытыми весами, техническим отчётом и кодом обучения с подкреплением. Можно развернуть модель у себя, дообучить или проверить.
Обучение тоже проходило публично. Xiaomi проводила фазу RL в прямом эфире примерно шесть дней. Pro и Flash прошли по 30 шагов обучения, собрав вместе около 750 000 траекторий; только на Pro ушло примерно $2.62 млн. На DeepSWE v1.1, внешнем бенчмарке по долгосрочной разработке ПО, Pro поднялась с 48.8 до 65.7.
Вместе с весами Xiaomi открыла более 7000 сред для задач обучения с подкреплением: программная инженерия, воспроизведение уязвимостей, задачи, требующие знаний, и веб-дизайн — не только результат, но и учебный материал.
Характеристики
| Характеристика | MiMo V2.6 Pro |
|---|---|
| ID модели | mimo-v2.6-pro |
| Производитель | Xiaomi |
| Масштаб | Флагман с триллионом параметров |
| Окно контекста | 1 000 000 токенов |
| Макс. вывод | 128 000 токенов |
| Ввод | Текст, изображение, видео, аудио |
| Вывод | Текст |
| Возможности | Рассуждение, вызов инструментов, структурированный вывод, стриминг |
| Индекс интеллекта | 46 (Xiaomi указывает 46.32) |
Две строки заслуживают особого внимания.
Ввод — омнимодальный. Текст, изображения, видео и аудио входят в один и тот же промпт. Большинство моделей за такую цену читают только текст и, возможно, скриншот. Передача видеозаписи экрана, набора кадров или аудиодорожки без промежуточной транскрипции — это другой класс задач, и именно на это ушли усилия при обучении.
Окно контекста — миллион токенов. В обучении сразу использовался контекст на 1M токенов, а не добавлялось окно потом. Xiaomi позиционирует модель для мультимодальных, мультиагентных и мультихарнессных задач. Вопросы по всему коду, годовые подборки документов и длинные агентные ветки помещаются без сжатия.
Xiaomi также показала модель на задачах, которые легко проверить. Модель формализовала в Lean 4 основную теорему из Period Three Implies Chaos — более 6000 строк исходного кода, доказательство которых ядро Lean проверяет полностью, без пропусков. Отдельно модель работала с исследователями материалов Xiaomi над проектированием кандидатов металлоорганических каркасов для улавливания загрязнителей PFAS. Бенчмарки можно обойти. Доказательство, которое компилируется, нельзя.
Что даёт Felo OpenAPI
Вызвать модель — просто. Причина запускать MiMo V2.6 Pro через Felo OpenAPI, а не подключать ещё одного провайдера — модель сразу попадает в уже связанную инфраструктуру.
Один ключ, три протокола. Felo OpenAPI открывает модель на каждом уровне, который поддерживает ваш клиент:
| Поверхность | Endpoint | Для чего использовать |
|---|---|---|
| Chat Completions | https://openapi.felo.ai/api/v1/chat/completions | Приложения и агенты, совместимые с OpenAI |
| Responses | https://openapi.felo.ai/api/v1/responses | Запросы агентов и рабочих процессов |
| Messages | https://openapi.felo.ai/api/v1/messages | Клиенты, совместимые с Anthropic |
Укажите существующему SDK OpenAI адрес https://openapi.felo.ai/api/v1, или Claude-совместимому клиенту — https://openapi.felo.ai/api, и задайте ID модели. Не требуется отдельный аккаунт, второй биллинг или изучение SDK конкретного провайдера.
Модель сразу работает с вашими агентами. Felo OpenAPI отмечает MiMo V2.6 Pro как совместимую с Claude Code и Codex, так же, как маршруты Claude и GPT. Если у вас уже есть агент на Felo, добавить эту модель — вопрос конфигурации.
Модель не одна. Это и отличает шлюз от платформы. По тому же ключу доступны поиск, web fetch, поиск по X, субтитры YouTube, генерация PPT, mindmap, память LiveDocs и рабочие процессы SuperAgent. Модель с окном на миллион токенов и омнимодальным вводом полезна только тогда, когда может получать свежие данные и создавать результат. На Felo это возможно.
Предыдущее поколение, mimo-v2.5-pro, уже на платформе. V2.6 — апгрейд, и переключение между ними требует только редактирования.
Как это выглядит на практике
Хороший тест — конкурентный бриф, потому что он требует всех возможностей сразу. На Felo OpenAPI один ключ закрывает весь цикл:
- Web Fetch забирает три страницы с ценами конкурентов в Markdown.
- Search дополняет недостающую информацию — финансирование, численность, свежие релизы.
- MiMo V2.6 Pro читает всё это в одном контексте на 1M токенов, вместе со скриншотами таблиц цен, и рассуждает по тексту и изображению одновременно, а не по OCR-транскрипции.
- PPT API превращает вывод в презентацию.
Альтернатива — четыре вендора, четыре ключа, четыре счета и прослойка, которую вы поддерживаете сами. Эта прослойка — налог, который убирает этот стек, и обычно именно из-за неё агентные демо не становятся продуктами.
Быстрый старт
Три шага от нуля до ответа.
1. Получите API-ключ в аккаунте Felo API Platform и экспортируйте его.
export FELO_API_KEY="YOUR_API_KEY"
2. Сделайте первый запрос. ID модели — mimo-v2.6-pro.
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.6-pro",
"messages": [
{"role": "user", "content": "Summarize the tradeoffs between sparse and dense attention."}
]
}'
Или через OpenAI SDK, меняется только базовый URL:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["FELO_API_KEY"],
base_url="https://openapi.felo.ai/api/v1",
)
completion = client.chat.completions.create(
model="mimo-v2.6-pro",
messages=[{"role": "user", "content": "Explain the tradeoffs between sparse and dense attention."}],
max_tokens=1024,
)
print(completion.choices[0].message.content)
3. Включите стриминг, добавив stream: true.
curl -N https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.6-pro",
"stream": true,
"messages": [{"role": "user", "content": "Hello"}]
}'
Практический совет для многоходовых задач: это модель рассуждения. Если ваш протокол или маршрут поддерживает управление рассуждением, сохраняйте возвращаемые метаданные рассуждения и передавайте их дальше при продолжении диалога. Потеря их в середине цепочки — самый частый способ сделать модель рассуждения хуже, чем она есть.

Экономика стоимости
Здесь MiMo V2.6 Pro оправдывает своё место. Официальные тарифы Felo OpenAPI за миллион токенов:
| Модель | Ввод / M | Вывод / M |
|---|---|---|
| GPT-6 Astra | $10.00 | $50.00 |
| Claude Opus 5.5 | $4.00 | $20.00 |
| GPT-6 Sol | $2.00 | $10.00 |
| MiMo V2.6 Pro | $0.43 | $0.87 |
| DeepSeek V4.1 Flash | $0.15 | $0.60 |
| GLM 5.3 Flash | $0.15 | $0.50 |
Это опубликованные тарифы Felo OpenAPI по всему каталогу, поэтому сравнение честное: одна платформа, один ключ, один счёт. Для MiMo V2.6 Pro цена совпадает с прайс-листом Xiaomi — $0.435 за ввод и $0.87 за вывод. Маршрут передаёт модель по прайсу, без наценки.
Теперь посчитайте для реальной агентной нагрузки. Пусть цикл читает срез репозитория на 200 000 токенов, генерирует 20 000 токенов изменений и запускается 50 раз в день:
- 10M входных токенов в день, 1M выходных токенов в день
- На GPT-6 Astra: $100 + $50 = $150 в день
- На Claude Opus 5.5: $40 + $20 = $60 в день
- На MiMo V2.6 Pro: $4.30 + $0.87 = $5.17 в день
Это примерно в 29 раз дешевле GPT-6 Astra для такой же задачи, на модели, которую Xiaomi ставит рядом с Claude Opus 5 и GPT-5.6 Sol по агентным бенчмаркам. Заявление — от вендора, цена — факт. Если хотя бы две трети заявления верны, экономика агентов меняется.
Вторичный эффект важнее самой экономии. Когда цикл стоит $5 в день вместо $150, вы перестаёте урезать контекст ради экономии. Не приходится брать более слабую модель для рутинных шагов. Можно запускать цикл снова с большим промптом. Большинство проблем с качеством агентов — это замаскированные бюджетные ограничения.
Где модель уместна, а где нет
Используйте модель, если нужна мультимодальная обработка изображений, видео или аудио; анализ с длинным контекстом, где весь документ должен оставаться в поле зрения; агентные задачи с большим расходом токенов; понимание видео; или если нужен открытый стек, поведение которого можно изучить и веса которого можно развернуть у себя.
Не используйте модель, если нужен абсолютный максимум по рассуждению и цена не ограничивает. Xiaomi прямо говорит: Claude Fable 5.1 и GPT-6 Astra всё ещё впереди. Если задача одна и критичная — платите за флагман.
Ожидание, которое стоит учесть перед переключением чувствительного к задержкам endpoint: Felo относит этот маршрут к классу deep — сначала рассуждение, потом ответ. Это правильный выбор для анализа и планирования, но не для автодополнения или чата в реальном времени, где лучше подходит быстрый уровень.
Кратко: это модель для тех, кто хочет большую часть качества без большей части счета. Счёт — то, что накапливается.
Частые вопросы
MiMo V2.6 Pro и MiMo V2.6 Flash — это одно и то же? Нет. Flash — более дешёвый и быстрый вариант из того же релиза, сейчас его нет на Felo OpenAPI. Pro — флагманский маршрут.
Какой endpoint использовать?
Если вы уже используете OpenAI SDK, используйте Chat Completions по адресу https://openapi.felo.ai/api/v1/chat/completions. Если у вас Claude-совместимый клиент — Anthropic-совместимый endpoint по адресу https://openapi.felo.ai/api. Endpoint Responses подходит для агентных и workflow-запросов.
Поддерживаются ли вызов инструментов и структурированный вывод? Да. Felo OpenAPI отмечает рассуждение, инструменты, JSON, стриминг и vision как поддерживаемые возможности этого маршрута. Определения инструментов совместимы по схеме, поэтому существующий код вызова инструментов работает без изменений.
Можно ли развернуть модель у себя? В этом и смысл открытых весов. Xiaomi опубликовала веса и технический отчёт, поэтому маршрут через Felo сегодня не ограничивает вас завтра.
Как модель сравнивается с закрытыми флагманами? Формулировка Xiaomi — самая честная: впереди всех других моделей с открытыми весами, всё ещё позади Claude Fable 5.1 и GPT-6 Astra, примерно на уровне Claude Opus 5 и GPT-5.6 Sol по большинству агентных бенчмарков. Важна последняя колонка: возможности за доллар.
Попробуйте MiMo V2.6 Pro
Получите ключ на Felo API Platform, укажите базовый URL https://openapi.felo.ai/api/v1, задайте модель mimo-v2.6-pro и запустите ту нагрузку, которую раньше экономили. На странице модели — полные характеристики, актуальные цены и примеры для TypeScript, Python, cURL и Claude Code.
Изучить MiMo V2.6 Pro на Felo OpenAPI →
Эта статья также доступна на следующих языках: English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português.