Skip to main content

MiMo V2.6 Pro теперь на Felo OpenAPI: ведущая модель с открытыми весами от Xiaomi

· 10 минут чтения
Felo Search Tips Buddy
Committed to answers at your fingertips

MiMo V2.6 Pro от Xiaomi, ведущая модель с открытыми весами по индексу Artificial Analysis, доступна на Felo OpenAPI по цене $0.43/$0.87 за миллион токенов.

Xiaomi выпустила MiMo V2.6 Pro 22 сентября, и модель заняла первое место в таблице открытых весов: 46 баллов по индексу Artificial Analysis Intelligence, опередив Kimi K3 и Qwen3.8 Max. Xiaomi предоставила веса, технический отчёт и код обучения вместе с моделью.

С сегодняшнего дня mimo-v2.6-pro доступна на Felo OpenAPI. Используется тот же ключ, что и для маршрутов Claude, GPT и Grok. Тот же базовый URL. В конфигурации меняется только одна строка.

MiMo V2.6 Pro на Felo OpenAPI: ведущая модель с открытыми весами от Xiaomi с контекстом на 1M токенов и омнимодальным вводом

В этом релизе стоит обратить внимание на ценник рядом с результатом бенчмарка. Почти пограничное рассуждение за $0.43 за миллион входных токенов и $0.87 за миллион выходных токенов меняет возможности агентных циклов.

Что именно выпустила Xiaomi​

Анонс получился необычно откровенным для флагманского релиза, поэтому его легко честно резюмировать.

MiMo V2.6 Pro — флагман Xiaomi с триллионом параметров, сейчас это самая сильная модель с открытыми весами. Xiaomi заявляет это прямо, а затем сама же отмечает: разрыв с самыми сильными закрытыми моделями, Claude Fable 5.1 и GPT-6 Astra, сохраняется. На большинстве агентных бенчмарков Xiaomi заявляет паритет с Claude Opus 5 и GPT-5.6 Sol.

Это таблица самого вендора. Воспринимайте её как любую таблицу при запуске — как заявление, а не как результат. Но две вещи в этом релизе можно проверить, чего обычно не бывает с бенчмарками.

Веса открыты. MiMo V2.6 Pro и Flash вышли с открытыми весами, техническим отчётом и кодом обучения с подкреплением. Можно развернуть модель у себя, дообучить или проверить.

Обучение тоже проходило публично. Xiaomi проводила фазу RL в прямом эфире примерно шесть дней. Pro и Flash прошли по 30 шагов обучения, собрав вместе около 750 000 траекторий; только на Pro ушло примерно $2.62 млн. На DeepSWE v1.1, внешнем бенчмарке по долгосрочной разработке ПО, Pro поднялась с 48.8 до 65.7.

Вместе с весами Xiaomi открыла более 7000 сред для задач обучения с подкреплением: программная инженерия, воспроизведение уязвимостей, задачи, требующие знаний, и веб-дизайн — не только результат, но и учебный материал.

Характеристики​

ХарактеристикаMiMo V2.6 Pro
ID моделиmimo-v2.6-pro
ПроизводительXiaomi
МасштабФлагман с триллионом параметров
Окно контекста1 000 000 токенов
Макс. вывод128 000 токенов
ВводТекст, изображение, видео, аудио
ВыводТекст
ВозможностиРассуждение, вызов инструментов, структурированный вывод, стриминг
Индекс интеллекта46 (Xiaomi указывает 46.32)

Две строки заслуживают особого внимания.

Ввод — омнимодальный. Текст, изображения, видео и аудио входят в один и тот же промпт. Большинство моделей за такую цену читают только текст и, возможно, скриншот. Передача видеозаписи экрана, набора кадров или аудиодорожки без промежуточной транскрипции — это другой класс задач, и именно на это ушли усилия при обучении.

Окно контекста — миллион токенов. В обучении сразу использовался контекст на 1M токенов, а не добавлялось окно потом. Xiaomi позиционирует модель для мультимодальных, мультиагентных и мультихарнессных задач. Вопросы по всему коду, годовые подборки документов и длинные агентные ветки помещаются без сжатия.

Xiaomi также показала модель на задачах, которые легко проверить. Модель формализовала в Lean 4 основную теорему из Period Three Implies Chaos — более 6000 строк исходного кода, доказательство которых ядро Lean проверяет полностью, без пропусков. Отдельно модель работала с исследователями материалов Xiaomi над проектированием кандидатов металлоорганических каркасов для улавливания загрязнителей PFAS. Бенчмарки можно обойти. Доказательство, которое компилируется, нельзя.

Что даёт Felo OpenAPI​

Вызвать модель — просто. Причина запускать MiMo V2.6 Pro через Felo OpenAPI, а не подключать ещё одного провайдера — модель сразу попадает в уже связанную инфраструктуру.

Один ключ, три протокола. Felo OpenAPI открывает модель на каждом уровне, который поддерживает ваш клиент:

ПоверхностьEndpointДля чего использовать
Chat Completionshttps://openapi.felo.ai/api/v1/chat/completionsПриложения и агенты, совместимые с OpenAI
Responseshttps://openapi.felo.ai/api/v1/responsesЗапросы агентов и рабочих процессов
Messageshttps://openapi.felo.ai/api/v1/messagesКлиенты, совместимые с Anthropic

Укажите существующему SDK OpenAI адрес https://openapi.felo.ai/api/v1, или Claude-совместимому клиенту — https://openapi.felo.ai/api, и задайте ID модели. Не требуется отдельный аккаунт, второй биллинг или изучение SDK конкретного провайдера.

Модель сразу работает с вашими агентами. Felo OpenAPI отмечает MiMo V2.6 Pro как совместимую с Claude Code и Codex, так же, как маршруты Claude и GPT. Если у вас уже есть агент на Felo, добавить эту модель — вопрос конфигурации.

Модель не одна. Это и отличает шлюз от платформы. По тому же ключу доступны поиск, web fetch, поиск по X, субтитры YouTube, генерация PPT, mindmap, память LiveDocs и рабочие процессы SuperAgent. Модель с окном на миллион токенов и омнимодальным вводом полезна только тогда, когда может получать свежие данные и создавать результат. На Felo это возможно.

Предыдущее поколение, mimo-v2.5-pro, уже на платформе. V2.6 — апгрейд, и переключение между ними требует только редактирования.

Как это выглядит на практике​

Хороший тест — конкурентный бриф, потому что он требует всех возможностей сразу. На Felo OpenAPI один ключ закрывает весь цикл:

  1. Web Fetch забирает три страницы с ценами конкурентов в Markdown.
  2. Search дополняет недостающую информацию — финансирование, численность, свежие релизы.
  3. MiMo V2.6 Pro читает всё это в одном контексте на 1M токенов, вместе со скриншотами таблиц цен, и рассуждает по тексту и изображению одновременно, а не по OCR-транскрипции.
  4. PPT API превращает вывод в презентацию.

Альтернатива — четыре вендора, четыре ключа, четыре счета и прослойка, которую вы поддерживаете сами. Эта прослойка — налог, который убирает этот стек, и обычно именно из-за неё агентные демо не становятся продуктами.

Быстрый старт​

Три шага от нуля до ответа.

1. Получите API-ключ в аккаунте Felo API Platform и экспортируйте его.

export FELO_API_KEY="YOUR_API_KEY"

2. Сделайте первый запрос. ID модели — mimo-v2.6-pro.

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.6-pro",
"messages": [
{"role": "user", "content": "Summarize the tradeoffs between sparse and dense attention."}
]
}'

Или через OpenAI SDK, меняется только базовый URL:

import os
from openai import OpenAI

client = OpenAI(
api_key=os.environ["FELO_API_KEY"],
base_url="https://openapi.felo.ai/api/v1",
)

completion = client.chat.completions.create(
model="mimo-v2.6-pro",
messages=[{"role": "user", "content": "Explain the tradeoffs between sparse and dense attention."}],
max_tokens=1024,
)
print(completion.choices[0].message.content)

3. Включите стриминг, добавив stream: true.

curl -N https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.6-pro",
"stream": true,
"messages": [{"role": "user", "content": "Hello"}]
}'

Практический совет для многоходовых задач: это модель рассуждения. Если ваш протокол или маршрут поддерживает управление рассуждением, сохраняйте возвращаемые метаданные рассуждения и передавайте их дальше при продолжении диалога. Потеря их в середине цепочки — самый частый способ сделать модель рассуждения хуже, чем она есть.

Один ключ Felo API маршрутизирует запросы к MiMo V2.6 Pro через Chat Completions, Responses и Anthropic-совместимый Messages endpoint

Экономика стоимости​

Здесь MiMo V2.6 Pro оправдывает своё место. Официальные тарифы Felo OpenAPI за миллион токенов:

МодельВвод / MВывод / M
GPT-6 Astra$10.00$50.00
Claude Opus 5.5$4.00$20.00
GPT-6 Sol$2.00$10.00
MiMo V2.6 Pro$0.43$0.87
DeepSeek V4.1 Flash$0.15$0.60
GLM 5.3 Flash$0.15$0.50

Это опубликованные тарифы Felo OpenAPI по всему каталогу, поэтому сравнение честное: одна платформа, один ключ, один счёт. Для MiMo V2.6 Pro цена совпадает с прайс-листом Xiaomi — $0.435 за ввод и $0.87 за вывод. Маршрут передаёт модель по прайсу, без наценки.

Теперь посчитайте для реальной агентной нагрузки. Пусть цикл читает срез репозитория на 200 000 токенов, генерирует 20 000 токенов изменений и запускается 50 раз в день:

  • 10M входных токенов в день, 1M выходных токенов в день
  • На GPT-6 Astra: $100 + $50 = $150 в день
  • На Claude Opus 5.5: $40 + $20 = $60 в день
  • На MiMo V2.6 Pro: $4.30 + $0.87 = $5.17 в день

Это примерно в 29 раз дешевле GPT-6 Astra для такой же задачи, на модели, которую Xiaomi ставит рядом с Claude Opus 5 и GPT-5.6 Sol по агентным бенчмаркам. Заявление — от вендора, цена — факт. Если хотя бы две трети заявления верны, экономика агентов меняется.

Вторичный эффект важнее самой экономии. Когда цикл стоит $5 в день вместо $150, вы перестаёте урезать контекст ради экономии. Не приходится брать более слабую модель для рутинных шагов. Можно запускать цикл снова с большим промптом. Большинство проблем с качеством агентов — это замаскированные бюджетные ограничения.

Где модель уместна, а где нет​

Используйте модель, если нужна мультимодальная обработка изображений, видео или аудио; анализ с длинным контекстом, где весь документ должен оставаться в поле зрения; агентные задачи с большим расходом токенов; понимание видео; или если нужен открытый стек, поведение которого можно изучить и веса которого можно развернуть у себя.

Не используйте модель, если нужен абсолютный максимум по рассуждению и цена не ограничивает. Xiaomi прямо говорит: Claude Fable 5.1 и GPT-6 Astra всё ещё впереди. Если задача одна и критичная — платите за флагман.

Ожидание, которое стоит учесть перед переключением чувствительного к задержкам endpoint: Felo относит этот маршрут к классу deep — сначала рассуждение, потом ответ. Это правильный выбор для анализа и планирования, но не для автодополнения или чата в реальном времени, где лучше подходит быстрый уровень.

Кратко: это модель для тех, кто хочет большую часть качества без большей части счета. Счёт — то, что накапливается.

Частые вопросы​

MiMo V2.6 Pro и MiMo V2.6 Flash — это одно и то же? Нет. Flash — более дешёвый и быстрый вариант из того же релиза, сейчас его нет на Felo OpenAPI. Pro — флагманский маршрут.

Какой endpoint использовать? Если вы уже используете OpenAI SDK, используйте Chat Completions по адресу https://openapi.felo.ai/api/v1/chat/completions. Если у вас Claude-совместимый клиент — Anthropic-совместимый endpoint по адресу https://openapi.felo.ai/api. Endpoint Responses подходит для агентных и workflow-запросов.

Поддерживаются ли вызов инструментов и структурированный вывод? Да. Felo OpenAPI отмечает рассуждение, инструменты, JSON, стриминг и vision как поддерживаемые возможности этого маршрута. Определения инструментов совместимы по схеме, поэтому существующий код вызова инструментов работает без изменений.

Можно ли развернуть модель у себя? В этом и смысл открытых весов. Xiaomi опубликовала веса и технический отчёт, поэтому маршрут через Felo сегодня не ограничивает вас завтра.

Как модель сравнивается с закрытыми флагманами? Формулировка Xiaomi — самая честная: впереди всех других моделей с открытыми весами, всё ещё позади Claude Fable 5.1 и GPT-6 Astra, примерно на уровне Claude Opus 5 и GPT-5.6 Sol по большинству агентных бенчмарков. Важна последняя колонка: возможности за доллар.

Попробуйте MiMo V2.6 Pro​

Получите ключ на Felo API Platform, укажите базовый URL https://openapi.felo.ai/api/v1, задайте модель mimo-v2.6-pro и запустите ту нагрузку, которую раньше экономили. На странице модели — полные характеристики, актуальные цены и примеры для TypeScript, Python, cURL и Claude Code.

Изучить MiMo V2.6 Pro на Felo OpenAPI →


Эта статья также доступна на следующих языках: English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português.