Skip to main content

MiMo V2.6 ProがFelo OpenAPIに登場:Xiaomiの最高峰オープンウェイトモデル

· 約13分
Felo Search Tips Buddy
Committed to answers at your fingertips

XiaomiのMiMo V2.6 Proは、Artificial Analysisインデックスでトップのオープンウェイトモデルであり、Felo OpenAPIで100万トークンあたり$0.43/$0.87で利用可能。

Xiaomiは9月22日にMiMo V2.6 Proをリリースし、オープンウェイト表のトップに位置した。Artificial Analysis Intelligence Indexで46を記録し、Kimi K3やQwen3.8 Maxを上回った。Xiaomiはウェイト、技術レポート、トレーニングコードを同時に公開した。

本日より、mimo-v2.6-proがFelo OpenAPIで利用可能となった。Claude、GPT、Grokルートで使用しているキーと同じものが使える。ベースURLも同じ。設定の一行を変更するだけで利用できる。

MiMo V2.6 Pro on Felo OpenAPI: the top open-weights model from Xiaomi with a 1M-token context and omni-modal input

このリリースが注目される理由は、ベンチマークの数値の隣に並ぶ価格設定にある。100万入力トークンあたり$0.43、100万出力トークンあたり$0.87という価格は、エージェントループの実行可能範囲を広げる。

Xiaomiが実際に公開したもの​

この発表は、フラッグシップのローンチとしては珍しく率直な内容であり、要点をまとめやすい。

MiMo V2.6 ProはXiaomiの1兆パラメータフラッグシップで、現時点で最も強力なオープンウェイトモデルとなっている。Xiaomiはその事実を明確に述べ、同時に反論も提示している:最強のクローズドモデルであるClaude Fable 5.1やGPT-6 Astraとの間にはまだ差がある。多くのエージェントベンチマークでは、Claude Opus 5やGPT-5.6 Solと同等と主張している。

これはベンダー自身のスコアボードであり、ローンチテーブルと同様に主張として扱うべきだ。しかし、このリリースには通常のベンチマーク主張とは異なり、検証可能な点が二つある。

ウェイトが公開されている。 MiMo V2.6 ProとFlashは、オープンウェイト、技術レポート、強化学習コードとともにリリースされた。セルフホストやファインチューニング、検証が可能だ。

トレーニングランも公開された。 XiaomiはRLフェーズを約6日間ライブで実施した。ProとFlashはそれぞれ30ステップのトレーニングを完了し、合計で約75万のトラジェクトリを収集した。Proのトレーニングだけで約$2.62百万が報告されている。DeepSWE v1.1という長期ソフトウェアエンジニアリングベンチマークでは、Proモデルが48.8から65.7へと向上した。

ウェイトとともに、Xiaomiはソフトウェアエンジニアリング、脆弱性再現、知識集約型作業、ウェブデザインなど7,000以上の強化学習タスク環境をオープンソース化した。結果だけでなく、トレーニング素材も公開した。

スペックシート​

スペックMiMo V2.6 Pro
モデルIDmimo-v2.6-pro
メーカーXiaomi
スケール1兆パラメータフラッグシップ
コンテキストウィンドウ1,000,000トークン
最大出力128,000トークン
入力テキスト、画像、動画、音声
出力テキスト
機能推論、ツール呼び出し、構造化出力、ストリーミング
インテリジェンスインデックス46(Xiaomi報告値46.32)

注目すべき行が二つある。

入力側がオムニモーダル。 テキスト、画像、動画、音声が同じプロンプトに入る。多くの同価格帯モデルはテキストやスクリーンショット程度しか扱えない。画面録画やフレームの束、音声トラックを文字起こしなしで直接入力できる点に、モデルのトレーニング努力が注がれている。

コンテキストウィンドウが100万トークン。 トレーニング自体が100万トークンのコンテキストを使用し、後付けではない。Xiaomiはモデルをマルチモーダル、マルチエージェント、マルチハーネス用途に位置付けている。コードベース全体の質問や、1年分のドキュメントセット、長いエージェントスレッドも圧縮なしで収まる。

Xiaomiは検証しやすい作業にもモデルを適用した。Period Three Implies Chaosの主定理をLean 4で完全形式化し、6,000行以上のソースを生成した。Leanカーネルが未証明のプレースホルダーなしで証明をチェックできる。別途、Xiaomiの材料研究者と協力し、PFAS汚染物質を捕捉する金属有機構造体候補を設計した。ベンチマークは操作できるが、コンパイル可能な証明は操作できない。

Felo OpenAPIが提供するもの​

モデルを呼び出すこと自体は簡単だ。MiMo V2.6 ProをFelo OpenAPI経由で使う理由は、既存のスタックにモデルが組み込まれる点にある。

1つのキーで3つのプロトコル。 Felo OpenAPIは、クライアントが話すあらゆるインターフェースでモデルを公開している:

サーフェスエンドポイント用途
Chat Completionshttps://openapi.felo.ai/api/v1/chat/completionsOpenAI互換アプリやエージェント
Responseshttps://openapi.felo.ai/api/v1/responsesエージェントやワークフローリクエスト
Messageshttps://openapi.felo.ai/api/v1/messagesAnthropic互換クライアント

既存のOpenAI SDKをhttps://openapi.felo.ai/api/v1に向けるか、Claudeスタイルのクライアントをhttps://openapi.felo.ai/apiに向け、モデルIDを設定する。別アカウントや二重課金関係、プロバイダー固有SDKの習得は不要。

既存のエージェントにそのまま組み込める。 Felo OpenAPIは、MiMo V2.6 ProをClaude CodeやCodexと同様に利用可能としている。ClaudeやGPTルートと同じ扱いだ。Feloにエージェントを向けている場合、モデル追加は設定変更だけで済む。

モデル単体ではない。 これがゲートウェイとプラットフォームの違い。検索、ウェブ取得、X検索、YouTube字幕、PPT生成、マインドマップ、LiveDocsメモリ、SuperAgentワークフローが同じキーで利用できる。100万トークンのコンテキストとオムニモーダル入力を持つモデルは、新しい情報へのアクセスや成果物生成もできて初めて活用できる。Feloではそれが可能だ。

前世代のmimo-v2.5-proも既にプラットフォーム上にある。V2.6はアップグレード版で、切り替えは編集だけで完了する。

エンドツーエンドの利用例​

競合分析ブリーフは良いテストケースとなる。全機能を同時に必要とするからだ。Felo OpenAPIでは、1つのキーで全工程をカバーできる:

  1. Web Fetchが3社の価格ページをMarkdownで取得する。
  2. Searchがページに書かれていない情報(資金調達、従業員数、最近のローンチ)を補完する。
  3. MiMo V2.6 Proが全データを1Mトークンのコンテキストで読み、各価格表のスクリーンショットも含めて、テキストと画像を同時に推論する(OCR変換なし)。
  4. PPT APIが結論をスライドに変換する。

これを別々のベンダーで行う場合、4社、4つのキー、4つの請求書、そして自分で管理するグルー層が必要になる。そのグルーがこのスタックで不要となり、エージェントデモが製品化されない最大の理由を解消する。

クイックスタート​

ゼロからレスポンスまで3ステップ。

1. Felo API PlatformアカウントからAPIキーを取得し、エクスポートする。

export FELO_API_KEY="YOUR_API_KEY"

2. 初回リクエストを送信する。 モデルIDはmimo-v2.6-pro。

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.6-pro",
"messages": [
{"role": "user", "content": "Summarize the tradeoffs between sparse and dense attention."}
]
}'

OpenAI SDK経由なら、ベースURLだけ変更すればよい:

import os
from openai import OpenAI

client = OpenAI(
api_key=os.environ["FELO_API_KEY"],
base_url="https://openapi.felo.ai/api/v1",
)

completion = client.chat.completions.create(
model="mimo-v2.6-pro",
messages=[{"role": "user", "content": "Explain the tradeoffs between sparse and dense attention."}],
max_tokens=1024,
)
print(completion.choices[0].message.content)

3. ストリーミングを有効化するには、stream: trueを追加する。

curl -N https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "mimo-v2.6-pro",
"stream": true,
"messages": [{"role": "user", "content": "Hello"}]
}'

マルチターン作業の実践的な注意点:これは推論モデルだ。プロトコルやルートが推論制御を公開している場合、返ってきた推論メタデータを保持し、会話継続時に渡すこと。途中で落とすと、推論モデルの品質が低く見える原因となる。

One Felo API key routing to MiMo V2.6 Pro across the Chat Completions, Responses, and Anthropic-compatible Messages endpoints

コスト計算​

MiMo V2.6 Proが価値を発揮する部分。Felo OpenAPIの公開レート(100万トークンあたり):

モデル入力 / M出力 / M
GPT-6 Astra$10.00$50.00
Claude Opus 5.5$4.00$20.00
GPT-6 Sol$2.00$10.00
MiMo V2.6 Pro$0.43$0.87
DeepSeek V4.1 Flash$0.15$0.60
GLM 5.3 Flash$0.15$0.50

これらはFelo OpenAPIの全カタログでの公開レートであり、公平な比較ができる:同じプラットフォーム、同じキー、同じ請求書。MiMo V2.6 Proの価格はXiaomiのリスト価格($0.435入力、$0.87出力)と一致する。ルートはリスト価格でモデルを通している。

現実的なエージェントワークロードで計算してみる。例えば、200,000トークンのリポジトリを読み、20,000トークンの変更を生成し、1日50回実行する場合:

  • 1日あたり入力10Mトークン、出力1Mトークン
  • GPT-6 Astraの場合:$100 + $50 = $150/日
  • Claude Opus 5.5の場合:$40 + $20 = $60/日
  • MiMo V2.6 Proの場合:$4.30 + $0.87 = $5.17/日

同じ作業でGPT-6 Astraより約29倍安価となる。XiaomiはClaude Opus 5やGPT-5.6 Solと同等と主張している。主張はベンダーのものだが、価格は事実だ。主張が2/3でも成立すれば、エージェント運用の経済性が変わる。

節約自体よりも二次的な効果が重要だ。1日$5で済むなら、コンテキストを削って節約する必要がなくなる。退屈な工程で弱いモデルに切り替える必要もなくなる。より大きなプロンプトで再実行できる。多くのエージェント品質問題は、予算問題が原因となっている。

適した用途と適さない用途​

画像、動画、音声のマルチモーダル推論が必要な場合、長いコンテキスト分析が必要な場合、エージェントタスクで大量トークンを消費する場合、動画理解、モデルの挙動を検証したい場合やウェイトをセルフホストしたい場合に適している。

最難度の推論で最高峰を求め、コストが制約でない場合には適さない。 Xiaomi自身が述べている通り、Claude Fable 5.1やGPT-6 Astraが依然として上位にある。高リスクタスクを1日1回だけ実行する場合は、フロンティアモデルを選ぶべきだ。

レイテンシー重視のエンドポイントを切り替える前に期待値を設定してほしい。Feloはこのルートのレイテンシーをdeepと分類している。つまり、回答前に推論する。分析やエージェント計画には適しているが、オートコンプリートやリアルタイムチャットには適さない。高速ティアが適している。

要約すると:品質の大部分を請求額の大部分なしで得たい場合に使うべきモデル。請求額こそが積み重なる。

よくある質問​

MiMo V2.6 ProとMiMo V2.6 Flashは同じものか? 違う。Flashは同リリースの安価・高速版で、現在Felo OpenAPIには未掲載。Proがフラッグシップルート。

どのエンドポイントを呼べばよいか? OpenAI SDKを使っている場合は、Chat Completions(https://openapi.felo.ai/api/v1/chat/completions)を利用する。Claudeスタイルクライアントの場合は、Anthropic互換サーフェス(https://openapi.felo.ai/api)を利用する。Responsesエンドポイントはエージェントやワークフローリクエスト向け。

ツール呼び出しや構造化出力に対応しているか? 対応している。Felo OpenAPIは、このルートで推論、ツール、JSON、ストリーミング、ビジョンをサポート機能として掲載している。ツール定義は互換スキーマに従うため、既存のツール呼び出しコードがそのまま使える。

セルフホストは可能か? オープンウェイトの意義はそこにある。Xiaomiはウェイトと技術レポートを公開しているため、Felo経由でも将来ロックインされることはない。

クローズドフラッグシップと比較すると? Xiaomi自身の説明が公平だ:他のオープンウェイトモデルより上位、Claude Fable 5.1やGPT-6 Astraには及ばない。多くのエージェントベンチマークではClaude Opus 5やGPT-5.6 Solと同等。注目すべきは最後の列:1ドルあたりの能力。

MiMo V2.6 Proを試す​

Felo API Platformからキーを取得し、ベースURLをhttps://openapi.felo.ai/api/v1に設定し、モデルをmimo-v2.6-proに指定して、これまで節約していたワークロードを実行しよう。モデルページには全スペック、最新価格、TypeScript、Python、cURL、Claude Codeのサンプルが掲載されている。

MiMo V2.6 ProをFelo OpenAPIで探す →


この記事は次の言語でもお読みいただけます:English、简体中文、한국어、繁體中文、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。