TabbitBlog

MiMo-V2.6-Pro 料金解説:公式価格表、キャッシュ効果、タスク別コスト試算

MiMo-V2.6-Pro の料金体系を実務的に解説:公式 API 料金、プロンプトキャッシュの経済性、思考トークンの影響、UltraSpeed モード、業務別予算シミュレーション。

この記事の内容
  1. 主要なポイント
  2. MiMo-V2.6-Pro 料金一覧
  3. 決定的な指標:100万トークンあたり0.0036ドルのキャッシュ読み取り
  4. 公式発表の「コスト削減」を読み解く
  5. メイン表以外の請求項目
  6. モデルファミリーの比較と選び方
  7. 課金されない境界と発生する費用
  8. 開発コミュニティの実践的な声
  9. 2つの実務タスクにおけるコスト試算
  10. シナリオ1:単発のバグ改修タスク(短いプロンプト、高密度な思考)
  11. シナリオ2:長文調査エージェント(巨大な文脈、高いキャッシュヒット率)
  12. Tabbit Browser でエージェント業務を実行する
  13. 参照情報

トークンの単価表示だけでは、エンジニアリングの課題を解決する総コストは見えてきません。それは原材料の一つの価格に過ぎないからです。2026年9月22日に Xiaomi が発表した公式料金表によると、フラッグシップモデル MiMo-V2.6-Pro未キャッシュ入力が100万トークンあたり0.435ドル(3.00元)、出力が0.87ドル(6.00元)となっています。一見すると、オープンウェイト市場における典型的な低価格設定に見えます。

しかし、実際の運用コストを左右するのは別の2つの要素です。1つはキャッシュヒット入力を100万トークンあたり0.0036ドル(0.025元)まで引き下げる120倍(99.17%引き)のプロンプトキャッシュ、もう1つは最大131,072トークンに達する広大な出力枠です。強化学習(RL)モデルが解答に至るまでに長い思考を展開すると、出力トークン数が急増して請求の大半を占めることがあります。本ガイドは、公式価格表を現場で役立つ予算試算へと翻訳します。スペック詳細については MiMo-V2.6-Pro モデル詳細 (English) をご覧ください。

主要なポイント

  • 基本料金は入力0.435ドル、出力0.87ドル/1Mトークンであり、欧米の大手フロンティアモデルの20分の1から60分の1の安価さです。

  • プロンプトキャッシュによる120倍のコスト削減効果:一致する接頭辞は0.0036ドル/1Mトークンとなり、多往復エージェントループが実用的な費用で稼働します。

  • UltraSpeed は正確に10倍のプレミアム価格mimo-v2.6-pro-ultraspeed は対話用途で最大20倍の生成速度を誇る一方、入力4.35ドル、出力8.70ドルに跳ね上がります。

  • 思考トークンは出力としてカウント:内部の推論ステップも0.87ドル/1Mトークンの出力枠で計算されるため、難問では入力の数倍の出力コストが発生します。

  • 旧 V2.5 世代は2026年10月21日に廃止mimo-2-5-pro-apimimo-2-5-pro-preset を使用している既存システムは早急に V2.6 への移行予算を組む必要があります。

MiMo-V2.6-Pro 料金一覧

以下の表は、2026年9月22日時点の Xiaomi MiMo 公式ドキュメント に基づく公式価格です。表記はすべて100万(1M)トークン単位です。

モデル名入力(キャッシュヒット)/ 1M入力(キャッシュ未ヒット)/ 1M出力 / 1Mコンテキスト長最大出力枠
MiMo-V2.6-Pro$0.0036 (¥0.025)$0.435 (¥3.00)$0.87 (¥6.00)1,048,576131,072
MiMo-V2.6-Flash$0.0028 (¥0.020)$0.140 (¥1.00)$0.28 (¥2.00)1,048,576131,072
MiMo-V2.6-Pro-UltraSpeed$0.0360 (¥0.250)$4.350 (¥30.00)$8.70 (¥60.00)1,048,576131,072
MiMo-V2.5-Pro(旧世代)$0.435 (¥3.00)$0.87 (¥6.00)1,048,5768,192

基本入力0.435ドルと出力0.87ドルは旧世代 V2.5 と同等ですが、V2.6 では0.0036ドルのキャッシュ読み取り層が新設され、出力上限が8kから128kへと拡大されています。旧 V2.5 は2026年10月21日に正式提供終了となります。

決定的な指標:100万トークンあたり0.0036ドルのキャッシュ読み取り

予算計画において最も強力な武器となるのが100万トークンあたり0.0036ドル(0.025元)という数字です。これは通常入力と比較して 99.17% のコスト削減を意味します。

自律エージェントの現場では、1回限りの呼び出しで終わる処理は稀です。エージェントによる深層推論ワークフロー では、Web ページの調査、ツール呼び出し、自己修正を15〜30往復繰り返します。キャッシュなしで50万トークンのコンテキストを20回再送すると、入力だけで1000万トークン(4.35ドル)を消費します。しかしプロンプトキャッシュを有効にすれば、この20往復の入力費はわずか0.036ドルに抑えられます。

さらにモデルファミリー内で興味深いのは、Pro のキャッシュ単価が Flash とほぼ同額である点です(0.0036ドル vs 0.0028ドル)。キャッシュヒット率が85%を超える実務システムでは、1兆パラメータ級の巨大 MoE モデルである Pro を、軽量な MiMo-V2.6-Flash (English) とほぼ変わらない入力費用で稼働させることが可能です。

公式発表の「コスト削減」を読み解く

Xiaomi は MiMo-V2.6-Pro について「欧米先端モデルの20分の1から60分の1のコスト」とアピールしています。Claude Opus の出力75ドルや GPT-5.6 の15ドルと比較すれば数値通りの計算ですが、現場運用では以下の2点に留意すべきです。

  1. 思考トークンによる出力の肥大化:大規模強化学習を経た MiMo-V2.6-Pro は、回答前に高度な思考ステップを実行します。500トークンの最終コードを出力するために、15,000〜30,000トークンの思考を消費することがあります。思考トークンは0.87ドル/1Mの標準出力レートで課金されるため、入力が短くても1回あたり0.026ドルを超えるケースが生じます。

  2. キャッシュ接頭辞の整合性要件:自動キャッシュはプロンプト接頭辞の完全一致に依存します。システムプロンプトの先頭に可変タイムスタンプや動的リクエスト ID を付与してしまうと、毎回キャッシュミスとなり全額0.435ドルが課金されます。

1リクエストあたりの計算式は以下の通りです:

1回あたりの費用 = (未キャッシュ入力 × $0.435
                + キャッシュ入力 × $0.0036
                + 思考を含む総出力 × $0.87) ÷ 1,000,000
月間予算 = (平均リクエスト費用 × 想定実行回数) × 再試行係数

メイン表以外の請求項目

全体費用を正確に把握するには、関連するオプション仕様の理解が欠かせません:

  • UltraSpeed モード(10倍の価格)mimo-v2.6-pro-ultraspeed は音声対話やリアルタイムチャット専用に設計され、最大20倍の生成速度を誇ります。ただし、価格も一律10倍(入力4.35ドル、出力8.70ドル)に設定されています。バッチ処理を誤ってこのエンドポイントに向けると予算が激増します。

  • Token Plan 月額サブスクリプション:開発者向けに人民元建ての月額パッケージが提供されています:

    • Lite(39元/月):個人の検証や軽微な自動化向け。

    • Standard(99元/月):日常的な開発補助向け。

    • Pro(329元/月):高い同時実行数と容量を備えたプロ開発向け。

    • Max(659元/月):重負荷のパイプラインやチーム共有向け。

  • レート制限と同時実行数:従量課金 API には RPM(毎分リクエスト数)および TPM(毎分トークン数)の制限が設けられており、大規模システムでは枠の事前調整が必要です。

モデルファミリーの比較と選び方

モデル階層最適なユースケース入力 / 1M(ミス / ヒット)出力 / 1Mレイテンシ特性
MiMo-V2.6-Pro高度なコーディング、複数ターンの推論、ブラウザエージェント$0.435 / $0.0036$0.87推論深度と処理速度のバランス型
MiMo-V2.6-Flash大量テキストの分類、フィルタリング、軽量なデータ抽出$0.140 / $0.0028$0.28高速かつ省リソース
MiMo-V2.6-Pro-UltraSpeedリアルタイム音声エージェント、即時応答チャット$4.350 / $0.0360$8.70極めて高速(最大20倍速)

選定方針は明快です。単純な抽出や大量分類には MiMo-V2.6-Flash を充て、深い思考が求められるエンジニアリングには MiMo-V2.6-Pro を標準機として採用します。そして人間が直接待つリアルタイム UI にのみ UltraSpeed を検討します。競合モデルとの違いについては、2026年 AI ブラウザ比較Kimi K3 の料金検証 も参考にしてください。

課金されない境界と発生する費用

請求ミスを防ぐため、何が無料枠で何が課金対象かを把握しておく必要があります:

  • 基本期間内のキャッシュ保管料は不要:100万トークン時間ごとに保管料(Google の0.50ドルなど)を課す事業者とは異なり、Xiaomi MiMo はキャッシュ読み取り時の従量課金のみで運用可能です。

  • 安全フィルターによる遮断は不課金:プラットフォームのセーフティガードによって遮断されたリクエストに対し、生成予定トークンの課金は行われません。

  • 思考トークンは無料ではない:思考モードを無料機能と誤認するケースがありますが、すべて出力として通常課金されます。

  • エージェントの失敗やループも全額課金:エージェントが迷走して無駄なツール呼び出しを繰り返した場合でも、消費されたトークンは全額請求されます。

開発コミュニティの実践的な声

開発者コミュニティで共有されている知見は、モデルの実力と実務上の注意点を浮き彫りにしています:

Next.js の原子タスク修復に関する Reddit ユーザー u/Illustrious-Many-782 の投稿
u/Illustrious-Many-782(Reddit):Next.js の不具合改修タスクにおいて、MiMo は優れた費用対効果を実証。個人の開発テストによる結果。
思考トークン消費に関する Reddit ユーザー u/latent_vector の投稿
u/latent_vector(r/LocalLLaMA):高度な推論タスクでは思考トークンが大幅に増えるため、出力がコストの大半を占める。
多往復キャッシュの経済性に関する Hacker News ユーザー alexp_dev の投稿
alexp_dev(Hacker News):99.17%のキャッシュ値引きにより、20往復以上の長文エージェント処理が現実的な予算で実現可能に。
UltraSpeed の価格設定に関する Hacker News ユーザー cloud_arch の投稿
cloud_arch(Hacker News):UltraSpeed は対話の遅延を解消するが、10倍の価格設定により欧米の先端モデルと同等のコスト帯になる。

これらの知見は、表面的なベンチマーク順位よりも、完成タスクごとの実質的な所要コストでモデルを選ぶ重要性を教えてくれます。

2つの実務タスクにおけるコスト試算

2026年時点の公式ドル建て料金を適用し、代表的な2つの業務シナリオを試算します:

シナリオ1:単発のバグ改修タスク(短いプロンプト、高密度な思考)

  • 入力:25,000未キャッシュトークン(コードベースと不具合内容)、キャッシュ率0%。

  • 出力:3,500トークン(思考2,500トークン、修正コード1,000トークン)。

  • 計算(25,000 × $0.435 + 3,500 × $0.87) ÷ 1,000,000 = $0.010875 + $0.003045 = $0.01392(約2円)。

  • 月間1,000タスク13.92ドル(約2,100円)。再試行係数1.2を見込んでも 16.70ドル(約2,500円)です。

シナリオ2:長文調査エージェント(巨大な文脈、高いキャッシュヒット率)

  • 入力:15回のツール実行で累計800,000トークン、キャッシュ率92%(736,000キャッシュ、64,000新規)。

  • 出力:12,000トークン(調査手順とレポート出力)。

  • 計算(64,000 × $0.435 + 736,000 × $0.0036 + 12,000 × $0.87) ÷ 1,000,000 = $0.02784 + $0.00265 + $0.01044 = $0.04093(約6円)。

  • 月間200タスク8.19ドル(約1,200円)。キャッシュがない場合は同じ業務に 71.60ドル を要し、8.7倍以上の格差が生じます。

業務シナリオ入力トークンキャッシュ率出力トークン月間回数月間トークン費用(USD)
単発バグ改修25,0000%3,5001,000$13.92
多往復調査エージェント800,00092%12,000200$8.19

ローカル計算

月間トークン費用を見積もる

2026年9月確認の公式API料金。思考トークンは出力に含めて一度だけ計算します。入力はブラウザ内でのみ処理されます。

MiMo-V2.6-Pro$0.0519 / タスク$10.38 /
MiMo-V2.6-Flash$0.0174 / タスク$3.47 /
MiMo-V2.6-Pro-UltraSpeed$0.5190 / タスク$103.80 /

ツール呼び出しや再試行は含みません。ProとFlashのキャッシュ読み取りは100万トークンあたり$0.0036と$0.0028です。確認日:2026-09-22。 最新料金を確認

上記の計算ツールはお手元のブラウザ内で完結して計算を行い、外部サーバーへの通信は一切発生しません。数値を変えて各モデルの費用感を比較してください。

Tabbit Browser でエージェント業務を実行する

API コールを試算した後は、エージェントを実際に稼働させるクライアント環境が必要です。Web データの収集や複数タブの比較調査を行うたびにスクリプトを一から組み上げるのは大きな開発負担となります。

Tabbit Browser は、Web 画面上で直接自律エージェントを動かし、表データの自動抽出や調査情報の集約を行える AI ネイティブブラウザです。最新動向に関心がある方は、エージェント型ブラウザとは何か2026年のおすすめ AI ブラウザ も併せてご確認ください。

公式規定の通り、Tabbit 内での特定モデルの利用可否はアカウントごとのモデル選択機能と契約条件に準じます。Tabbit は外部 API の請求を代行するものではありませんが、ブラウザを活用した調査作業に極めて高い生産性を提供します。

Tabbit Browser

参照情報

本記事の数値および仕様は、2026年9月22日に確認した公式技術発表に基づいています:

よくある質問

MiMo-V2.6-Pro の公式 API 利用料金はいくらですか?

公式料金表によると、MiMo-V2.6-Pro は未キャッシュ入力が100万トークンあたり0.435ドル(3.00人民元)、キャッシュヒット入力が0.0036ドル(0.025人民元)、出力が0.87ドル(6.00人民元)です。

MiMo-V2.6-Pro のプロンプトキャッシュでどれくらい安くなりますか?

キャッシュヒット時の入力単価は100万トークンあたり0.0036ドルとなり、通常入力の0.435ドルと比較して約120分の1(99.17%オフ)に削減されます。

モデル内部の思考・推論トークンは別料金ですか?

いいえ、別途の請求項目はありません。Xiaomi MiMo では思考プロセスで消費されたトークンも生成テキストと合算され、標準出力料金(100万トークンあたり0.87ドル)として計算されます。

MiMo-V2.6-Pro-UltraSpeed とは何ですか?なぜ10倍の料金なのですか?

UltraSpeed はリアルタイム対話向けに最大20倍の生成速度を提供する高速版です。その代わり、入力・出力料金ともに通常版の正確に10倍(入力4.35ドル、出力8.70ドル)に設定されています。

Xiaomi の Token Plan サブスクリプションと従量課金 API の違いは何ですか?

Token Plan は月額定額の割り当てプラン(Lite 39元、Standard 99元、Pro 329元、Max 659元/月)であり、100万トークン単位で利用分のみ後払いする従量課金 API とは別体系です。

Tabbit Browser 内で MiMo-V2.6-Pro を利用できますか?

Tabbit Browser は Web 調査やエージェント操作のための作業環境を提供します。モデルの利用可否はアカウントごとのモデル選択機能および規約に準拠します。

次のステップへ

Tabbit と一緒に仕事をしましょう。

タブをまたいで調査し、繰り返しのブラウザ作業を自動化し、あらゆる文脈を手の届くところに。