シャオミMiMo-V2-Pro:ルールを書き換えるフラッグシップAIエージェント頭脳

2026年3月19日読了時間12分

AI業界を揺るがした真夜中のローンチ

まさにシャオミらしい——大胆で、速く、遠慮のない——スタイルで、 同社は2026年3月19日の深夜、1つでも2つでもなく3つの真新しいAIモデルを一斉に発表したMiMo-V2-ProMiMo-V2-Omni、そしてMiMo-V2-TTSだ。三本柱の中のフラッグシップであるMiMo-V2-Proこそが、今みんなが話題にしているものだ。 そしてそれには十分な理由がある。

MiMo-V2-Proとは何か?

MiMo-V2-Proは、シャオミの実世界のエージェント的ワークロード向けに構築された フラッグシップ基盤モデルである。クイズに答えたり見栄えのいいデモを生成したりするために 設計されたのではなく、タスクを完遂するために工学された ものだ:複雑なワークフローの統率、本番エンジニアリングの推進、 そして人間の介入なしに信頼性を持って結果を提供すること。

これをエージェントシステムの頭脳だと考えれば いい——計画を立て、推論し、ツールを呼び出し、驚くほどの安定性で 長く多段階のワークフローを実行できる頭脳だ。

前作のオープンウェイトモデルであるMiMo-V2-Flash(総パラメータ 309B / アクティブ15B、MITライセンス、Intelligence Index:41) からの大幅なアップグレードである。注目すべきは、MiMo-V2-Proの重みはまだ公開されていない点だ ——現在はシャオミの公式APIを通じてのみ利用可能である。

主なスペックの概要

  • 総パラメータ数:1兆(1T)超
  • アクティブパラメータ数:420億(MiMo-V2-Flashの約3倍)
  • アーキテクチャ:7:1の比率のハイブリッドアテンション (Flashの5:1からアップグレード)
  • コンテキストウィンドウ:最大100万トークン
  • モダリティ:テキスト入力・テキスト出力のみ (マルチモーダル非対応)
  • マルチトークン予測(MTP):高速生成のための軽量レイヤー

「Hunter Alpha」の謎——発表前からすでに話題

公式発表の1週間前、世界最大のAPIアグリゲーションプラットフォームで ある OpenRouterに、「Hunter Alpha」という コードネームの匿名モデルが静かに掲載された。宣伝も、プレス リリースもなかった。

呼び出し件数は着実に増加し、Hunter Alphaは複数日にわたり日次チャートの1位を獲得、そして合計利用トークン数1兆を超えた——それが シャオミのモデルだと誰も知らないうちに、この状況が起きたのだ。 この種の自発的でコミュニティ主導の評価は、どんなベンチマーク スコアよりも意味があると言えるかもしれない。

実際のフィードバックに基づく1週間の継続的な改善を経て、 MiMo-V2-Proは長文コンテキスト能力とエージェントシナリオにおける 安定性を大幅に改善して発表された。

ベンチマーク性能:世界8位、巨人たちに挟まれる

世界で最も評価が高い独立系モデル評価フレームワークの一つであるArtificial Analysis Intelligence Indexによると、MiMo-V2-Proは49点を獲得し、世界8位中国系LLMの中では2位に位置している。

ランキングの文脈:

モデルIntelligence Index スコア
GLM-5(Reasoning)50
MiMo-V2-Pro49
GPT-5.2 Codex(xhigh)49
Grok 4.20 Beta(Reasoning)48
Kimi K2.5(Reasoning)47
Qwen3.5 397B A17B(Reasoning)45
MiMo-V2-Flash(Reasoning)41

MiMo-V2-ProはGLM-5のすぐ後ろに位置し、Kimi K2.5、Qwen3.5、Grok 4.20 Betaより上位——確固たる世界トップ10に入っている。

エージェントベンチマーク(シャオミ公式)

ベンチマークMiMo-V2-ProClaude Sonnet 4.6Claude Opus 4.6
PinchBench84.086.986.3
ClawEval61.566.366.3

深掘り:MiMo-V2-Proが真に輝く場所

エージェント的な実世界の作業(GDPval-AA)

MiMo-V2-Proは、実世界のエージェント的作業タスクを測定するベンチ マークであるGDPval-AAでEloレーティング1426を 記録し、同等クラスのモデル群を先導している。GLM-5 Reasoning (1406)、Kimi K2.5 Reasoning(1283)、Qwen3.5 397B(1209)を 上回る。参考までに、GPT-5.4(xhigh)とClaude Sonnet 4.6 (max effort)はそれぞれ1667と1633だ。

低いハルシネーション率(AA-Omniscience)

MiMo-V2-ProはAA-Omniscience Indexで+5を記録し、 際立って低いハルシネーション率が原動力となっている——GLM-5 Reasoning(+2)、Kimi K2.5 Reasoning(-8)、Qwen3.5 397B (-30)を上回る。Claude Opus 4.6(+14)とGemini 3.1 Pro Preview(+33)はこのカテゴリでなお先を行っている。

トークン効率

MiMo-V2-Proは同等クラスの中で最もトークン効率が高い。 Intelligence Indexの全評価を完了するために使用したのはわずか7,700万出力トークン——GLM-5 Reasoning(1億900万) やKimi K2.5 Reasoning(8,900万)よりも大幅に少ない。これは 実際の運用コストにとって非常に大きな意味を持つ。

価格:わずかなコストでフロンティア級のインテリジェンス

MiMo-V2-ProのAPI価格はClaude Sonnet 4.6のわずか5分の1でありながら、多くのエージェント的シナリオにおいて同等以上の 性能を発揮する。

コンテキスト範囲入力出力
256Kトークンまで$1 / 100万トークン$3 / 100万トークン
100万トークンまで$2 / 100万トークン$6 / 100万トークン

Artificial Analysis Intelligence Indexの全評価を実行するのにMiMo-V2-Proはわずか$348で済んだ——GPT-5.2 (xhigh)の$2,304、Claude Opus 4.6(max effort)の$2,486と比較すると 対照的だ。Intelligence IndexでGLM-5よりわずか1点低いスコア にもかかわらず、GLM-5より運用コストが低い。 ここでのコストパフォーマンスは非常に高い。

エージェントの時代のために構築——コーディングからClawまで

MiMo-V2-Proはエージェント的シナリオに深く最適化 されており、複雑で多様なエージェントの足場においてSFTとRLで 訓練されている。オープンソースコミュニティで急速に支持を 広げている汎用エージェントフレームワーク、OpenClawのネイティブ頭脳である。

主なエージェント能力:

  • 人間の介入なしに複雑なワークフローを統率
  • 多段階タスクをまたぐ長期的な計画立案
  • 大幅に改善された安定性と正確性を持つ精密なツール呼び出し
  • 高負荷の実世界アプリケーションフローを処理する100万トークンのコンテキスト
  • フロントエンド開発:OpenClaw内で単一の クエリで洗練された完全に機能するウェブページを生成

さらに、5つの主要なエージェント開発フレームワーク——OpenClaw、OpenCode、KiloCode、Blackbox、Cline——と提携し、 世界中の開発者向けに1週間の無料API利用を提供している。

すでに複数のプラットフォームに展開済み

MiMo-V2-Proは単なる研究モデルではない——すでに広範な エコシステムで稼働している。発表時点で:

  • Xiaomi MiClaw(シャオミ自社のエージェント プラットフォーム)
  • MiMo Studio
  • Kingsoft WebOffice(Word、Excel、PPT、PDF ——WPSエコシステム全体)
  • Xiaomi ブラウザ
  • OpenClaw、OpenCode、KiloCode、Blackbox、Cline経由でアクセス可能

私の見解:これはシャオミの最も本気のAI宣言だ

MiMo-V2-Proは、シャオミが世界的なAIフロンティアの議論に 加わることを宣言するものだ。 高速な追随者としてでも、格安の代替品としてでもなく、GLM-5と Kimi K2.5の間に位置する、世界の知能ランキングにおける本物の トップ10プレーヤーとしてだ。

「Hunter Alpha」というステルスローンチ戦略は巧妙で、多くを 物語っていた。OpenRouterでこのモデルを匿名のまま実力で 証明させることで——チャートの1位を獲得し、1兆トークンの 利用を超えることで——シャオミはマーケティングよりも先に プロダクト自身に語らせた。それは自信の証だ。

1兆パラメータ規模、100万トークンのコンテキスト、 エージェント優先の設計、世界トップ10のランキング、同等クラス 最高水準のハルシネーション耐性、優れたトークン効率、そして 完全なインテリジェンスベンチマークの実行にわずか$348という 破壊的な価格(Claude Opus 4.6の$2,486に対して)の組み合わせは、 軽視するのが本当に難しいパッケージを作り出している。AI競争は もはや米国の二社間だけの争いではない。シャオミがそれを 証明したのだ。

自社のスタックのためにAIエージェントやMiMoを検討中ですか?

MiMoやOpenClawからClaude、GPTまで、ワークフローに最適な モデルの選定と導入をお手伝いします。戦略と実装の サポートについては、ぜひご相談ください。