Xiaomi MiMo V2.5 OpenRouter API
もしXiaomi MiMo V2.5 OpenRouter モデル IDをお探しなら、それは次のとおりです。
xiaomi/mimo-v2.5
MiMo V2.5 は、モデル ID だけが示す以上に興味深いモデルです。
Xiaomi は、これをネイティブなオムニモーダルモデルとして設計し、テキスト、画像、動画、音声を理解できるほか、1M トークンのコンテキストウィンドウ、ツール呼び出し、構造化出力、Web 検索、コンテキストキャッシュも備えています。
開発者にとって、この組み合わせは、MiMo V2.5 をマルチモーダルエージェントや長文コンテキストアプリケーションに特に適したものにしています。
Xiaomi MiMo V2.5 OpenRouter モデル ID
OpenRouterのモデルIDは次のとおりです。
xiaomi/mimo-v2.5
OpenRouterは現在、MiMo V2.5を約 105万トークンのコンテキスト。
すでにOpenRouterを利用している場合、基本的なテキストリクエストは次のようになります。
from openai import OpenAI
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key="YOUR_OPENROUTER_API_KEY"
)
response = client.chat.completions.create(
model="xiaomi/mimo-v2.5",
messages=[
{
"role": "user",
"content": "Explain the architecture of this application."
}
]
)
print(response.choices[0].message.content)
マルチモーダル入力の正確な形式は、使用するAPIプロトコルとエンドポイントによって異なるため、画像、音声、動画を送信する前にプロバイダーのドキュメントを確認してください。
Xiaomi MiMo V2.5の料金
Xiaomiは自社のAPIを通じてMiMo V2.5も提供しています。
現在の海外向け従量課金の料金は次のとおりです。
| 利用形態 | 1Mトークンあたりの料金 |
|---|---|
| キャッシュ済み入力 | $0.0028 |
| 非キャッシュ入力 | $0.14 |
| 出力 | $0.28 |
Xiaomiは記載しています 1Mトークンのコンテキストウィンドウ、128Kの最大出力、100 RPM、および10M TPMは自社のMiMo V2.5 API向けです。
これらのレート制限はXiaomiのAPIを対象としており、すべてのサードパーティプロバイダーに自動的に適用されるものと想定すべきではありません。
OpenRouterでのMiMo V2.5の料金はいくらですか?
OpenRouterの料金は、複数の推論プロバイダーがモデルを提供できるため、異なる場合があります。
OpenRouterのメインとなるMiMo V2.5モデルページには、現在、割引後の代表価格としておよそ次の金額が表示されています。
$0.119 / 1M 入力トークン
$0.238 / 1M 出力トークン
ただし、OpenRouterのプロバイダー別料金ページでは、バックエンドによって異なる料金が表示されます。
たとえば、Xiaomiルートの料金は次のとおりです。
$0.14 / 1M 入力
$0.28 / 1M 出力
$0.0028 / 1M キャッシュリード
一方、他のプロバイダーは、高めまたは低めの料金を設定する場合があります。
このため、API料金の比較には、検索結果に表示された数値だけでなく、実際のプロバイダールートを使用する必要があります。
Xiaomi MiMo V2.5 APIは無料ですか?
標準のMiMo V2.5 APIは恒久的に無料ではありません。
Xiaomiは現在、このモデルの従量課金を公開しています。したがって、本番アプリケーションでは通常のトークン料金が発生すると想定してください。
以下のようなケースに遭遇する可能性があります:
- トライアルクレジット
- 一時的なプロモーション
- サードパーティ割引
- 開発者向けキャンペーン
- 限定無料枠
ただし、これらは恒久的な価格設定ではなく、一時的なアクセスとして扱うべきです。
この区別は特に重要です。Xiaomiは現在、一部のMiMo TTSモデルを一時的に無料としてリストアップしています。それは決して主要なmimo-v2.5言語モデルが無料であるという意味ではありません。
したがって、無料のXiaomi MiMo APIを探しているなら、最も安全な答えは次のとおりです。
MiMo V2.5は有料のAPIモデルですが、プラットフォームによっては一時的な無料クレジットやプロモーションアクセスが利用できる場合があります。
MiMo V2.5が際立つ理由
MiMo V2.5は、1つのモデルにすべてが揃うことが珍しい4つの機能を兼ね備えています:
- 1Mトークンのコンテキスト
- ネイティブ対応のマルチモーダル理解
- ツール呼び出し
- 非常に低い公式トークン価格
それぞれが異なる理由で重要です。
1Mコンテキストウィンドウ
Xiaomiは公式に次のように記載しています:
コンテキスト長:1Mトークン
最大出力:128Kトークン
大きなコンテキストウィンドウは、以下のような用途に役立ちます:
- コードリポジトリ全体
- 大規模な技術文書
- 長い会話履歴
- エージェントのメモリ
- 研究コレクション
- 長い動画またはマルチモーダルコンテキスト
主な利点は、単に巨大なプロンプトを送信できることではありません。
エージェントアプリケーションでは、コンテキストにユーザー指示、中間結果、ツール呼び出し、ドキュメント、以前のアクションが徐々に蓄積される場合があります。
コンテキストウィンドウが大きいほど、モデルはその状態を保持する余地が広がります。
MiMo V2.5はネイティブなマルチモーダルです。
これは、MiMo V2.5と多くのテキスト優先LLMとの最大の違いの1つです。
Xiaomiは次の入力モダリティを挙げています:
テキスト
画像
動画
音声
テキスト出力を伴います。
これにより、次のようなユースケースが生まれます:
- スクリーンショットの理解
- 画像分析
- 動画要約
- 音声理解
- ビジュアル文書解析
- マルチモーダルエージェント
例えば、エージェントは画像を調べ、その内容を理解し、次に何をすべきかを推論し、ツールを呼び出すことができます。
これは、入力タイプごとに独立した別々のモデルを持つよりも有用です。
MiMo V2.5はツール呼び出しに対応していますか?
はい。
Xiaomiは公式にツール呼び出しをMiMo V2.5の機能の1つとして挙げています。
典型的な関数スキーマは次のようになります。
{
"type": "function",
"name": "get_order_status",
"description": "Get the current status of an order",
"parameters": {
"type": "object",
"properties": {
"order_id": {
"type": "string"
}
},
"required": ["order_id"]
}
}
その後、モデルはこの関数が必要だと判断し、適切な引数を生成して、構造化されたツールリクエストを返すことができます。
アプリケーションは実際の関数を実行し、その結果をモデルに返します。
マルチモーダルエージェント向け MiMo V2.5
マルチモーダル理解とツールの組み合わせは、MiMo V2.5が特に興味深くなる点です。
サポートエージェントを考えてみましょう。
ユーザーが注文の問題が表示されたスクリーンショットをアップロードし、次のように尋ねます。
注文がキャンセルされたのはなぜですか?
ワークフローは次のようになります。
ユーザーがスクリーンショットをアップロード
↓
MiMo V2.5 がスクリーンショットを理解
↓
注文情報を抽出
↓
get_order_status() を呼び出し
↓
ライブ注文データを受信
↓
ユーザーに問題を説明
これは単純なチャットボットとは根本的に異なります。
モデルは知覚し、推論し、行動する必要があります。
それはまさにMiMo V2.5の機能セットが適している種類のワークフローです。
MiMo V2.5 vs MiMo V2.5 Pro
Xiaomiは現在、以下の両方を提供しています:
mimo-v2.5
mimo-v2.5-pro
標準のMiMo V2.5は、ネイティブのオムニモーダルモデルです。
MiMo V2.5 Proは、複雑で長時間実行されるエージェントタスクに向けて、より積極的に位置づけられています。Xiaomiは、Proモデルが非常に多数のツール呼び出しを含む安定した長期ワークフローを実行できると説明しています。
価格も異なります:
| モデル | 入力 | 出力 |
|---|---|---|
| MiMo V2.5 | $0.14/M | $0.28/M |
| MiMo V2.5 Pro | $0.435/M | $0.87/M |
選択 MiMo V2.5 重視する場合:
- マルチモーダル入力
- 低コスト
- 長いコンテキスト
- 汎用エージェントワークフロー
選択 MiMo V2.5 Pro 優先する場合:
- より複雑なエージェントタスク
- より長い自律実行
- より高度なソフトウェアエンジニアリングのワークフロー
Xiaomi Direct と OpenRouter、どちらを使うべき?
アーキテクチャ次第です。
Xiaomi Direct API
ダイレクトアクセスが適しているのは、以下の場合です:
- MiMo がスタックの中核モデルである
- Xiaomi のネイティブ機能を利用したい
- 直接課金を利用したい
- 公式の料金体系を利用したい
OpenRouter
OpenRouter が適しているケース:
- すでに OpenRouter を利用している
- 他の OpenRouter モデルと一緒に MiMo を利用したい
- OpenRouter API を単一の統合で利用したい
統合マルチモデルゲートウェイ
3つ目のケース:
必ずしも Xiaomi を中心に構築したいとは限らない または OpenRouter。
アプリケーションを1つの共通APIレイヤーに依存させ、基盤となるモデルは変更可能にしたい。
そこで役立つのが、TokenHubのようなプラットフォームです。
マルチモデルアプリケーションでのTokenHubの利用
TokenHubは、OpenAI API形式と互換性のあるRESTful APIを提供し、複数の主要なモデルプロバイダーを1つのゲートウェイで利用できるようにします。
OpenAI互換のベースURLは次のとおりです。
https://us-api.tokenhub.com/v1
一般的なアプリケーションでは、次の構造をそのまま使用できます。
from openai import OpenAI
client = OpenAI(
base_url="https://us-api.tokenhub.com/v1",
api_key="YOUR_TOKENHUB_API_KEY"
)
response = client.chat.completions.create(
model="MODEL_ID",
messages=[
{
"role": "user",
"content": "Analyze this task."
}
]
)
その後、TokenHubの現在のモデルカタログからモデルを選択します。
これは、バックエンド全体を単一のプロバイダー向けに設計するのではなく、MiMoの機能を他のモデルと比較したい場合に役立ちます。
現在のモデル提供状況と正確なモデルIDは、必ずTokenHubのライブカタログで確認してください。
MiMo V2.5と他の中国製LLMの比較
MiMo V2.5は、競争が激化する中国のLLM市場に参戦しています。
ワークロードによっては、以下も試してみてください。
GLM
長期的なエンジニアリングおよびコーディングに強みを持ち、1Mクラスのコンテキストを備えたモデルを提供します。
Qwen
コーディング、推論、エージェント、マルチモーダルワークロードをカバーする幅広いモデルファミリー。
DeepSeek
推論、コーディング、価格重視のAPIワークロードで頻繁に評価されています。
MiniMax
特に、コーディングエージェントや長時間実行されるツールワークフローに関連します。
適切な選択は実際のワークロードによって異なります。
ベンチマークスコアを見ても、モデルが自身のツールを確実に呼び出せるか、画像を理解できるか、エージェントループ全体でコンテキストを維持できるか、レイテンシ目標を達成できるかはわかりません。
代表的な本番タスクでモデルをテストしてください。
よくある質問
Xiaomi MiMo V2.5 OpenRouterのモデルIDは何ですか?
モデルID:
xiaomi/mimo-v2.5
MiMo V2.5の料金はいくらですか?
Xiaomiの現在の海外API価格は $0.14/M 未キャッシュ入力トークン と $0.28/M 出力トークン。 キャッシュ入力は$0.0028/Mです。
MiMo V2.5は無料ですか?
標準APIは有料です。一時的なトライアルやプロモーションクレジットが存在する場合もありますが、それらは恒久的な価格ではありません。
MiMo V2.5は1Mコンテキストに対応していますか?
はい。Xiaomiは公式に1Mトークンのコンテキストウィンドウと128Kの最大出力を記載しています。
MiMo V2.5は画像に対応していますか?
はい。テキスト、画像、動画、音声入力をネイティブでサポートしています。
MiMo V2.5はツール呼び出しに対応していますか?
はい。ツール呼び出しは正式にサポートされています。
単一モデルに縛られない構築
MiMo V2.5は、次のような場合に検討する価値があります: 長いコンテキスト、マルチモーダル入力、ツール呼び出し、低トークンコスト を同一モデルで必要とすることです。
しかし、今日の最良のモデルが6か月後の最良のモデルとは限りません。
TokenHubは、対応するAIモデル向けにOpenAI互換のAPIゲートウェイを1つ提供することで、新しいプロバイダーごとにインテグレーションを作り直すことなく、モデルの比較や切り替えが容易になります。