Xiaomi MiMo v2.6 ProをAIHubMixで使用する方法:セットアップガイド

AIHubMix約 6 分で読めます
Xiaomi MiMo v2.6 ProをAIHubMixで使用する方法:セットアップガイド

要するに: 公式の openai Python SDKを https://aihubmix.com/v1 に向け、モデルIDを mimo-v2.6-pro に設定し、AIHubMixキーで認証します。APIはOpenAI互換(OpenAIと同じ形式で呼び出し可能)なので、特別なクライアントは必要ありません。セットアップには約5分かかります。

主なポイント

  • OpenAI互換API — base_urlを変更するだけで、他は不要
  • 有料 mimo-v2.6-pro · 無料 xiaomi-mimo-v2.6-pro-free [1] [2]
  • $0.48/M 入力 · $0.96/M 出力 [1]
  • 無料プラン 5リクエスト/分 · 100/日 · 1Mトークン/日 [2]
  • コンテキスト 1.05Mトークン · 最大出力 131Kトークン [1]
  • 要件:Python 3.9以上、AIHubMix APIキー

参考値

ベースURLhttps://aihubmix.com/v1
プロトコルOpenAIチャット完了
有料モデルIDmimo-v2.6-pro
無料モデルIDxiaomi-mimo-v2.6-pro-free
料金(有料)$0.48/M入力 · $0.96/M出力 · $0.0038/Mキャッシュ読み取り [1]
無料プランの制限5 req/min · 100 req/day · 1Mトークン/日 [2]
コンテキストウィンドウ1.05Mトークン [1]
最大出力131Kトークン [1]
入力モダリティテキスト、視覚、音声、ビデオ — テキスト出力のみ [1]
リストされた機能ストリーミング、ツール呼び出し、構造化出力、プロンプトキャッシング [1]

v2.6 Proを使用すべきか、それともv2.5 Proか?

v2.6 Proを使用してください。同じ価格で、より多くの種類の入力を受け付けます。

mimo-v2.5-promimo-v2.6-pro
入力テキストのみ [5]テキスト、視覚、音声、ビデオ [1]
価格(入出力)$0.48/M · $0.96/M [5]$0.48/M · $0.96/M [1]
コンテキスト / 最大出力1.05M · 131K [5]1.05M · 131K [1]
利用可能性2026年10月21日引退予定 [5]現在 [1]

Xiaomiのリリースノートによると、V2.6は「V2.5シリーズと同じAPI料金を採用している」とされ、V2.6-Proは人工分析知能指数で46ポイントを獲得しています — 執筆時点でのオープンソーススコアのトップで、Kimi K3やQwen3.8 Maxを上回り、Claude Fable 5.1やGPT-6 Astraの下に位置しています [4]。ノートの中で最も明確な世代間の違いは、より安価なモデルについてです:V2.6-Flash は「MiMo-V2.5-Proを包括的に上回っている」とされています [4]。

覚えておくべきことが2つあります。Xiaomiは直接のV2.6-Pro対V2.5-Proのベンチマーク表を公開していないため、上記の比較は仕様と価格に基づいています。また、mimo-v2.5-pro は2026年10月21日に引退予定で、mimo-v2.6-pro が移行先として指定されています [5]。したがって、v2.5に基づいて構築された新しいものは、ほぼすぐに移行する必要があります。

なぜAIHubMixなのか

  • 変更するのは base_urlだけです。 ゲートウェイはOpenAIチャット完了形式を使用しているため、公式SDKは変更なしで動作します。Anthropic形式の /v1/messages (ベータ)やネイティブGemini呼び出しも同じキーで利用可能です [6]。
  • 1つのキーで多くのベンダーをカバーします。 GET /v1/models はセットアップ当日に416のモデルIDを返し、そのうち21がMiMoのバリエーションでした [3]。モデルを変更するには、スクリプト内の1つの文字列を変更するだけです。
  • 最初に無料でテストできます。 xiaomi-mimo-v2.6-pro-free は5リクエスト/分、100/日、1Mトークン/日で$0です [2] — セットアップが機能することを証明するのに十分です。
  • サブスクリプションはありません。 請求は従量課金制で、会員費や月額料金はありません [6]。有料MiMoの料金は、モデルページでの$0.48/M入力と$0.96/M出力に一致します [1]。
  • デバッグが速い。 呼び出しが失敗した場合、同じスクリプトを別のベンダーのモデルに向けます。そこで成功すれば、キー、URL、リクエストの形式は正しく、問題はモデルにあります — 1回の呼び出しで済み、午後を無駄にすることはありません。

セットアップ方法

1. プロジェクトを作成する

mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"

2. キーを保存する

printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore

スクリプト内にキーをハードコーディングせず、.env をコミットしないでください。

3. クライアントを作成する

 chat.py として保存します:

import os
import sys

from dotenv import load_dotenv
from openai import OpenAI

load_dotenv()

client = OpenAI(
    api_key=os.environ["AIHUBMIX_API_KEY"],
    base_url="https://aihubmix.com/v1",
)

prompt = sys.argv[1] if len(sys.argv) > 1 else "自己紹介を1文でしてください。"

stream = client.chat.completions.create(
    model="mimo-v2.6-pro",
    messages=[{"role": "user", "content": prompt}],
    max_tokens=1024,
    stream=True,
)

for chunk in stream:
    if not chunk.choices:
        continue
    piece = chunk.choices[0].delta.content
    if piece:
        print(piece, end="", flush=True)
print()

ループ内に両方のチェックを保持してください。一部のチャンクは空の choices 配列で到着し、インデックス指定すると IndexError が発生します。また、最初と最後のフレームで delta.content が None の場合、 print はリテラルテキスト None として出力されます。

4. 実行する

.venv/bin/python chat.py "自己紹介を1文でしてください。"
私はMiMoです。XiaomiのLLMコアチームによって開発された大規模言語モデルで、質問に答えたり、執筆したり、さまざまな役立つタスクを支援するためにここにいます。

最初のトークンが出るまでに約6秒かかることを期待してください。モデルページに記載されている6.4秒に対して [1]。

5. 必要に応じて調整する

ストリーミング呼び出しでない場合は、 stream=True を削除し、 response.choices[0].message.content を読み取ります。モデルを切り替えるには、 model 引数を変更します。より長い出力のために max_tokens を増やします — 上記のデフォルトの1024はモデルの制限を大きく下回っています [1]。

チェックリスト

  • [ ] 仮想環境が作成され、 openai と python-dotenv がインストールされている
  • [ ] .env に実際のキーが含まれ、 chmod 600 が適用されている
  • [ ] .env が .gitignore にリストされている
  • [ ] base_url が https://aihubmix.com/v1 である —  /v1 が必要です
  • [ ] モデルIDが mimo-v2.6-pro (有料)または xiaomi-mimo-v2.6-pro-free (無料)である
  • [ ] ストリーミングループが chunk.choices と delta.content をガードしている
  • [ ] テスト呼び出しがテキストを返す

FAQ

APIは本当にOpenAI互換ですか? はい — 標準のチャット完了です。任意のOpenAI互換クライアントは、ベースURLを https://aihubmix.com/v1 に設定し、AIHubMixキーをベアラートークンとして渡すことで動作します。AIHubMixのドキュメントでは、 coding-xiaomi-mimo-v2.6-flash がOpenAI互換形式のみをサポートしていると記載されています [3]。

どのモデルIDを使用すべきですか? mimo-v2.6-pro は有料、 xiaomi-mimo-v2.6-pro-free は無料です。2つのティアは異なる命名規則を使用しており — 無料バリアントは xiaomi- プレフィックスを持ち、有料のものは持たないため、間違えやすいです。

他にどのようなバリエーションがありますか? mimo-v2.6-pro-ultraspeed 、 mimo-v2.6-flash 、 mimo-v2.5-pro 、および coding-tuned IDs(例: coding-xiaomi-mimo-v2.6-pro)があります [3]。APIからリストを取得します:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
    if 'mimo' in i: print(i)
"

私は 429 を受け取ります — それは何を意味しますか? メッセージによりますが、2つのケースは逆の処理が必要です。「プロバイダーによって制限されています」は、1分あたりのスロットルです:待って再試行してください。「無料モデルのクォータの上限に達しました」は、アカウントの無料クォータが枯渇しており、無料モデル間で共有されています — 再試行しても役に立たないため、 mimo-v2.6-pro に切り替えてください。

私は 400 を受け取ります 「現在は提供できません」。 まず、APIに対してIDを確認してください:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"

それが True を印刷した場合、curlでチャット呼び出しを繰り返し、 "code": "no_available_channel" を探します。それはモデルがリストされているが、その瞬間に上流のキャパシティがないことを意味します — これはプロバイダー側の条件であり、ローカルの変更では修正できません。待つか、応答からリクエストIDを持ってAIHubMixサポートに連絡してください。

問題が私のものかプロバイダーのものかをどうやって判断できますか? 同じキーとスクリプトで別のベンダーのモデルを呼び出します — 例えば gpt-4o-mini です。成功すれば、キー、ベースURL、リクエスト形式は正しく、問題はその特定のモデルにあります。失敗すれば、キーと請求を確認してください。

なぜ出力が文の途中で切れるのですか? それは max_tokens に達したためであり、モデルの制限ではありません。これを上げてください。

アカウントのステータスを確認するにはどうすればよいですか?

curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY"

 has_payment_method と制限フィールドを確認してください。

次のステップ

上記のスクリプトは、動作する基盤です。MiMo v2.6 Proのリストされた機能には、ツール呼び出し、構造化出力、視覚および音声入力、プロンプトキャッシング [1] が含まれています — すべて同じOpenAI互換インターフェースを通じて行われるため、クライアントの拡張は主に標準パラメータを追加することに関するものです。無料プランから始めてセットアップを確認し、その後モデルIDを mimo-v2.6-pro に切り替えて通常使用してください。


出典