今月、AIHubMixはチャット、コード、ビデオ、画像にわたる約20の新モデルを追加し、いくつかのプラットフォーム機能を提供しました。同じAPIキーでさらに多くのモデルにアクセスできるようになりました。以下が主なハイライトです。
LLM Router
モデル名をautoに設定すると、ゲートウェイがリクエストに基づいてプラットフォーム上の数百のモデルの中から最適なモデルを選択します。コスト優先、品質優先、または低遅延戦略に基づき、実際にヒットしたモデルに対して請求されます。手動での比較やモデルの切り替えは不要で、クライアントコードの変更もありません。詳細はLLM Routerをご覧ください。
レスポンスプロトコルの任意のモデル
/v1/responsesエンドポイントはもはやGPTファミリーに限定されておらず、プラットフォーム上の任意のモデルを呼び出すことができます。レスポンスプロトコルに基づいて構築されたツール(Codex CLIなど)は、OpenAIの公式モデルに制限されることなく、GLM、Gemini、DeepSeek、Kimi、Qwenなどをローカルモデルカタログ経由で使用できます。詳細はCodex CLI · カスタムモデルをご覧ください。
モデルマッピング&フォールバック
コンソールでAPIキーごとにエイリアスマッピングとフォールバックを設定できます。クライアントは任意のモデル名を使用でき、ゲートウェイが実際のターゲットモデルに書き換えます。プライマリが失敗した場合、自動的にバックアップに切り替わり、最終的に応答したモデルに対して請求されます。単一の障害でプロダクショントラフィックが落ちることはなく、クライアントコードはそのままです。詳細はモデルマッピング&フォールバックをご覧ください。
AIHubMix CLI
依存関係ゼロの単一バイナリ:Python、Node、またはGoは不要です。ターミナルから直接残高を照会し、APIキーを管理し、利用可能なモデルをリスト表示できます。スクリプトやClaude CodeのようなAIエージェントに対しても一級のサポートがあります。詳細はAIHubMix CLIをご覧ください。
AIHubMix Skill(AIコーディングエージェント用拡張機能)
スキルをサポートするAIエージェント用のローカル拡張機能(Codex、Claude Code、Cursor、Clineなど)。自然言語を使用してAIHubMixを統合し、モデルを照会し、機能で選択し、例を生成し、エラーをトラブルシューティングできます。Skillは、AIHubMixの公式APIからライブモデル、価格、プロトコル情報をオンデマンドで読み取るため、エージェントは古いバンドルモデルリストに依存することはありません。詳細はスキルをご覧ください。
バックアップドメイン: api.inferera.com
メインドメインaihubmix.comにアクセスできない場合やタイムアウトした場合は、リクエストをhttps://api.inferera.comに向けてください。エンドポイントと機能は同一で、APIキー、モデル、リクエストボディは変更されません。
その他のリリース
- Geminiオーディオ入力: OpenAI互換のエンドポイント(
/v1/chat/completions)がinput_audioを受け入れ、使用量にaudio_tokensを返します。 - GLM 5.2推論努力: ネイティブZhipuチャネルが
reasoning_effortをサポートし、思考の深さを調整できます。 - Open Design統合: AIHubMixは現在、Open Designのための組み込みBYOKゲートウェイです。
- OpenClawプラグイン修正: aihubmix-authが修正され、安定して使用できます。
安定性と修正
- 請求精度とキャッシュメータリング精度が向上しました。
/v1/modelsでのモデルの欠落が修正されました。- いくつかのビデオ生成およびチャネルテストの問題が修正されました。
今月の新モデル(約20)
チャット / 一般
- claude-fable-5 [引退]: Claudeの最新世代で、より強力な安全ガードレールを備えています(詳細はChangelog · Fable 5ノートをご覧ください)。
- minimax-m3、qwen3.7-plus、glm-5.2、およびDoubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo。
コード
- kimi-k2.7-codeおよびkimi-k2.7-code-highspeed: Kimiのコードシリーズ、高速バリアントを含みます。
- coding-glm-5.2および無料のcoding-glm-5.2-free。
ビデオ
- Kling: テキストからビデオ、画像からビデオ、複数画像参照、およびオムニマルチモーダル生成。
- happyhorse-1.1: テキストからビデオ(t2v)、参照(r2v)、および画像からビデオ(i2v)。
画像
- Baidu musesteamer-air-imageによる画像生成。
その他の新モデル
- grok-build-0.1、hy3-preview、および無料のstep-3.7-flash-free。
価格と通知
- step-3.7-flash、90%オフ(期間限定): $0.022 / M入力トークン、$0.132 / M出力トークン。
- 廃止と自動ルーティング:
claude-opus-4-20250514およびclaude-sonnet-4-20250514は、モデルプロバイダーによって6月15日に引退され、プラットフォームは同じファミリーの4-5バージョンに自動ルーティングします。
FAQ
今月追加されたモデルはどれですか?
約20のモデルで、チャット(claude-fable-5 [引退]、minimax-m3、qwen3.7-plus、glm-5.2、doubao-seed-2-1シリーズ)、コード(kimi-k2.7-codeシリーズ、coding-glm-5.2)、ビデオ(Kling、happyhorse-1.1)、および画像(musesteamer-air-image)を含みます。
LLM Routerをどのように使用しますか?
リクエストのモデル名をautoに設定します。ゲートウェイがリクエストに基づいて最適なモデルを選択し、実際にヒットしたモデルに対して請求します。クライアントコードの変更は不要です。詳細はLLM Routerをご覧ください。
メインドメインにアクセスできない場合はどうなりますか?
リクエストアドレスをバックアップドメインhttps://api.inferera.comに置き換えます。エンドポイントと機能は同一で、パラメータを変更する必要はありません。
step-3.7-flashの期間限定価格は何ですか?
$0.022 / M入力トークンおよび$0.132 / M出力トークンです。
すべてのモデルはモデルカタログで閲覧でき、統合の詳細はドキュメントで確認できます。
更新日: 2026-06-30