今月、AIHubMixはチャット、コーディング、音声、画像、3Dの分野で約30の新しいモデルを追加し、メディア生成API、構造化出力修復、3D生成APIなどのプラットフォーム機能をいくつか立ち上げました。単一のAPIキーを通じて利用可能なモダリティの範囲は引き続き拡大しています。以下がハイライトです。
メディア生成APIと統一された非同期タスク
新しいメディア生成エンドポイント/ai/v1/images/generationsと/ai/v1/images/editsが利用可能になり、統一された非同期タスク、結果クエリ、アーティファクトのダウンロード、Webhookコールバックも提供されています。画像と動画のワークフローは同じタスクライフサイクルを通じて統合でき、長時間の生成結果を簡単に追跡できます。生成されたアーティファクトは直接ダウンロードおよびバッチ取得をサポートしています。詳細は非同期タスクを参照してください。
構造化出力修復
新しいキー レベルの構造化出力修復機能が利用可能になりましたが、デフォルトでは無効になっています。有効にすると、構造化JSON出力を宣言する非ストリーミングリクエストに対して、モデルが切り捨て、末尾のカンマ、またはコードブロックラッパーなどの形式エラーを含むJSONを返すと、プラットフォームはそれを自動的に解析可能な有効なJSONに修復して返します。値は変更されず、クライアント側の変更は必要ありません。これは、チャット完了、レスポンス、Claude、およびGeminiプロトコルをサポートし、修復されたレスポンスにはX-JSON-Repaired: trueヘッダーが付加されます。詳細は構造化出力修復を参照してください。
3D生成API
新しい/v1/3d/generations非同期3D生成APIがTencent Hunyuan 3D(hy-3d-3.1)を最初のサポートモデルとして立ち上げました。テキストから3D、画像から3D、およびマルチビュー入力をカバーし、obj、glb、stl、usdz、fbx形式のアーティファクトとPBRマテリアルを提供し、ゲーム、eコマースディスプレイ、3D印刷、製品デザインに適しています。詳細は3D生成APIを参照してください。
公式AIHubMix MCPサーバー
MCPクライアント用の公式ホスティングエントリポイントが稼働中です:mcp.aihubmix.com/mcp(バックアップ:mcp.inferera.com/mcp)。これをClaude Code、Codex、Cursorなどのツールに接続して、モデルや価格を照会し、ドキュメントを検索し、残高を確認し、チャット、画像生成、動画生成ツールを呼び出すことができます。認証情報はリクエストごとにクライアントから渡され、サーバーはAPIキーを保存しません。
Jina検索とウェブリーディング
新しいJina SearchおよびReader機能を使用すると、AIHubMix APIキーを使用して検索結果やウェブページのコンテンツを取得でき、外部情報の取得、ドキュメントの読み取り、エージェントツールの呼び出しに適しています。どちらもPOSTリクエストをサポートし、ReaderはPDF、Word、Excel、PPT、HTML、画像などのローカルファイルのマルチパートアップロードも受け付けます。詳細はJina AIを参照してください。
その他の機能更新
- Qwen TTS音声生成:
qwen-audio-3.0-tts-plusおよびqwen-audio-3.0-tts-flashは/v1/audio/speechを通じて呼び出すことができます。非ストリーミングリクエストは音声結果リンクを返し、ストリーミングリクエストはSSE音声生成イベントを返し、感情タグや自然言語音声指示をサポートします。詳細はTTSを参照してください。 - GPTプロンプトキャッシングのドキュメント: GPT-5.6シリーズから始まり、キャッシュ書き込みは入力価格の1.25倍、キャッシュ読み取りは0.1倍で請求され、キャッシュは少なくとも30分間保持されます。
prompt_cache_keyパラメータの詳細とキャッシュヒットのトラブルシューティングが含まれています。詳細はGPTプロンプトキャッシングを参照してください。 - Veo 3.1画像から動画への変換が最初/最後のフレームと参照画像をサポート: 開始ショットと終了ショット、キャラクター参照、スタイル参照をより正確に制御します。詳細は動画生成を参照してください。
- gpt-5.5以上のツール呼び出しのための自動レスポンスブリッジ:
/v1/chat/completionsを通じてツールとreasoning_effortを使用して送信されたリクエストは、自動的にレスポンス機能を使用し、既存のクライアントに変更なしでより信頼性の高いツール呼び出しを提供します。詳細はレスポンスAPIを参照してください。 - Geminiネイティブエンドポイントが完成:
@google/genaiSDKは、AIHubMixを通じて呼び出す際にネイティブの埋め込み、インタラクション、コンテキストキャッシングをサポートします。詳細はGeminiネイティブSDKを参照してください。 - ストリーミング接続が2時間に拡張: 最大ストリーミング接続時間が1時間から2時間に延長され、長時間の思考や生成タスクが早期に切断される可能性が低くなります。
- Gemini画像パラメータのパススルー: OpenAI互換APIを通じてGemini画像出力モデルを呼び出す際に、
aspectRatioおよびimageSizeをextra_body.generationConfig.imageConfigに渡すことができます。 - プロトコル全体での構造化出力: OpenAI互換の
response_formatとClaudeネイティブのoutput_config.formatは、関連するパスで双方向に適応します。詳細は構造化出力を参照してください。
安定性と修正
- マルチプロトコル互換性の改善: メッセージレスポンスフィールド、思考パラメータ、
stopパラメータ、およびツール呼び出しレスポンス構造が各プロトコルエコシステムにさらに整合されました。 - ストリーミングの信頼性の改善: 一部のモデルに対して切り捨てられたストリーミング出力や空のものとして誤分類されたレスポンスを修正し、クライアントが切断された際の使用記録をより完全にしました。
- キャッシュメーターと請求の正確性の改善により、請求の詳細が実際の使用状況をよりよく反映するようになりました。
- 明確なエラーメッセージ: パラメータ検証の失敗が早期に返され、未知のモデルや枯渇したキーのクォータに対するエラーがより明示的になりました。
今月の新しいモデル(約30件)
チャット / 一般
- claude-opus-5: 1Mのコンテキストウィンドウと128Kの最大出力を持つAnthropicのフラッグシップモデルで、重い推論、コーディング、長期エージェントタスクのために構築されています。
- claude-sonnet-5: チャット、推論、エージェントシナリオ用。
- gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna: OpenAI GPT-5.6シリーズの3つのティアで、それぞれ1,050,000のコンテキストウィンドウ、128Kの最大出力、テキストと画像の入力を持っています。Solはフラッグシップティアで、TerraはGPT-5.5のパフォーマンスを半額で提供し、Lunaはコストに敏感なワークロードをターゲットにしています。
- qwen3.8-max-preview: 最新世代のQwen基盤モデルで、2.4Tのパラメータを持ち、期間限定で90%の割引が適用されます。
- kimi-k3: Moonshot AIのオープンロングコンテキストモデルで、2.8Tのパラメータ、1Mのコンテキストウィンドウ、ネイティブビジョン入力を持っています。詳細はKimi K3ハンズオンガイドを参照してください。
- grok-4.5: 設定可能な推論、ツール呼び出し、500Kのコンテキストを持ち、コード修正やエージェントワークフローに適しています。
- tencent-hy3: Tencent Hunyuan Hy3のGAリリース。MoEアーキテクチャで295Bの合計/21Bのアクティブパラメータ、256Kのコンテキストウィンドウを持ち、Apache 2.0の下でオープンソース化されています。
- gemini-3.6-flash、gemini-3.5-flash-lite、gemini-2.5-flash-lite: Google Flashシリーズの新しいティアです。
- glm-5.2-fast-preview、Qwen3-235B-A22B-Instruct-2507、command-a-plus-05-2026、gemma-4-31b、longcat-2.0。
コーディング
- qwen3-coder-480b-a35b-instruct: コード生成、ソフトウェアエンジニアリングエージェント、ツール呼び出しワークフロー用のQwen3-Coderフラッグシップコードモデルです。
音声
- gpt-audio-1.5: 初の一般提供(GA)OpenAI音声モデルで、音声入力と出力をサポートします。
- gpt-4o-transcribe-diarize: スピーカーダイアライゼーションを伴うASR転写で、転写APIを通じてのみ利用可能です。
- qwen-audio-3.0-tts-plus、qwen-audio-3.0-tts-flash: Qwen音声合成モデル。プラスティアは感情とキャラクターの詳細な制御を提供し、フラッシュティアは初回パケットのレイテンシを200ms未満にします。
画像
- mai-image-2.5-pro: 高忠実度のリアリズムと画像内テキストレンダリングを持つMicrosoftのフラッグシップ画像生成および編集モデルです。mai-image-2.5およびmai-image-2.5-flashも同じシリーズから利用可能です。
- gemini-3.1-flash-lite-image: Googleの画像機能モデルです。
3D
- hy-3d-3.1: Tencent Hunyuan 3Dプロフェッショナルエディションで、テキストから3D、画像から3D、8方向のマルチアングル入力をサポートします。
検索 / 再ランキング
- jina-reranker-v3.5: RAG、検索、構造化データランキング用のJina AIマルチリンガルリストワイズドキュメント再ランキングモデルです。
価格と発表
- GLM-5.2期間限定の時間帯オファー:
glm-5.2は日毎の時間ウィンドウで割引され、UTCで14:00から24:00まで50%オフ、00:00から14:00まで30%オフです。期間限定オファーです。 - Qwen3.8-Max-Previewが90%オフ: 呼び出しは定価の10%で請求され、同じ支出で実質的に10倍の使用が可能です。期間限定、先着順です。
- DeepSeek V4時間帯請求: DeepSeek V4モデルはピークおよびオフピークの請求をサポートします。料金はリクエスト提出時の時間ウィンドウに従い、境界を越えるストリーミングリクエストも提出時の料金が適用されます。
FAQ
今月追加されたモデルはどれですか?
約30件で、チャット(claude-opus-5、claude-sonnet-5、GPT-5.6シリーズ、qwen3.8-max-preview、kimi-k3、grok-4.5、tencent-hy3など)、コーディング(qwen3-coder-480b-a35b-instruct)、音声(gpt-audio-1.5およびqwen-audio-3.0-ttsシリーズ)、画像(mai-image-2.5シリーズ)、3D(hy-3d-3.1)、再ランキング(jina-reranker-v3.5)をカバーしています。
AIHubMix MCPサーバーに接続するにはどうすればよいですか?
MCP対応クライアント(Claude Code、Codex、Cursorなど)にエントリポイントhttps://mcp.aihubmix.com/mcpを追加します。認証情報はリクエストごとにクライアントから渡されます。その後、モデルや価格を照会し、ドキュメントを検索し、残高を確認し、チャット、画像生成、動画生成ツールを呼び出すことができます。
メディア生成APIは何をサポートしていますか?/ai/v1/images/generationsおよび/ai/v1/images/editsを通じて画像生成および編集リクエストを送信し、統一された非同期タスクAPIを使用してステータスを照会し、アーティファクトをダウンロードし、Webhookコールバックを受け取ります。詳細は非同期タスクを参照してください。
Qwen3.8-Max-Previewの期間限定オファーとは何ですか?
呼び出しは定価の10%で請求され、同じ支出で実質的に10倍の使用が可能です。期間限定、先着順です。
すべてのモデルはモデルギャラリーで閲覧でき、統合の詳細はドキュメントで確認できます。
更新日: 2026-07-31