2026年6月版本亮點:~20個新模型

2026年7月31日 · AIHubMix · 3 min read · 變更紀錄

2026年6月版本亮點:~20個新模型

本月AIHubMix在聊天、代碼、視頻和圖像領域新增了約20個新模型,並推出了幾項平台功能。現在同一API密鑰可以訪問更多模型。以下是亮點。

LLM路由器

將模型名稱設置為 auto,網關根據您的請求從平台上的數百個模型中選擇最佳模型,並根據成本優先、質量優先或低延遲策略進行計費,按實際命中的模型計費。無需手動比較或切換模型,也無需更改客戶端代碼。請參見 LLM路由器

響應協議上的任何模型

/v1/responses 端點不再僅限於GPT系列:現在可以調用平台上的任何模型。基於響應協議構建的工具(如Codex CLI)因此可以通過本地模型目錄使用GLM、Gemini、DeepSeek、Kimi、Qwen等,而不再受限於OpenAI的官方模型。請參見 Codex CLI · 自定義模型

模型映射與回退

在控制台中為每個API密鑰配置別名映射和失敗回退:您的客戶端可以使用任何模型名稱,網關將其重寫為實際目標模型;如果主要模型失敗,則會自動切換到備用模型,按最終響應的模型計費。單次故障不會影響您的生產流量,客戶端代碼保持不變。請參見 模型映射與回退

AIHubMix CLI

一個不需要任何依賴的單一二進制文件:無需Python、Node或Go。直接從終端查詢您的餘額、管理API密鑰和列出可用模型,並對腳本和AI代理(如Claude Code)提供一流支持。請參見 AIHubMix CLI

AIHubMix技能(AI編碼代理的擴展)

支持技能(Codex、Claude Code、Cursor、Cline等)的AI代理本地擴展。使用自然語言集成AIHubMix,查詢模型,按能力選擇,生成示例並排除錯誤。該技能按需從AIHubMix的官方API讀取實時模型、定價和協議信息,因此代理不會依賴過時的捆綁模型列表。請參見 技能

備用域名:api.inferera.com

當主域名 aihubmix.com 無法訪問或超時時,請將請求指向 https://api.inferera.com。端點和功能相同:您的API密鑰、模型和請求主體不變。

還有其他更新

  • Gemini音頻輸入:與OpenAI兼容的端點(/v1/chat/completions)現在接受 input_audio 並返回使用中的audio_tokens。
  • GLM 5.2推理努力:本地Zhipu通道支持 reasoning_effort 以調整思考深度。
  • Open Design集成:AIHubMix現在是 Open Design 的內置BYOK網關。
  • OpenClaw插件修復aihubmix-auth 現在已修復並穩定可用。

穩定性與修復

  • 改進了計費精度和緩存計量準確性。
  • 修復了 /v1/models 中缺失的模型。
  • 修復了幾個視頻生成和通道測試問題。

本月新模型(約20個)

聊天 / 一般

  • claude-fable-5 [已退役]:Claude的最新一代,具有更強的安全防護(請參見 變更日誌 · Fable 5 註釋)。
  • minimax-m3qwen3.7-plusglm-5.2,以及Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo

代碼

  • kimi-k2.7-codekimi-k2.7-code-highspeed:Kimi的代碼系列,包括一個高速變體。
  • coding-glm-5.2 和免費的 coding-glm-5.2-free

視頻

  • Kling:文本到視頻、圖像到視頻、多圖像參考和全方位多模態生成。
  • happyhorse-1.1:文本到視頻(t2v)、參考(r2v)和圖像到視頻(i2v)。

圖像

  • Baidu musesteamer-air-image 用於圖像生成。

還有其他新模型

  • grok-build-0.1hy3-preview,以及免費的 step-3.7-flash-free

定價與通知

  • step-3.7-flash,限時90%折扣:$0.022 / M 輸入標記,$0.132 / M 輸出標記。
  • 棄用與自動路由claude-opus-4-20250514claude-sonnet-4-20250514 於6月15日被模型提供者退役;平台自動將其路由到同系列的4-5版本。

常見問題

本月新增了哪些模型?
約20個,涵蓋聊天(claude-fable-5 [已退役]、minimax-m3、qwen3.7-plus、glm-5.2、doubao-seed-2-1系列)、代碼(kimi-k2.7-code系列、coding-glm-5.2)、視頻(Kling、happyhorse-1.1)和圖像(musesteamer-air-image)。

如何使用LLM路由器?
在請求中將模型名稱設置為 auto;網關根據您的請求選擇最佳模型,並按實際命中的模型計費,無需更改客戶端代碼。請參見 LLM路由器

如果主域名無法訪問怎麼辦?
將請求地址替換為備用域名 https://api.inferera.com。端點和功能相同,無需更改任何參數。

step-3.7-flash的限時價格是多少?
$0.022 / M 輸入標記和 $0.132 / M 輸出標記。

模型目錄 瀏覽所有模型,並在 文檔 中查找集成詳情。


更新日期:2026-06-30

More from the blog