2026年7月版本亮點:~30個新模型和媒體API

2026年7月31日 · AIHubMix · 6 min read · 變更紀錄

2026年7月版本亮點:~30個新模型和媒體API

本月,AIHubMix在聊天、編碼、音頻、圖像和3D領域新增了近30個新模型,並推出了幾個平台功能,包括媒體生成API、結構化輸出修復和3D生成API。通過單一API密鑰可用的模式範圍持續擴展。以下是亮點。

媒體生成API和統一的異步任務

新的媒體生成端點/ai/v1/images/generations/ai/v1/images/edits現在可用,還有統一的異步任務、結果查詢、工件下載和Webhook回調。圖像和視頻工作流程可以通過相同的任務生命周期進行整合,使跟踪長時間生成結果變得簡單。生成的工件支持直接下載和批量檢索。請參見異步任務

結構化輸出修復

現在提供一個新的鍵級結構化輸出修復功能,默認為禁用。一旦啟用,對於聲明結構化JSON輸出的非流式請求,當模型返回格式錯誤的JSON(例如截斷、尾隨逗號或代碼塊包裝)時,平台會自動將其修復為可解析的有效JSON再返回。值保持不變,無需客戶端更改。它支持聊天完成、響應、Claude和Gemini協議,修復的響應攜帶X-JSON-Repaired: true標頭。請參見結構化輸出修復

3D生成API

新的/v1/3d/generations異步3D生成API以騰訊混元3D(hy-3d-3.1)作為首個支持的模型。它涵蓋文本到3D、圖像到3D和多視角輸入,生成的工件格式包括obj、glb、stl、usdz和fbx,並支持PBR材料,適合遊戲、電子商務展示、3D打印和產品設計。請參見3D生成API

官方AIHubMix MCP伺服器

官方的MCP客戶端入口點現在已經上線:mcp.aihubmix.com/mcp(備份:mcp.inferera.com/mcp)。在Claude Code、Codex、Cursor和其他工具中連接它以查詢模型和價格、搜索文檔、檢查餘額,並調用聊天、圖像生成和視頻生成工具。憑證由客戶端每次請求傳遞,伺服器不存儲API密鑰。

Jina搜索和網頁閱讀

新的Jina搜索和閱讀器功能讓您可以使用AIHubMix API密鑰檢索搜索結果和網頁內容,適合外部信息檢索、文檔閱讀和代理工具調用。兩者都支持POST請求,閱讀器還接受本地文件的多部分上傳,如PDF、Word、Excel、PPT、HTML和圖像。請參見Jina AI

其他功能更新

  • Qwen TTS音頻生成qwen-audio-3.0-tts-plusqwen-audio-3.0-tts-flash可以通過/v1/audio/speech調用。非流式請求返回音頻結果鏈接,流式請求返回SSE音頻生成事件,支持情感標籤和自然語言語音指令。請參見TTS
  • GPT提示緩存文檔:從GPT-5.6系列開始,緩存寫入按1.25倍的輸入價格計費,緩存讀取按0.1倍計費,且緩存至少保留30分鐘。包括prompt_cache_key參數詳細信息和緩存命中故障排除。請參見GPT提示緩存
  • Veo 3.1圖像到視頻支持首/末幀和參考圖像:更精確地控制開場和結尾鏡頭、角色參考和風格參考。請參見視頻生成
  • 自動響應橋接gpt-5.5及以上工具調用:通過/v1/chat/completions發送的請求,帶有工具和reasoning_effort自動使用響應功能,讓現有客戶在不進行任何更改的情況下獲得更可靠的工具調用。請參見響應API
  • Gemini原生端點完成@google/genai SDK現在支持通過AIHubMix調用的原生嵌入、交互和上下文緩存。請參見Gemini原生SDK
  • 流式連接延長至2小時:最大流式連接時間已從1小時延長至2小時,因此長時間思考和長時間生成任務不太可能被提前中斷。
  • Gemini圖像參數透傳:通過OpenAI兼容API調用Gemini圖像輸出模型時,可以在extra_body.generationConfig.imageConfig中傳遞aspectRatioimageSize
  • 跨協議的結構化輸出:OpenAI兼容的response_format和Claude原生的output_config.format現在在相關路徑上雙向適應。請參見結構化輸出

穩定性和修復

  • 多協議兼容性改進:消息響應字段、思考參數、stop參數和工具調用響應結構進一步與每個協議生態系統對齊。
  • 流式可靠性改進:修復了某些模型的流式輸出截斷和響應被錯誤分類為空的問題,並在客戶斷開連接時提供更完整的使用記錄。
  • 緩存計量和計費準確性改進,使計費細節更好地反映實際使用情況。
  • 更清晰的錯誤消息:參數驗證失敗會更早返回,對於未知模型和用盡的密鑰配額的錯誤更為明確。

本月新模型(近30個)

聊天 / 一般

  • claude-opus-5:Anthropic旗艦模型,具有1M上下文窗口和128K最大輸出,專為重度推理、編碼和長期代理任務而設計。
  • claude-sonnet-5:適用於聊天、推理和代理場景。
  • gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna:OpenAI GPT-5.6系列的三個層級,每個層級具有1,050,000上下文窗口、128K最大輸出,以及文本和圖像輸入。Sol是旗艦層級,Terra的性能與GPT-5.5相當,價格僅為一半,而Luna則針對成本敏感的工作負載。
  • qwen3.8-max-preview:最新一代的Qwen基礎模型,具有2.4T參數,限時提供90%的折扣。
  • kimi-k3:Moonshot AI開放的長上下文模型,具有2.8T參數、1M上下文窗口和原生視覺輸入。請參見Kimi K3實操指南
  • grok-4.5:可配置的推理、工具調用和500K上下文,適合代碼修復和代理工作流程。
  • tencent-hy3:騰訊混元Hy3的GA版本。MoE架構,總計295B / 21B活躍參數,256K上下文窗口,根據Apache 2.0開源。
  • gemini-3.6-flashgemini-3.5-flash-litegemini-2.5-flash-lite:Google Flash系列的新層級。
  • glm-5.2-fast-previewQwen3-235B-A22B-Instruct-2507command-a-plus-05-2026gemma-4-31blongcat-2.0

編碼

  • qwen3-coder-480b-a35b-instruct:Qwen3-Coder旗艦代碼模型,用於代碼生成、軟件工程代理和工具調用工作流程。

音頻

  • gpt-audio-1.5:首個普遍可用(GA)的OpenAI音頻模型,支持音頻輸入和輸出。
  • gpt-4o-transcribe-diarize:ASR轉錄,帶有說話者區分,僅通過轉錄API提供。
  • qwen-audio-3.0-tts-plusqwen-audio-3.0-tts-flash:Qwen語音合成模型。Plus層級提供對情感和角色的細緻控制,Flash層級的首包延遲低於200毫秒。

圖像

  • mai-image-2.5-pro:微軟旗艦圖像生成和編輯模型,具有高保真度的真實感和圖像內文本渲染。mai-image-2.5mai-image-2.5-flash來自同一系列也已上線。
  • gemini-3.1-flash-lite-image:Google圖像能力模型。

3D

  • hy-3d-3.1:騰訊混元3D專業版,支持文本到3D、圖像到3D和八視角多角度輸入。

檢索 / 重新排序

  • jina-reranker-v3.5:Jina AI多語言列表文檔重新排序器,用於RAG、搜索和結構化數據排名。

定價和公告

  • GLM-5.2限時時段優惠glm-5.2按每日時間窗口折扣,UTC時間:每天14:00至24:00折扣50%,00:00至14:00折扣30%。限時優惠。
  • Qwen3.8-Max-Preview九折優惠:調用按列表價格的10%計費,實際上以相同支出獲得10倍的使用量。限時,先到先得。
  • DeepSeek V4時段計費:DeepSeek V4模型支持高峰和非高峰計費。收費遵循請求提交時間的時間窗口,跨越邊界的流式請求也按提交時間計費。

常見問題

本月新增了哪些模型?
近30個,涵蓋聊天(claude-opus-5、claude-sonnet-5、GPT-5.6系列、qwen3.8-max-preview、kimi-k3、grok-4.5、tencent-hy3等)、編碼(qwen3-coder-480b-a35b-instruct)、音頻(gpt-audio-1.5和qwen-audio-3.0-tts系列)、圖像(mai-image-2.5系列)、3D(hy-3d-3.1)和重新排序(jina-reranker-v3.5)。

我該如何連接到AIHubMix MCP伺服器?
在任何支持MCP的客戶端(Claude Code、Codex、Cursor等)中添加入口點https://mcp.aihubmix.com/mcp。憑證由客戶端每次請求傳遞。然後,您可以查詢模型和價格、搜索文檔、檢查餘額,並調用聊天、圖像生成和視頻生成工具。

媒體生成API支持什麼?
通過/ai/v1/images/generations/ai/v1/images/edits提交圖像生成和編輯請求,然後使用統一的異步任務API查詢狀態、下載工件並接收Webhook回調。請參見異步任務

什麼是Qwen3.8-Max-Preview限時優惠?
調用按列表價格的10%計費,實際上以相同支出獲得10倍的使用量。限時,先到先得。

瀏覽模型畫廊中的所有模型,並在文檔中查找集成詳細信息。


更新日期:2026-07-31

More from the blog