2026年6月发布亮点:约20个新模型

2026年7月31日 · AIHubMix · 3 min read · 更新日志

2026年6月发布亮点:约20个新模型

本月,AIHubMix在聊天、代码、视频和图像领域新增了约20个新模型,并推出了多个平台功能。现在同一个API密钥可以访问更多内容。以下是亮点。

LLM路由器

将模型名称设置为auto,网关会根据您的请求,从平台上的数百个模型中选择最佳模型,采用成本优先、质量优先或低延迟策略,按实际命中的模型计费。无需手动比较或切换模型,也无需更改客户端代码。请参见LLM路由器

响应协议上的任何模型

/v1/responses端点不再仅限于GPT系列:现在可以调用平台上的任何模型。基于响应协议构建的工具(如Codex CLI)因此可以通过本地模型目录使用GLM、Gemini、DeepSeek、Kimi、Qwen等,而不再局限于OpenAI的官方模型。请参见Codex CLI · 自定义模型

模型映射与回退

在控制台中为每个API密钥配置别名映射和失败回退:您的客户端可以使用任何模型名称,网关会将其重写为真实目标模型;如果主模型失败,会自动切换到备份模型,按最终响应的模型计费。一次小故障不会影响您的生产流量,客户端代码保持不变。请参见模型映射与回退

AIHubMix CLI

一个单一的二进制文件,无需任何依赖:不需要Python、Node或Go。可以直接从终端查询余额、管理API密钥和列出可用模型,支持脚本和AI代理(如Claude Code)。请参见AIHubMix CLI

AIHubMix技能(AI编码代理的扩展)

一个本地扩展,支持技能(Codex、Claude Code、Cursor、Cline等)的AI代理。使用自然语言集成AIHubMix,查询模型,按能力选择,生成示例并排除错误。该技能按需从AIHubMix的官方API读取实时模型、定价和协议信息,因此代理从不依赖过时的捆绑模型列表。请参见技能

备份域名:api.inferera.com

当主域名aihubmix.com无法访问或超时时,请将请求指向https://api.inferera.com。端点和功能完全相同:您的API密钥、模型和请求体无需更改。

还发布了

  • Gemini音频输入:与OpenAI兼容的端点(/v1/chat/completions)现在接受input_audio并返回使用中的audio_tokens。
  • GLM 5.2推理努力:本地Zhipu通道支持reasoning_effort以调整思维深度。
  • Open Design集成:AIHubMix现在是Open Design的内置BYOK网关。
  • OpenClaw插件修复aihubmix-auth已修复并稳定可用。

稳定性与修复

  • 改进了计费精度和缓存计量准确性。
  • 修复了/v1/models中缺失的模型。
  • 修复了多个视频生成和通道测试问题。

本月新模型(约20个)

聊天 / 通用

  • claude-fable-5 [已退役]:Claude的最新版本,具有更强的安全防护(请参见更新日志 · Fable 5说明)。
  • minimax-m3qwen3.7-plusglm-5.2和Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo

代码

  • kimi-k2.7-codekimi-k2.7-code-highspeed:Kimi的代码系列,包括高速度变体。
  • coding-glm-5.2和免费的coding-glm-5.2-free

视频

  • Kling:文本到视频、图像到视频、多图像参考和全方位多模态生成。
  • happyhorse-1.1:文本到视频(t2v)、参考(r2v)和图像到视频(i2v)。

图像

  • 百度musesteamer-air-image用于图像生成。

还有新模型

  • grok-build-0.1hy3-preview和免费的step-3.7-flash-free

定价与通知

  • step-3.7-flash,限时90%折扣:$0.022 / M输入令牌,$0.132 / M输出令牌。
  • 弃用与自动路由claude-opus-4-20250514claude-sonnet-4-20250514于6月15日被模型提供者退役;平台自动将其路由到同系列的4-5版本。

常见问题

本月新增了哪些模型?
约20个,涵盖聊天(claude-fable-5 [已退役]、minimax-m3、qwen3.7-plus、glm-5.2、doubao-seed-2-1系列)、代码(kimi-k2.7-code系列、coding-glm-5.2)、视频(Kling、happyhorse-1.1)和图像(musesteamer-air-image)。

如何使用LLM路由器?
在请求中将模型名称设置为auto;网关会根据您的请求选择最佳模型,并按实际命中的模型计费,无需更改客户端代码。请参见LLM路由器

如果主域名无法访问怎么办?
将请求地址替换为备份域名https://api.inferera.com。端点和功能完全相同,无需更改参数。

step-3.7-flash的限时价格是多少?
$0.022 / M输入令牌和$0.132 / M输出令牌。

浏览所有模型,请访问模型目录,并在文档中查找集成详情。


更新日期:2026-06-30

More from the blog