简而言之: 将官方 openai Python SDK指向 https://aihubmix.com/v1,使用模型ID mimo-v2.6-pro,并使用您的AIHubMix密钥进行身份验证。该API与OpenAI兼容(以与OpenAI相同的格式可调用),因此不需要特殊客户端。设置大约需要五分钟。
关键点
- OpenAI兼容API — 只需更改
base_url,其他无需更改 - 付费
mimo-v2.6-pro· 免费xiaomi-mimo-v2.6-pro-free[1] [2] - $0.48/M 输入 · $0.96/M 输出 [1]
- 免费层 每分钟5个请求 · 每天100个请求 · 每天1M令牌 [2]
- 上下文 1.05M令牌 · 最大输出 131K令牌 [1]
- 要求:Python 3.9+,AIHubMix API密钥
参考值
| 基础URL | https://aihubmix.com/v1 |
| 协议 | OpenAI聊天完成 |
| 付费模型ID | mimo-v2.6-pro |
| 免费模型ID | xiaomi-mimo-v2.6-pro-free |
| 定价(付费) | $0.48/M输入 · $0.96/M输出 · $0.0038/M缓存读取 [1] |
| 免费层限制 | 每分钟5个请求 · 每天100个请求 · 每天1M令牌 [2] |
| 上下文窗口 | 1.05M令牌 [1] |
| 最大输出 | 131K令牌 [1] |
| 输入方式 | 文本、视觉、音频、视频 — 仅文本输出 [1] |
| 列出的功能 | 流式传输、工具调用、结构化输出、提示缓存 [1] |
您应该使用v2.6 Pro还是v2.5 Pro?
使用v2.6 Pro。它的价格相同,并且接受更多种类的输入。
mimo-v2.5-pro | mimo-v2.6-pro | |
|---|---|---|
| 输入 | 仅文本 [5] | 文本、视觉、音频、视频 [1] |
| 价格(输入/输出) | $0.48/M · $0.96/M [5] | $0.48/M · $0.96/M [1] |
| 上下文/最大输出 | 1.05M · 131K [5] | 1.05M · 131K [1] |
| 可用性 | 于2026年10月21日退役 [5] | 当前 [1] |
小米的发布说明表示V2.6“采用与V2.5系列相同的API定价”,并给V2.6-Pro在人工分析智能指数上打了46分——在撰写时是最高的开源分数,超过Kimi K3和Qwen3.8 Max,低于Claude Fable 5.1和GPT-6 Astra [4]。说明中最明显的代际差异是关于更便宜的模型:V2.6-Flash “在各方面都超越了MiMo-V2.5-Pro” [4]。
需要记住两件事。小米尚未发布直接的V2.6-Pro与V2.5-Pro的基准表,因此上述比较是规格和价格。而且 mimo-v2.5-pro 计划于2026年10月21日退役,mimo-v2.6-pro 被命名为迁移目标 [5],因此基于v2.5构建的任何新内容几乎需要立即迁移。
为什么选择AIHubMix
- 您只需更改
base_url。 网关使用OpenAI聊天完成格式,因此官方SDK可以无修改使用。Anthropic格式的/v1/messages(测试版)和原生Gemini调用可以在同一密钥上使用 [6]。 - 一个密钥覆盖多个供应商。
GET /v1/models在设置当天返回了416个模型ID,其中21个是MiMo变体 [3]。更改模型意味着在您的脚本中更改一个字符串。 - 您可以先免费测试。
xiaomi-mimo-v2.6-pro-free在每分钟5个请求、每天100个请求和每天1M令牌内的费用为$0 [2] — 足以证明设置在您花费任何费用之前是有效的。 - 没有订阅。 计费是按需付费,没有会员或月费 [6],付费MiMo的费率与模型页面上的$0.48/M输入和$0.96/M输出相匹配 [1]。
- 调试更快。 如果调用失败,将相同的脚本指向另一个供应商的模型。如果成功,则意味着您的密钥、URL和请求格式是正确的,问题出在模型上 — 一次调用而不是一个下午。
如何设置
1. 创建项目
mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"
2. 存储您的密钥
printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore
切勿在脚本中硬编码密钥,也切勿提交 .env。
3. 创建客户端
保存为 chat.py:
import os
import sys
from dotenv import load_dotenv
from openai import OpenAI
load_dotenv()
client = OpenAI(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com/v1",
)
prompt = sys.argv[1] if len(sys.argv) > 1 else "用一句话介绍自己。"
stream = client.chat.completions.create(
model="mimo-v2.6-pro",
messages=[{"role": "user", "content": prompt}],
max_tokens=1024,
stream=True,
)
for chunk in stream:
if not chunk.choices:
continue
piece = chunk.choices[0].delta.content
if piece:
print(piece, end="", flush=True)
print()
保持循环内的两个检查。一些块到达时会有一个空的 choices 数组,如果索引会引发 IndexError ;而 delta.content 在第一帧和最后一帧上可能为 None ,这会导致 print 输出字面文本 None。
4. 运行它
.venv/bin/python chat.py "用一句话介绍自己。"
我是MiMo,一个由小米的LLM核心团队开发的大型语言模型,旨在协助回答问题、写作和各种有用的任务。
预计大约六秒后会收到第一个令牌,模型页面上列出的时间为6.4秒 [1]。
5. 根据需要调整
对于非流式调用,删除 stream=True 并读取 response.choices[0].message.content。要切换模型,请更改 model 参数。增加 max_tokens 以获得更长的输出 — 上述默认的1024远低于模型的限制 [1]。
检查清单
- [ ] 已创建虚拟环境;
openai和python-dotenv已安装 - [ ]
.env包含您的真实密钥,chmod 600 - [ ]
.env已列入.gitignore - [ ]
base_url为https://aihubmix.com/v1— 必须包含/v1 - [ ] 模型ID为
mimo-v2.6-pro(付费)或xiaomi-mimo-v2.6-pro-free(免费) - [ ] 流式循环保护
chunk.choices和delta.content - [ ] 测试调用返回文本
常见问题
API真的与OpenAI兼容吗? 是的 — 标准聊天完成。任何与OpenAI兼容的客户端都可以通过将基础URL设置为 https://aihubmix.com/v1 并将您的AIHubMix密钥作为承载令牌传递来工作。AIHubMix的文档指出, coding-xiaomi-mimo-v2.6-flash 仅支持与OpenAI兼容的格式 [3]。
我应该使用哪个模型ID? mimo-v2.6-pro 用于付费, xiaomi-mimo-v2.6-pro-free 用于免费。这两个层次使用不同的命名约定 — 免费变体带有 xiaomi- 前缀,而付费的则没有,这很容易搞错。
还有哪些其他变体可用? mimo-v2.6-pro-ultraspeed、 mimo-v2.6-flash、 mimo-v2.5-pro,以及编码调优的ID,如 coding-xiaomi-mimo-v2.6-pro [3]。从API列出它们:
curl -s https://aihubmix.com/v1/models \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
| python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
if 'mimo' in i: print(i)
"
我收到 429 — 这意味着什么? 这取决于消息,两个情况需要相反的处理。“被提供商限制速率”是每分钟的限制:等待并重试。“达到免费模型配额的限制”意味着您帐户的免费配额已用尽,并且在免费模型之间共享 — 重试没有帮助,因此切换到 mimo-v2.6-pro。
我收到 400 “目前无法提供服务”。 首先确认ID是否与API匹配:
curl -s https://aihubmix.com/v1/models \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
| python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"
如果打印 True,请使用curl重复聊天调用并查找 "code": "no_available_channel"。这意味着模型已列出,但此时没有上游容量 — 这是提供商方面的条件,无法通过本地更改解决。等待或联系AIHubMix支持,提供响应中的请求ID。
我如何判断问题是我的还是提供商的? 使用相同的密钥和脚本调用不同供应商的模型 — 例如 gpt-4o-mini。如果成功,则您的密钥、基础URL和请求格式是正确的,问题出在特定模型上。如果也失败,请检查您的密钥和计费。
为什么我的输出在句子中间被截断? 您达到了 max_tokens,而不是模型限制。请提高它。
我如何检查我的帐户状态?
curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
-H "Authorization: Bearer $AIHUBMIX_API_KEY"
查看 has_payment_method 和限制字段。
后续步骤
上述脚本是一个有效的基础。MiMo v2.6 Pro的列出功能包括工具调用、结构化输出、视觉和音频输入,以及提示缓存 [1] — 所有这些都通过相同的OpenAI兼容接口,因此扩展客户端主要是添加标准参数。首先使用免费层确认您的设置,然后将模型ID切换为 mimo-v2.6-pro 以供常规使用。
来源
- [1] AIHubMix模型页面,
mimo-v2.6-pro: https://aihubmix.com/model/mimo-v2.6-pro (访问时间:2026年9月28日) - [2] AIHubMix模型页面,
xiaomi-mimo-v2.6-pro-free: https://aihubmix.com/model/xiaomi-mimo-v2.6-pro-free (访问时间:2026年9月28日) - [3] 从
GET /v1/models端点和AIHubMix模型页面获取的变体ID和格式说明(访问时间:2026年9月28日) - [4] 小米MiMo发布说明,V2.6系列: https://mimo.mi.com/docs/en-US/news/latest/v2-6 (访问时间:2026年9月28日)
- [5] AIHubMix模型页面,
mimo-v2.5-pro: https://aihubmix.com/model/mimo-v2.5-pro (访问时间:2026年9月28日) - [6] AIHubMix产品文档: https://docs.aihubmix.com/en (访问时间:2026年9月28日)



