如何在AIHubMix上使用小米MiMo v2.6 Pro:设置指南

推理时代阅读约 6 分钟
如何在AIHubMix上使用小米MiMo v2.6 Pro:设置指南

简而言之: 将官方 openai Python SDK指向 https://aihubmix.com/v1,使用模型ID mimo-v2.6-pro,并使用您的AIHubMix密钥进行身份验证。该API与OpenAI兼容(以与OpenAI相同的格式可调用),因此不需要特殊客户端。设置大约需要五分钟。

关键点

  • OpenAI兼容API — 只需更改 base_url,其他无需更改
  • 付费 mimo-v2.6-pro · 免费 xiaomi-mimo-v2.6-pro-free [1] [2]
  • $0.48/M 输入 · $0.96/M 输出 [1]
  • 免费层 每分钟5个请求 · 每天100个请求 · 每天1M令牌 [2]
  • 上下文 1.05M令牌 · 最大输出 131K令牌 [1]
  • 要求:Python 3.9+,AIHubMix API密钥

参考值

基础URLhttps://aihubmix.com/v1
协议OpenAI聊天完成
付费模型IDmimo-v2.6-pro
免费模型IDxiaomi-mimo-v2.6-pro-free
定价(付费)$0.48/M输入 · $0.96/M输出 · $0.0038/M缓存读取 [1]
免费层限制每分钟5个请求 · 每天100个请求 · 每天1M令牌 [2]
上下文窗口1.05M令牌 [1]
最大输出131K令牌 [1]
输入方式文本、视觉、音频、视频 — 仅文本输出 [1]
列出的功能流式传输、工具调用、结构化输出、提示缓存 [1]

您应该使用v2.6 Pro还是v2.5 Pro?

使用v2.6 Pro。它的价格相同,并且接受更多种类的输入。

mimo-v2.5-promimo-v2.6-pro
输入仅文本 [5]文本、视觉、音频、视频 [1]
价格(输入/输出)$0.48/M · $0.96/M [5]$0.48/M · $0.96/M [1]
上下文/最大输出1.05M · 131K [5]1.05M · 131K [1]
可用性于2026年10月21日退役 [5]当前 [1]

小米的发布说明表示V2.6“采用与V2.5系列相同的API定价”,并给V2.6-Pro在人工分析智能指数上打了46分——在撰写时是最高的开源分数,超过Kimi K3和Qwen3.8 Max,低于Claude Fable 5.1和GPT-6 Astra [4]。说明中最明显的代际差异是关于更便宜的模型:V2.6-Flash “在各方面都超越了MiMo-V2.5-Pro” [4]。

需要记住两件事。小米尚未发布直接的V2.6-Pro与V2.5-Pro的基准表,因此上述比较是规格和价格。而且 mimo-v2.5-pro 计划于2026年10月21日退役,mimo-v2.6-pro 被命名为迁移目标 [5],因此基于v2.5构建的任何新内容几乎需要立即迁移。

为什么选择AIHubMix

  • 您只需更改 base_url。 网关使用OpenAI聊天完成格式,因此官方SDK可以无修改使用。Anthropic格式的 /v1/messages (测试版)和原生Gemini调用可以在同一密钥上使用 [6]。
  • 一个密钥覆盖多个供应商。 GET /v1/models 在设置当天返回了416个模型ID,其中21个是MiMo变体 [3]。更改模型意味着在您的脚本中更改一个字符串。
  • 您可以先免费测试。 xiaomi-mimo-v2.6-pro-free 在每分钟5个请求、每天100个请求和每天1M令牌内的费用为$0 [2] — 足以证明设置在您花费任何费用之前是有效的。
  • 没有订阅。 计费是按需付费,没有会员或月费 [6],付费MiMo的费率与模型页面上的$0.48/M输入和$0.96/M输出相匹配 [1]。
  • 调试更快。 如果调用失败,将相同的脚本指向另一个供应商的模型。如果成功,则意味着您的密钥、URL和请求格式是正确的,问题出在模型上 — 一次调用而不是一个下午。

如何设置

1. 创建项目

mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"

2. 存储您的密钥

printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore

切勿在脚本中硬编码密钥,也切勿提交 .env。

3. 创建客户端

保存为 chat.py:

import os
import sys

from dotenv import load_dotenv
from openai import OpenAI

load_dotenv()

client = OpenAI(
    api_key=os.environ["AIHUBMIX_API_KEY"],
    base_url="https://aihubmix.com/v1",
)

prompt = sys.argv[1] if len(sys.argv) > 1 else "用一句话介绍自己。"

stream = client.chat.completions.create(
    model="mimo-v2.6-pro",
    messages=[{"role": "user", "content": prompt}],
    max_tokens=1024,
    stream=True,
)

for chunk in stream:
    if not chunk.choices:
        continue
    piece = chunk.choices[0].delta.content
    if piece:
        print(piece, end="", flush=True)
print()

保持循环内的两个检查。一些块到达时会有一个空的 choices 数组,如果索引会引发 IndexError ;而 delta.content 在第一帧和最后一帧上可能为 None ,这会导致 print 输出字面文本 None。

4. 运行它

.venv/bin/python chat.py "用一句话介绍自己。"
我是MiMo,一个由小米的LLM核心团队开发的大型语言模型,旨在协助回答问题、写作和各种有用的任务。

预计大约六秒后会收到第一个令牌,模型页面上列出的时间为6.4秒 [1]。

5. 根据需要调整

对于非流式调用,删除 stream=True 并读取 response.choices[0].message.content。要切换模型,请更改 model 参数。增加 max_tokens 以获得更长的输出 — 上述默认的1024远低于模型的限制 [1]。

检查清单

  • [ ] 已创建虚拟环境; openai 和 python-dotenv 已安装
  • [ ] .env 包含您的真实密钥, chmod 600
  • [ ] .env 已列入 .gitignore
  • [ ] base_url 为 https://aihubmix.com/v1 — 必须包含 /v1
  • [ ] 模型ID为 mimo-v2.6-pro (付费)或 xiaomi-mimo-v2.6-pro-free (免费)
  • [ ] 流式循环保护 chunk.choices 和 delta.content
  • [ ] 测试调用返回文本

常见问题

API真的与OpenAI兼容吗? 是的 — 标准聊天完成。任何与OpenAI兼容的客户端都可以通过将基础URL设置为 https://aihubmix.com/v1 并将您的AIHubMix密钥作为承载令牌传递来工作。AIHubMix的文档指出, coding-xiaomi-mimo-v2.6-flash 仅支持与OpenAI兼容的格式 [3]。

我应该使用哪个模型ID? mimo-v2.6-pro 用于付费, xiaomi-mimo-v2.6-pro-free 用于免费。这两个层次使用不同的命名约定 — 免费变体带有 xiaomi- 前缀,而付费的则没有,这很容易搞错。

还有哪些其他变体可用? mimo-v2.6-pro-ultraspeed、 mimo-v2.6-flash、 mimo-v2.5-pro,以及编码调优的ID,如 coding-xiaomi-mimo-v2.6-pro [3]。从API列出它们:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
    if 'mimo' in i: print(i)
"

我收到 429 — 这意味着什么? 这取决于消息,两个情况需要相反的处理。“被提供商限制速率”是每分钟的限制:等待并重试。“达到免费模型配额的限制”意味着您帐户的免费配额已用尽,并且在免费模型之间共享 — 重试没有帮助,因此切换到 mimo-v2.6-pro。

我收到 400 “目前无法提供服务”。 首先确认ID是否与API匹配:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"

如果打印 True,请使用curl重复聊天调用并查找 "code": "no_available_channel"。这意味着模型已列出,但此时没有上游容量 — 这是提供商方面的条件,无法通过本地更改解决。等待或联系AIHubMix支持,提供响应中的请求ID。

我如何判断问题是我的还是提供商的? 使用相同的密钥和脚本调用不同供应商的模型 — 例如 gpt-4o-mini。如果成功,则您的密钥、基础URL和请求格式是正确的,问题出在特定模型上。如果也失败,请检查您的密钥和计费。

为什么我的输出在句子中间被截断? 您达到了 max_tokens,而不是模型限制。请提高它。

我如何检查我的帐户状态?

curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY"

查看 has_payment_method 和限制字段。

后续步骤

上述脚本是一个有效的基础。MiMo v2.6 Pro的列出功能包括工具调用、结构化输出、视觉和音频输入,以及提示缓存 [1] — 所有这些都通过相同的OpenAI兼容接口,因此扩展客户端主要是添加标准参数。首先使用免费层确认您的设置,然后将模型ID切换为 mimo-v2.6-pro 以供常规使用。


来源