Em resumo: aponte o SDK Python oficial da openai para https://aihubmix.com/v1, use o ID do modelo mimo-v2.6-pro e autentique-se com sua chave AIHubMix. A API é compatível com OpenAI (chamada no mesmo formato que a da OpenAI), portanto, nenhum cliente especial é necessário. A configuração leva cerca de cinco minutos.
Pontos principais
- API compatível com OpenAI — altere
base_url, nada mais - Pago
mimo-v2.6-pro· gratuitoxiaomi-mimo-v2.6-pro-free[1] [2] - $0.48/M entrada · $0.96/M saída [1]
- Camada gratuita 5 solicitações/min · 100/dia · 1M tokens/dia [2]
- Contexto 1.05M tokens · saída máxima 131K tokens [1]
- Requisitos: Python 3.9+, uma chave de API AIHubMix
Valores de referência
| Base URL | https://aihubmix.com/v1 |
| Protocolo | OpenAI Chat Completions |
| ID do modelo pago | mimo-v2.6-pro |
| ID do modelo gratuito | xiaomi-mimo-v2.6-pro-free |
| Preços (pago) | $0.48/M entrada · $0.96/M saída · $0.0038/M leitura de cache [1] |
| Limites da camada gratuita | 5 req/min · 100 req/dia · 1M tokens/dia [2] |
| Janela de contexto | 1.05M tokens [1] |
| Saída máxima | 131K tokens [1] |
| Modalidades de entrada | Texto, visão, áudio, vídeo — saída apenas em texto [1] |
| Recursos listados | Streaming, chamada de ferramentas, saídas estruturadas, cache de prompt [1] |
Você deve usar v2.6 Pro ou v2.5 Pro?
Use v2.6 Pro. Tem o mesmo preço e aceita mais tipos de entrada.
mimo-v2.5-pro | mimo-v2.6-pro | |
|---|---|---|
| Entrada | Apenas texto [5] | Texto, visão, áudio, vídeo [1] |
| Preço em / saída | $0.48/M · $0.96/M [5] | $0.48/M · $0.96/M [1] |
| Contexto / saída máxima | 1.05M · 131K [5] | 1.05M · 131K [1] |
| Disponibilidade | Retira em 21 de outubro de 2026 [5] | Atual [1] |
As notas de lançamento da Xiaomi dizem que a V2.6 "adota a mesma precificação de API que a série V2.5" e dão à V2.6-Pro 46 pontos no Índice de Análise de Inteligência Artificial — a melhor pontuação de código aberto no momento da redação, acima do Kimi K3 e Qwen3.8 Max e abaixo do Claude Fable 5.1 e GPT-6 Astra [4]. A linha mais clara de geração para geração nas notas é sobre o modelo mais barato: V2.6-Flash "superou amplamente o MiMo-V2.5-Pro" [4].
Duass coisas a ter em mente. A Xiaomi não publicou uma tabela de benchmark direta entre V2.6-Pro e V2.5-Pro, então a comparação acima é de especificações e preço. E mimo-v2.5-pro está programado para ser retirado em 21 de outubro de 2026, com mimo-v2.6-pro sendo nomeado como o alvo de migração [5], então qualquer coisa nova construída sobre v2.5 precisaria ser movida quase imediatamente.
Por que AIHubMix
- Você só altera
base_url. O gateway fala o formato OpenAI Chat Completions, então o SDK oficial funciona sem modificações. Chamadas no formato Anthropic/v1/messages(beta) e nativas do Gemini estão disponíveis na mesma chave [6]. - Uma chave cobre muitos fornecedores.
GET /v1/modelsretornou 416 IDs de modelo no dia da configuração, 21 deles variantes MiMo [3]. Alterar o modelo significa alterar uma string no seu script. - Você pode testar gratuitamente primeiro.
xiaomi-mimo-v2.6-pro-freecusta $0 dentro de 5 solicitações/min, 100/dia e 1M tokens/dia [2] — o suficiente para provar que a configuração funciona antes de gastar qualquer coisa. - Sem assinatura. A cobrança é pay-as-you-go, sem taxa de adesão ou mensal [6], e a taxa paga do MiMo corresponde à página do modelo em $0.48/M de entrada e $0.96/M de saída [1].
- O depuração é mais rápida. Se uma chamada falhar, aponte o mesmo script para o modelo de outro fornecedor. Um sucesso lá significa que sua chave, URL e formato de solicitação estão corretos, e o problema é o modelo — uma chamada em vez de uma tarde.
Como configurá-lo
1. Crie o projeto
mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"
2. Armazene sua chave
printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore
Nunca codifique a chave diretamente no seu script e nunca faça commit de .env.
3. Crie o cliente
Salve como chat.py:
import os
import sys
from dotenv import load_dotenv
from openai import OpenAI
load_dotenv()
client = OpenAI(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com/v1",
)
prompt = sys.argv[1] if len(sys.argv) > 1 else "Apresente-se em uma frase."
stream = client.chat.completions.create(
model="mimo-v2.6-pro",
messages=[{"role": "user", "content": prompt}],
max_tokens=1024,
stream=True,
)
for chunk in stream:
if not chunk.choices:
continue
piece = chunk.choices[0].delta.content
if piece:
print(piece, end="", flush=True)
print()
Mantenha ambas as verificações dentro do loop. Alguns chunks chegam com um array choices vazio, o que gera um IndexError se indexado; e delta.content pode ser None nos primeiros e últimos frames, o que print geraria como o texto literal None.
4. Execute-o
.venv/bin/python chat.py "Apresente-se em uma frase."
Sou MiMo, um grande modelo de linguagem desenvolvido pela equipe de LLM da Xiaomi, aqui para ajudar a responder perguntas, escrever e realizar uma ampla gama de tarefas úteis.
Espere cerca de seis segundos para os primeiros tokens, contra os 6.4s listados na página do modelo [1].
5. Ajuste conforme necessário
Para uma chamada não streaming, remova stream=True e leia response.choices[0].message.content. Para mudar de modelos, altere o argumento model. Aumente max_tokens para uma saída mais longa — o padrão de 1024 acima está bem abaixo do limite do modelo [1].
Lista de Verificação
- [ ] Virtualenv criado;
openaiepython-dotenvinstalados - [ ]
.envcontém sua chave real,chmod 600 - [ ]
.envlistado em.gitignore - [ ]
base_urléhttps://aihubmix.com/v1— o/v1é necessário - [ ] ID do modelo é
mimo-v2.6-pro(pago) ouxiaomi-mimo-v2.6-pro-free(gratuito) - [ ] O loop de streaming protege
chunk.choicesedelta.content - [ ] Uma chamada de teste retorna texto
FAQ
A API é realmente compatível com OpenAI? Sim — Completions de Chat padrão. Qualquer cliente compatível com OpenAI funciona definindo a URL base para https://aihubmix.com/v1 e passando sua chave AIHubMix como o token bearer. A documentação do AIHubMix observa que coding-xiaomi-mimo-v2.6-flash suporta apenas formatos compatíveis com OpenAI [3].
Qual ID de modelo devo usar? mimo-v2.6-pro para pago, xiaomi-mimo-v2.6-pro-free para gratuito. Os dois níveis usam convenções de nomenclatura diferentes — variantes gratuitas têm o prefixo xiaomi- e as pagas não, o que é fácil de confundir.
Quais outras variantes estão disponíveis? mimo-v2.6-pro-ultraspeed, mimo-v2.6-flash, mimo-v2.5-pro, e IDs ajustados para codificação como coding-xiaomi-mimo-v2.6-pro [3]. Liste-os a partir da API:
curl -s https://aihubmix.com/v1/models \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
| python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
if 'mimo' in i: print(i)
"
Eu recebo 429 — o que isso significa? Depende da mensagem, e os dois casos precisam de tratamento oposto. "limitado por taxa pelo provedor" é um limite por minuto: aguarde e tente novamente. "alcancei o limite da cota do modelo gratuito" significa que a cota gratuita da sua conta está esgotada e compartilhada entre modelos gratuitos — tentar novamente não ajudará, então mude para mimo-v2.6-pro.
Eu recebo 400 "não pode ser atendido no momento". Primeiro, confirme o ID contra a API:
curl -s https://aihubmix.com/v1/models \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
| python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"
Se isso imprimir True, repita a chamada de chat com curl e procure por "code": "no_available_channel". Isso significa que o modelo está listado, mas não tem capacidade upstream no momento — uma condição do lado do provedor que nenhuma alteração local resolverá. Aguarde ou entre em contato com o suporte do AIHubMix com o ID da solicitação da resposta.
Como posso saber se um problema é meu ou do provedor? Chame o modelo de outro fornecedor com a mesma chave e script — por exemplo gpt-4o-mini. Se for bem-sucedido, sua chave, URL base e formato de solicitação estão corretos e o problema é aquele modelo específico. Se falhar também, verifique sua chave e cobrança.
Por que minha saída é cortada no meio da frase? Você atingiu max_tokens, não um limite do modelo. Aumente-o.
Como faço para verificar o status da minha conta?
curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
-H "Authorization: Bearer $AIHUBMIX_API_KEY"
Olhe para has_payment_method e os campos de limite.
Próximos passos
O script acima é uma base funcional. As capacidades listadas do MiMo v2.6 Pro incluem chamada de ferramentas, saídas estruturadas, entrada de visão e áudio, e cache de prompt [1] — tudo através da mesma interface compatível com OpenAI, então estender o cliente é principalmente uma questão de adicionar parâmetros padrão. Comece com a camada gratuita para confirmar sua configuração, depois mude o ID do modelo para mimo-v2.6-pro para uso regular.
Fontes
- [1] Página do modelo AIHubMix,
mimo-v2.6-pro: https://aihubmix.com/model/mimo-v2.6-pro (acessado em 28 de setembro de 2026) - [2] Página do modelo AIHubMix,
xiaomi-mimo-v2.6-pro-free: https://aihubmix.com/model/xiaomi-mimo-v2.6-pro-free (acessado em 28 de setembro de 2026) - [3] IDs de variante e notas de formato do
GET /v1/modelsendpoint e páginas de modelo AIHubMix (acessado em 28 de setembro de 2026) - [4] Notas de lançamento do Xiaomi MiMo, série V2.6: https://mimo.mi.com/docs/en-US/news/latest/v2-6 (acessado em 28 de setembro de 2026)
- [5] Página do modelo AIHubMix,
mimo-v2.5-pro: https://aihubmix.com/model/mimo-v2.5-pro (acessado em 28 de setembro de 2026) - [6] Documentação do produto AIHubMix: https://docs.aihubmix.com/en (acessado em 28 de setembro de 2026)



