Como Usar o Xiaomi MiMo v2.6 Pro no AIHubMix: Guia de Configuração

AIHubMix6 min de leitura
Como Usar o Xiaomi MiMo v2.6 Pro no AIHubMix: Guia de Configuração

Em resumo: aponte o SDK Python oficial da openai para https://aihubmix.com/v1, use o ID do modelo mimo-v2.6-pro e autentique-se com sua chave AIHubMix. A API é compatível com OpenAI (chamada no mesmo formato que a da OpenAI), portanto, nenhum cliente especial é necessário. A configuração leva cerca de cinco minutos.

Pontos principais

  • API compatível com OpenAI — altere base_url, nada mais
  • Pago mimo-v2.6-pro · gratuito xiaomi-mimo-v2.6-pro-free [1] [2]
  • $0.48/M entrada · $0.96/M saída [1]
  • Camada gratuita 5 solicitações/min · 100/dia · 1M tokens/dia [2]
  • Contexto 1.05M tokens · saída máxima 131K tokens [1]
  • Requisitos: Python 3.9+, uma chave de API AIHubMix

Valores de referência

Base URLhttps://aihubmix.com/v1
ProtocoloOpenAI Chat Completions
ID do modelo pagomimo-v2.6-pro
ID do modelo gratuitoxiaomi-mimo-v2.6-pro-free
Preços (pago)$0.48/M entrada · $0.96/M saída · $0.0038/M leitura de cache [1]
Limites da camada gratuita5 req/min · 100 req/dia · 1M tokens/dia [2]
Janela de contexto1.05M tokens [1]
Saída máxima131K tokens [1]
Modalidades de entradaTexto, visão, áudio, vídeo — saída apenas em texto [1]
Recursos listadosStreaming, chamada de ferramentas, saídas estruturadas, cache de prompt [1]

Você deve usar v2.6 Pro ou v2.5 Pro?

Use v2.6 Pro. Tem o mesmo preço e aceita mais tipos de entrada.

mimo-v2.5-promimo-v2.6-pro
EntradaApenas texto [5]Texto, visão, áudio, vídeo [1]
Preço em / saída$0.48/M · $0.96/M [5]$0.48/M · $0.96/M [1]
Contexto / saída máxima1.05M · 131K [5]1.05M · 131K [1]
DisponibilidadeRetira em 21 de outubro de 2026 [5]Atual [1]

As notas de lançamento da Xiaomi dizem que a V2.6 "adota a mesma precificação de API que a série V2.5" e dão à V2.6-Pro 46 pontos no Índice de Análise de Inteligência Artificial — a melhor pontuação de código aberto no momento da redação, acima do Kimi K3 e Qwen3.8 Max e abaixo do Claude Fable 5.1 e GPT-6 Astra [4]. A linha mais clara de geração para geração nas notas é sobre o modelo mais barato: V2.6-Flash "superou amplamente o MiMo-V2.5-Pro" [4].

Duass coisas a ter em mente. A Xiaomi não publicou uma tabela de benchmark direta entre V2.6-Pro e V2.5-Pro, então a comparação acima é de especificações e preço. E mimo-v2.5-pro está programado para ser retirado em 21 de outubro de 2026, com mimo-v2.6-pro sendo nomeado como o alvo de migração [5], então qualquer coisa nova construída sobre v2.5 precisaria ser movida quase imediatamente.

Por que AIHubMix

  • Você só altera base_url. O gateway fala o formato OpenAI Chat Completions, então o SDK oficial funciona sem modificações. Chamadas no formato Anthropic /v1/messages (beta) e nativas do Gemini estão disponíveis na mesma chave [6].
  • Uma chave cobre muitos fornecedores. GET /v1/models retornou 416 IDs de modelo no dia da configuração, 21 deles variantes MiMo [3]. Alterar o modelo significa alterar uma string no seu script.
  • Você pode testar gratuitamente primeiro. xiaomi-mimo-v2.6-pro-free custa $0 dentro de 5 solicitações/min, 100/dia e 1M tokens/dia [2] — o suficiente para provar que a configuração funciona antes de gastar qualquer coisa.
  • Sem assinatura. A cobrança é pay-as-you-go, sem taxa de adesão ou mensal [6], e a taxa paga do MiMo corresponde à página do modelo em $0.48/M de entrada e $0.96/M de saída [1].
  • O depuração é mais rápida. Se uma chamada falhar, aponte o mesmo script para o modelo de outro fornecedor. Um sucesso lá significa que sua chave, URL e formato de solicitação estão corretos, e o problema é o modelo — uma chamada em vez de uma tarde.

Como configurá-lo

1. Crie o projeto

mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"

2. Armazene sua chave

printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore

Nunca codifique a chave diretamente no seu script e nunca faça commit de .env.

3. Crie o cliente

Salve como chat.py:

import os
import sys

from dotenv import load_dotenv
from openai import OpenAI

load_dotenv()

client = OpenAI(
    api_key=os.environ["AIHUBMIX_API_KEY"],
    base_url="https://aihubmix.com/v1",
)

prompt = sys.argv[1] if len(sys.argv) > 1 else "Apresente-se em uma frase."

stream = client.chat.completions.create(
    model="mimo-v2.6-pro",
    messages=[{"role": "user", "content": prompt}],
    max_tokens=1024,
    stream=True,
)

for chunk in stream:
    if not chunk.choices:
        continue
    piece = chunk.choices[0].delta.content
    if piece:
        print(piece, end="", flush=True)
print()

Mantenha ambas as verificações dentro do loop. Alguns chunks chegam com um array choices vazio, o que gera um IndexError se indexado; e delta.content pode ser None nos primeiros e últimos frames, o que print geraria como o texto literal None.

4. Execute-o

.venv/bin/python chat.py "Apresente-se em uma frase."
Sou MiMo, um grande modelo de linguagem desenvolvido pela equipe de LLM da Xiaomi, aqui para ajudar a responder perguntas, escrever e realizar uma ampla gama de tarefas úteis.

Espere cerca de seis segundos para os primeiros tokens, contra os 6.4s listados na página do modelo [1].

5. Ajuste conforme necessário

Para uma chamada não streaming, remova stream=True e leia response.choices[0].message.content. Para mudar de modelos, altere o argumento model. Aumente max_tokens para uma saída mais longa — o padrão de 1024 acima está bem abaixo do limite do modelo [1].

Lista de Verificação

  • [ ] Virtualenv criado; openai e python-dotenv instalados
  • [ ] .env contém sua chave real, chmod 600
  • [ ] .env listado em .gitignore
  • [ ] base_url é https://aihubmix.com/v1 — o /v1 é necessário
  • [ ] ID do modelo é mimo-v2.6-pro (pago) ou xiaomi-mimo-v2.6-pro-free (gratuito)
  • [ ] O loop de streaming protege chunk.choices e delta.content
  • [ ] Uma chamada de teste retorna texto

FAQ

A API é realmente compatível com OpenAI? Sim — Completions de Chat padrão. Qualquer cliente compatível com OpenAI funciona definindo a URL base para https://aihubmix.com/v1 e passando sua chave AIHubMix como o token bearer. A documentação do AIHubMix observa que coding-xiaomi-mimo-v2.6-flash suporta apenas formatos compatíveis com OpenAI [3].

Qual ID de modelo devo usar? mimo-v2.6-pro para pago, xiaomi-mimo-v2.6-pro-free para gratuito. Os dois níveis usam convenções de nomenclatura diferentes — variantes gratuitas têm o prefixo xiaomi- e as pagas não, o que é fácil de confundir.

Quais outras variantes estão disponíveis? mimo-v2.6-pro-ultraspeed, mimo-v2.6-flash, mimo-v2.5-pro, e IDs ajustados para codificação como coding-xiaomi-mimo-v2.6-pro [3]. Liste-os a partir da API:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
    if 'mimo' in i: print(i)
"

Eu recebo 429 — o que isso significa? Depende da mensagem, e os dois casos precisam de tratamento oposto. "limitado por taxa pelo provedor" é um limite por minuto: aguarde e tente novamente. "alcancei o limite da cota do modelo gratuito" significa que a cota gratuita da sua conta está esgotada e compartilhada entre modelos gratuitos — tentar novamente não ajudará, então mude para mimo-v2.6-pro.

Eu recebo 400 "não pode ser atendido no momento". Primeiro, confirme o ID contra a API:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"

Se isso imprimir True, repita a chamada de chat com curl e procure por "code": "no_available_channel". Isso significa que o modelo está listado, mas não tem capacidade upstream no momento — uma condição do lado do provedor que nenhuma alteração local resolverá. Aguarde ou entre em contato com o suporte do AIHubMix com o ID da solicitação da resposta.

Como posso saber se um problema é meu ou do provedor? Chame o modelo de outro fornecedor com a mesma chave e script — por exemplo gpt-4o-mini. Se for bem-sucedido, sua chave, URL base e formato de solicitação estão corretos e o problema é aquele modelo específico. Se falhar também, verifique sua chave e cobrança.

Por que minha saída é cortada no meio da frase? Você atingiu max_tokens, não um limite do modelo. Aumente-o.

Como faço para verificar o status da minha conta?

curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY"

Olhe para has_payment_method e os campos de limite.

Próximos passos

O script acima é uma base funcional. As capacidades listadas do MiMo v2.6 Pro incluem chamada de ferramentas, saídas estruturadas, entrada de visão e áudio, e cache de prompt [1] — tudo através da mesma interface compatível com OpenAI, então estender o cliente é principalmente uma questão de adicionar parâmetros padrão. Comece com a camada gratuita para confirmar sua configuração, depois mude o ID do modelo para mimo-v2.6-pro para uso regular.


Fontes