Cómo usar Xiaomi MiMo v2.6 Pro en AIHubMix: Guía de configuración

AIHubMix6 min de lectura
Cómo usar Xiaomi MiMo v2.6 Pro en AIHubMix: Guía de configuración

En resumen: apunta el SDK de Python oficial de openai a https://aihubmix.com/v1, utiliza el ID del modelo mimo-v2.6-pro y autentica con tu clave de AIHubMix. La API es compatible con OpenAI (llamable en el mismo formato que la de OpenAI), por lo que no se requiere un cliente especial. La configuración toma aproximadamente cinco minutos.

Puntos clave

  • API compatible con OpenAI — cambia base_url, nada más
  • Modelo pago mimo-v2.6-pro · modelo gratuito xiaomi-mimo-v2.6-pro-free [1] [2]
  • $0.48/M entrada · $0.96/M salida [1]
  • Nivel gratuito 5 solicitudes/min · 100/día · 1M tokens/día [2]
  • Contexto 1.05M tokens · salida máxima 131K tokens [1]
  • Requisitos: Python 3.9+, una clave API de AIHubMix

Valores de referencia

Base URLhttps://aihubmix.com/v1
ProtocoloOpenAI Chat Completions
ID del modelo pagomimo-v2.6-pro
ID del modelo gratuitoxiaomi-mimo-v2.6-pro-free
Precios (pago)$0.48/M entrada · $0.96/M salida · $0.0038/M lectura de caché [1]
Límites del nivel gratuito5 req/min · 100 req/día · 1M tokens/día [2]
Ventana de contexto1.05M tokens [1]
Salida máxima131K tokens [1]
Modalidades de entradaTexto, visión, audio, video — salida solo de texto [1]
Características listadasStreaming, llamada de herramientas, salidas estructuradas, almacenamiento en caché de prompts [1]

¿Deberías usar v2.6 Pro o v2.5 Pro?

Usa v2.6 Pro. Tiene el mismo precio y acepta más tipos de entrada.

mimo-v2.5-promimo-v2.6-pro
EntradaSolo texto [5]Texto, visión, audio, video [1]
Precio en / salida$0.48/M · $0.96/M [5]$0.48/M · $0.96/M [1]
Contexto / salida máxima1.05M · 131K [5]1.05M · 131K [1]
DisponibilidadRetiro el 21 de octubre de 2026 [5]Actual [1]

Las notas de lanzamiento de Xiaomi dicen que V2.6 "adopta la misma estructura de precios de API que la serie V2.5" y le dan a V2.6-Pro 46 puntos en el Índice de Análisis de Inteligencia Artificial — la puntuación de código abierto más alta en el momento de escribir, por encima de Kimi K3 y Qwen3.8 Max y por debajo de Claude Fable 5.1 y GPT-6 Astra [4]. La línea más clara de generación a generación en las notas es sobre el modelo más barato: V2.6-Flash "ha superado de manera integral a MiMo-V2.5-Pro" [4].

Dos cosas a tener en cuenta. Xiaomi no ha publicado una tabla de referencia directa entre V2.6-Pro y V2.5-Pro, por lo que la comparación anterior es de especificaciones y precios. Y mimo-v2.5-pro está programado para retirarse el 21 de octubre de 2026 con mimo-v2.6-pro nombrado como el objetivo de migración [5], por lo que cualquier cosa nueva construida sobre v2.5 necesitaría ser trasladada casi de inmediato.

Por qué AIHubMix

  • Solo cambias base_url. La puerta de enlace habla el formato de OpenAI Chat Completions, por lo que el SDK oficial funciona sin modificaciones. Las llamadas en formato de Anthropic /v1/messages (beta) y nativas de Gemini están disponibles con la misma clave [6].
  • Una clave cubre muchos proveedores. GET /v1/models devolvió 416 IDs de modelos el día de la configuración, 21 de ellos variantes de MiMo [3]. Cambiar de modelo significa cambiar una cadena en tu script.
  • Puedes probar gratis primero. xiaomi-mimo-v2.6-pro-free cuesta $0 dentro de 5 solicitudes/min, 100/día y 1M tokens/día [2] — suficiente para probar que la configuración funciona antes de gastar algo.
  • Sin suscripción. La facturación es por uso con ningún costo de membresía o mensual [6], y la tarifa de MiMo pagada coincide con la página del modelo a $0.48/M en y $0.96/M fuera [1].
  • La depuración es más rápida. Si una llamada falla, apunta el mismo script a otro modelo de proveedor. Un éxito allí significa que tu clave, URL y forma de solicitud están bien, y el problema es el modelo — una llamada en lugar de una tarde.

Cómo configurarlo

1. Crea el proyecto

mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"

2. Almacena tu clave

printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore

Nunca codifiques la clave directamente en tu script, y nunca cometas .env.

3. Crea el cliente

Guarda como chat.py:

import os
import sys

from dotenv import load_dotenv
from openai import OpenAI

load_dotenv()

client = OpenAI(
    api_key=os.environ["AIHUBMIX_API_KEY"],
    base_url="https://aihubmix.com/v1",
)

prompt = sys.argv[1] if len(sys.argv) > 1 else "Preséntate en una oración."

stream = client.chat.completions.create(
    model="mimo-v2.6-pro",
    messages=[{"role": "user", "content": prompt}],
    max_tokens=1024,
    stream=True,
)

for chunk in stream:
    if not chunk.choices:
        continue
    piece = chunk.choices[0].delta.content
    if piece:
        print(piece, end="", flush=True)
print()

Mantén ambas verificaciones dentro del bucle. Algunos fragmentos llegan con un array choices vacío, lo que genera un IndexError si se indexa; además, el delta.content puede ser None en los primeros y últimos fotogramas, lo que print saldría como el texto literal None.

4. Ejecútalo

.venv/bin/python chat.py "Preséntate en una oración."
Soy MiMo, un modelo de lenguaje grande desarrollado por el equipo de LLM de Xiaomi, aquí para ayudar a responder preguntas, escribir y realizar una amplia gama de tareas útiles.

Espera aproximadamente seis segundos para los primeros tokens, contra los 6.4s listados en la página del modelo [1].

5. Ajusta según sea necesario

Para una llamada no en streaming, elimina stream=True y lee response.choices[0].message.content. Para cambiar de modelos, cambia el argumento model. Aumenta max_tokens para una salida más larga — el valor predeterminado de 1024 arriba está muy por debajo del límite del modelo [1].

Lista de verificación

  • [ ] Virtualenv creado; openai y python-dotenv instalados
  • [ ] .env contiene tu clave real, chmod 600
  • [ ] .env listado en .gitignore
  • [ ] base_url es https://aihubmix.com/v1 — el /v1 es requerido
  • [ ] ID del modelo es mimo-v2.6-pro (pago) o xiaomi-mimo-v2.6-pro-free (gratuito)
  • [ ] Bucle de streaming protege chunk.choices y delta.content
  • [ ] Una llamada de prueba devuelve texto

FAQ

¿Es la API realmente compatible con OpenAI? Sí — Chat Completions estándar. Cualquier cliente compatible con OpenAI funciona configurando la URL base a https://aihubmix.com/v1 y pasando tu clave de AIHubMix como el token portador. La documentación de AIHubMix señala que coding-xiaomi-mimo-v2.6-flash solo admite formatos compatibles con OpenAI [3].

¿Qué ID de modelo debo usar? mimo-v2.6-pro para pago, xiaomi-mimo-v2.6-pro-free para gratuito. Los dos niveles utilizan diferentes convenciones de nombres — las variantes gratuitas llevan el prefijo xiaomi- y las pagadas no, lo que es fácil de confundir.

¿Qué otras variantes están disponibles? mimo-v2.6-pro-ultraspeed, mimo-v2.6-flash, mimo-v2.5-pro, y IDs ajustados para codificación como coding-xiaomi-mimo-v2.6-pro [3]. Listalos desde la API:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
    if 'mimo' in i: print(i)
"

Recibo 429 — ¿qué significa? Depende del mensaje, y los dos casos necesitan un manejo opuesto. "limitado por la tasa del proveedor" es un estrangulamiento por minuto: espera y vuelve a intentar. "alcanzó el límite de la cuota del modelo gratuito" significa que la cuota gratuita de tu cuenta se ha agotado y se comparte entre modelos gratuitos — volver a intentar no ayudará, así que cambia a mimo-v2.6-pro.

Recibo 400 "no se puede atender en este momento". Primero confirma el ID contra la API:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"

Si eso imprime True, repite la llamada de chat con curl y busca "code": "no_available_channel". Eso significa que el modelo está listado pero no tiene capacidad superior en ese momento — una condición del lado del proveedor que ningún cambio local solucionará. Espera o contacta al soporte de AIHubMix con el ID de solicitud de la respuesta.

¿Cómo puedo saber si un problema es mío o del proveedor? Llama a un modelo de otro proveedor con la misma clave y script — por ejemplo gpt-4o-mini. Si tiene éxito, tu clave, URL base y formato de solicitud son correctos y el problema es ese modelo específico. Si también falla, verifica tu clave y facturación.

¿Por qué mi salida se corta a mitad de oración? Alcanzaste max_tokens, no un límite del modelo. Aumentalo.

¿Cómo puedo verificar el estado de mi cuenta?

curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY"

Mira has_payment_method y los campos de límite.

Próximos pasos

El script anterior es una base funcional. Las capacidades listadas de MiMo v2.6 Pro incluyen llamadas a herramientas, salidas estructuradas, entrada de visión y audio, y almacenamiento en caché de prompts [1] — todo a través de la misma interfaz compatible con OpenAI, por lo que extender el cliente es principalmente una cuestión de agregar parámetros estándar. Comienza con el nivel gratuito para confirmar tu configuración, luego cambia el ID del modelo a mimo-v2.6-pro para uso regular.


Fuentes