En résumé : pointez le SDK Python officiel openai vers https://aihubmix.com/v1, utilisez l'ID du modèle mimo-v2.6-pro, et authentifiez-vous avec votre clé AIHubMix. L'API est compatible avec OpenAI (appelable dans le même format qu'OpenAI), donc aucun client spécial n'est requis. La configuration prend environ cinq minutes.
Points clés
- API compatible avec OpenAI — changez
base_url, rien d'autre - Modèle payant
mimo-v2.6-pro· modèle gratuitxiaomi-mimo-v2.6-pro-free[1] [2] - 0,48 $/M en entrée · 0,96 $/M en sortie [1]
- Niveau gratuit 5 requêtes/min · 100/jour · 1M tokens/jour [2]
- Contexte 1,05M tokens · sortie max 131K tokens [1]
- Exigences : Python 3.9+, une clé API AIHubMix
Valeurs de référence
| Base URL | https://aihubmix.com/v1 |
| Protocole | OpenAI Chat Completions |
| ID du modèle payant | mimo-v2.6-pro |
| ID du modèle gratuit | xiaomi-mimo-v2.6-pro-free |
| Tarification (payant) | 0,48 $/M en entrée · 0,96 $/M en sortie · 0,0038 $/M en lecture de cache [1] |
| Limites du niveau gratuit | 5 req/min · 100 req/jour · 1M tokens/jour [2] |
| Fenêtre de contexte | 1,05M tokens [1] |
| Sortie max | 131K tokens [1] |
| Modalités d'entrée | Texte, vision, audio, vidéo — sortie texte uniquement [1] |
| Fonctionnalités répertoriées | Streaming, appel d'outils, sorties structurées, mise en cache des invites [1] |
Devez-vous utiliser v2.6 Pro ou v2.5 Pro ?
Utilisez v2.6 Pro. Il est au même prix et accepte plus de types d'entrée.
mimo-v2.5-pro | mimo-v2.6-pro | |
|---|---|---|
| Entrée | Texte uniquement [5] | Texte, vision, audio, vidéo [1] |
| Prix en / out | 0,48 $/M · 0,96 $/M [5] | 0,48 $/M · 0,96 $/M [1] |
| Contexte / sortie max | 1,05M · 131K [5] | 1,05M · 131K [1] |
| Disponibilité | Retrait le 21 octobre 2026 [5] | Actuel [1] |
Les notes de version de Xiaomi indiquent que V2.6 "adopte la même tarification API que la série V2.5" et attribuent à V2.6-Pro 46 points sur l'Indice d'Analyse de l'Intelligence Artificielle — le meilleur score open-source au moment de l'écriture, au-dessus de Kimi K3 et Qwen3.8 Max et en dessous de Claude Fable 5.1 et GPT-6 Astra [4]. La ligne de génération la plus claire d'une génération à l'autre dans les notes concerne le modèle moins cher : V2.6-Flash "a largement surpassé MiMo-V2.5-Pro" [4].
Deux choses à garder à l'esprit. Xiaomi n'a pas publié de tableau de référence direct V2.6-Pro contre V2.5-Pro, donc la comparaison ci-dessus est basée sur les spécifications et le prix. Et mimo-v2.5-pro est prévu pour être retiré le 21 octobre 2026 avec mimo-v2.6-pro nommé comme cible de migration [5], donc tout nouveau construit sur v2.5 devra être déplacé presque immédiatement.
Pourquoi AIHubMix
- Vous ne changez que
base_url. La passerelle parle le format OpenAI Chat Completions, donc le SDK officiel fonctionne sans modification. Les appels au format Anthropic/v1/messages(bêta) et natifs de Gemini sont disponibles avec la même clé [6]. - Une clé couvre de nombreux fournisseurs.
GET /v1/modelsa retourné 416 ID de modèles le jour de la configuration, dont 21 variantes MiMo [3]. Changer de modèle signifie changer une chaîne dans votre script. - Vous pouvez tester gratuitement d'abord.
xiaomi-mimo-v2.6-pro-freecoûte 0 $ dans les limites de 5 requêtes/min, 100/jour et 1M tokens/jour [2] — suffisamment pour prouver que la configuration fonctionne avant de dépenser quoi que ce soit. - Aucune souscription. La facturation est à l'utilisation avec aucun frais d'adhésion ou mensuel [6], et le tarif MiMo payant correspond à la page du modèle à 0,48 $/M en entrée et 0,96 $/M en sortie [1].
- Le débogage est plus rapide. Si un appel échoue, pointez le même script vers le modèle d'un autre fournisseur. Un succès là-bas signifie que votre clé, URL et format de requête sont corrects, et que le problème vient du modèle — un appel au lieu d'un après-midi.
Comment le configurer
1. Créez le projet
mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"
2. Stockez votre clé
printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore
Ne jamais coder la clé en dur dans votre script, et ne jamais commettre .env.
3. Créez le client
Enregistrez sous chat.py :
import os
import sys
from dotenv import load_dotenv
from openai import OpenAI
load_dotenv()
client = OpenAI(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com/v1",
)
prompt = sys.argv[1] if len(sys.argv) > 1 else "Présentez-vous en une phrase."
stream = client.chat.completions.create(
model="mimo-v2.6-pro",
messages=[{"role": "user", "content": prompt}],
max_tokens=1024,
stream=True,
)
for chunk in stream:
if not chunk.choices:
continue
piece = chunk.choices[0].delta.content
if piece:
print(piece, end="", flush=True)
print()
Gardez les deux vérifications à l'intérieur de la boucle. Certains morceaux arrivent avec un tableau choices vide, ce qui soulève une IndexError si indexé ; delta.content est None sur les premières et dernières trames, ce qui print afficherait comme le texte littéral None.
4. Exécutez-le
.venv/bin/python chat.py "Présentez-vous en une phrase."
Je suis MiMo, un grand modèle de langage développé par l'équipe LLM de Xiaomi, ici pour aider à répondre aux questions, à écrire et à une large gamme de tâches utiles.
Attendez-vous à environ six secondes pour les premiers tokens, contre les 6,4s indiqués sur la page du modèle [1].
5. Ajustez si nécessaire
Pour un appel non en streaming, supprimez stream=True et lisez response.choices[0].message.content. Pour changer de modèle, modifiez l'argument model. Augmentez max_tokens pour une sortie plus longue — le défaut de 1024 ci-dessus est bien en dessous de la limite du modèle [1].
Liste de contrôle
- [ ] Virtualenv créé ;
openaietpython-dotenvinstallés - [ ]
.envcontient votre vraie clé,chmod 600 - [ ]
.envrépertorié dans.gitignore - [ ]
base_urlesthttps://aihubmix.com/v1— le/v1est requis - [ ] L'ID du modèle est
mimo-v2.6-pro(payant) ouxiaomi-mimo-v2.6-pro-free(gratuit) - [ ] Les protections de boucle de streaming vérifient
chunk.choicesetdelta.content - [ ] Un appel de test renvoie du texte
FAQ
L'API est-elle vraiment compatible avec OpenAI ? Oui — Chat Completions standard. Tout client compatible avec OpenAI fonctionne en définissant l'URL de base sur https://aihubmix.com/v1 et en passant votre clé AIHubMix comme le jeton porteur. La documentation d'AIHubMix note que coding-xiaomi-mimo-v2.6-flash ne prend en charge que les formats compatibles avec OpenAI [3].
Quel ID de modèle devrais-je utiliser ? mimo-v2.6-pro pour le payant, xiaomi-mimo-v2.6-pro-free pour le gratuit. Les deux niveaux utilisent des conventions de nommage différentes — les variantes gratuites portent le préfixe xiaomi- et celles payantes ne le portent pas, ce qui est facile à confondre.
Quelles autres variantes sont disponibles ? mimo-v2.6-pro-ultraspeed, mimo-v2.6-flash, mimo-v2.5-pro, et des ID ajustés pour le codage tels que coding-xiaomi-mimo-v2.6-pro [3]. Listez-les depuis l'API :
curl -s https://aihubmix.com/v1/models \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
| python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
if 'mimo' in i: print(i)
"
Je reçois 429 — que signifie-t-il ? Cela dépend du message, et les deux cas nécessitent un traitement opposé. "limité par le fournisseur" est un throttling par minute : attendez et réessayez. "atteint la limite du quota du modèle gratuit" signifie que le quota gratuit de votre compte est épuisé et partagé entre les modèles gratuits — réessayer n'aidera pas, donc passez à mimo-v2.6-pro.
Je reçois 400 "ne peut pas être servi pour le moment". Confirmez d'abord l'ID contre l'API :
curl -s https://aihubmix.com/v1/models \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
| python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"
Si cela imprime True, répétez l'appel de chat avec curl et recherchez "code": "no_available_channel". Cela signifie que le modèle est répertorié mais n'a pas de capacité en amont à ce moment-là — une condition côté fournisseur qu'aucun changement local ne résoudra. Attendez, ou contactez le support AIHubMix avec l'ID de demande de la réponse.
Comment puis-je savoir si un problème vient de moi ou du fournisseur ? Appelez un modèle d'un autre fournisseur avec la même clé et le même script — par exemple gpt-4o-mini. Si cela réussit, votre clé, l'URL de base et le format de requête sont corrects et le problème vient de ce modèle spécifique. Si cela échoue aussi, vérifiez votre clé et votre facturation.
Pourquoi ma sortie est-elle coupée en plein milieu d'une phrase ? Vous avez atteint max_tokens, pas une limite du modèle. Augmentez-le.
Comment vérifier l'état de mon compte ?
curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
-H "Authorization: Bearer $AIHUBMIX_API_KEY"
Regardez has_payment_method et les champs de limite.
Prochaines étapes
Le script ci-dessus est une base fonctionnelle. Les capacités répertoriées de MiMo v2.6 Pro incluent l'appel d'outils, les sorties structurées, l'entrée vision et audio, et la mise en cache des invites [1] — tout cela via la même interface compatible avec OpenAI, donc l'extension du client est principalement une question d'ajout de paramètres standard. Commencez avec le niveau gratuit pour confirmer votre configuration, puis changez l'ID du modèle en mimo-v2.6-pro pour une utilisation régulière.
Sources
- [1] Page modèle AIHubMix,
mimo-v2.6-pro: https://aihubmix.com/model/mimo-v2.6-pro (consulté le 28 septembre 2026) - [2] Page modèle AIHubMix,
xiaomi-mimo-v2.6-pro-free: https://aihubmix.com/model/xiaomi-mimo-v2.6-pro-free (consulté le 28 septembre 2026) - [3] ID de variantes et notes de format provenant de l'endpoint
GET /v1/modelset des pages de modèles AIHubMix (consulté le 28 septembre 2026) - [4] Notes de version de Xiaomi MiMo, série V2.6 : https://mimo.mi.com/docs/en-US/news/latest/v2-6 (consulté le 28 septembre 2026)
- [5] Page modèle AIHubMix,
mimo-v2.5-pro: https://aihubmix.com/model/mimo-v2.5-pro (consulté le 28 septembre 2026) - [6] Documentation produit AIHubMix : https://docs.aihubmix.com/en (consulté le 28 septembre 2026)



