In breve: punta il SDK Python ufficiale openai a https://aihubmix.com/v1, utilizza l'ID modello mimo-v2.6-pro e autentica con la tua chiave AIHubMix. L'API è compatibile con OpenAI (richiamabile nello stesso formato di OpenAI), quindi non è necessario alcun client speciale. L'installazione richiede circa cinque minuti.
Punti chiave
- API compatibile con OpenAI — cambia
base_url, nient'altro - Modello a pagamento
mimo-v2.6-pro· modello gratuitoxiaomi-mimo-v2.6-pro-free[1] [2] - $0.48/M input · $0.96/M output [1]
- Limiti del livello gratuito 5 richieste/min · 100/giorno · 1M token/giorno [2]
- Contesto 1.05M token · output massimo 131K token [1]
- Requisiti: Python 3.9+, una chiave API AIHubMix
Valori di riferimento
| Base URL | https://aihubmix.com/v1 |
| Protocollo | OpenAI Chat Completions |
| ID modello a pagamento | mimo-v2.6-pro |
| ID modello gratuito | xiaomi-mimo-v2.6-pro-free |
| Prezzi (a pagamento) | $0.48/M input · $0.96/M output · $0.0038/M lettura cache [1] |
| Limiti del livello gratuito | 5 req/min · 100 req/giorno · 1M token/giorno [2] |
| Finestra di contesto | 1.05M token [1] |
| Output massimo | 131K token [1] |
| Modalità di input | Testo, visione, audio, video — output solo testo [1] |
| Funzionalità elencate | Streaming, chiamata di strumenti, output strutturati, caching dei prompt [1] |
Dovresti usare v2.6 Pro o v2.5 Pro?
Usa v2.6 Pro. Ha lo stesso prezzo e accetta più tipi di input.
mimo-v2.5-pro | mimo-v2.6-pro | |
|---|---|---|
| Input | Solo testo [5] | Testo, visione, audio, video [1] |
| Prezzo in / out | $0.48/M · $0.96/M [5] | $0.48/M · $0.96/M [1] |
| Contesto / output massimo | 1.05M · 131K [5] | 1.05M · 131K [1] |
| Disponibilità | Ritirato il 21 ottobre 2026 [5] | Attuale [1] |
Le note di rilascio di Xiaomi affermano che V2.6 "adotta la stessa struttura dei prezzi API della serie V2.5" e danno a V2.6-Pro 46 punti sull'Artificial Analysis Intelligence Index — il punteggio open-source più alto al momento della scrittura, sopra Kimi K3 e Qwen3.8 Max e sotto Claude Fable 5.1 e GPT-6 Astra [4]. La linea più chiara di generazione in generazione nelle note riguarda il modello più economico: V2.6-Flash "ha superato complessivamente MiMo-V2.5-Pro" [4].
Due cose da tenere a mente. Xiaomi non ha pubblicato una tabella di benchmark diretta tra V2.6-Pro e V2.5-Pro, quindi il confronto sopra è basato su specifiche e prezzi. E mimo-v2.5-pro è programmato per essere ritirato il 21 ottobre 2026 con mimo-v2.6-pro designato come obiettivo di migrazione [5], quindi qualsiasi nuova costruzione basata su v2.5 dovrebbe essere spostata quasi immediatamente.
Perché AIHubMix
- Devi solo cambiare
base_url. Il gateway parla il formato OpenAI Chat Completions, quindi l'SDK ufficiale funziona senza modifiche. Le chiamate in formato Anthropic/v1/messages(beta) e native Gemini sono disponibili con la stessa chiave [6]. - Una chiave copre molti fornitori.
GET /v1/modelsha restituito 416 ID modello il giorno dell'installazione, 21 dei quali varianti MiMo [3]. Cambiare modello significa cambiare una stringa nel tuo script. - Puoi testare gratuitamente prima.
xiaomi-mimo-v2.6-pro-freecosta $0 entro 5 richieste/min, 100/giorno e 1M token/giorno [2] — abbastanza per dimostrare che l'installazione funziona prima di spendere qualcosa. - Nessun abbonamento. La fatturazione è pay-as-you-go senza costi di iscrizione o mensili [6], e la tariffa MiMo a pagamento corrisponde alla pagina del modello a $0.48/M in e $0.96/M out [1].
- Il debug è più veloce. Se una chiamata fallisce, punta lo stesso script a un modello di un altro fornitore. Un successo lì significa che la tua chiave, URL e forma della richiesta sono a posto, e il problema è il modello — una chiamata invece di un pomeriggio.
Come configurarlo
1. Crea il progetto
mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"
2. Memorizza la tua chiave
printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore
Non hardcodare mai la chiave nel tuo script e non impegnare mai .env.
3. Crea il client
Salva come chat.py:
import os
import sys
from dotenv import load_dotenv
from openai import OpenAI
load_dotenv()
client = OpenAI(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com/v1",
)
prompt = sys.argv[1] if len(sys.argv) > 1 else "Presentati in una frase."
stream = client.chat.completions.create(
model="mimo-v2.6-pro",
messages=[{"role": "user", "content": prompt}],
max_tokens=1024,
stream=True,
)
for chunk in stream:
if not chunk.choices:
continue
piece = chunk.choices[0].delta.content
if piece:
print(piece, end="", flush=True)
print()
Mantieni entrambi i controlli all'interno del ciclo. Alcuni chunk arrivano con un array choices vuoto, il che solleva IndexError se indicizzato; delta.content è None sui primi e ultimi frame, il che print outputterebbe come il testo letterale None.
4. Eseguilo
.venv/bin/python chat.py "Presentati in una frase."
Sono MiMo, un grande modello linguistico sviluppato dal team LLM di Xiaomi, qui per assisterti con risposte a domande, scrittura e una vasta gamma di compiti utili.
Aspettati circa sei secondi per i primi token, contro i 6.4s elencati nella pagina del modello [1].
5. Regola secondo necessità
Per una chiamata non streaming, rimuovi stream=True e leggi response.choices[0].message.content. Per cambiare modello, modifica l'argomento model. Aumenta max_tokens per un output più lungo — il valore predefinito di 1024 sopra è ben al di sotto del limite del modello [1].
Lista di controllo
- [ ] Virtualenv creato;
openaiepython-dotenvinstallati - [ ]
.envcontiene la tua chiave reale,chmod 600 - [ ]
.envelencato in.gitignore - [ ]
base_urlèhttps://aihubmix.com/v1— il/v1è richiesto - [ ] L'ID modello è
mimo-v2.6-pro(a pagamento) oxiaomi-mimo-v2.6-pro-free(gratuito) - [ ] I controlli del ciclo di streaming proteggono
chunk.choicesedelta.content - [ ] Una chiamata di test restituisce testo
FAQ
L'API è davvero compatibile con OpenAI? Sì — Chat Completions standard. Qualsiasi client compatibile con OpenAI funziona impostando l'URL di base su https://aihubmix.com/v1 e passando la tua chiave AIHubMix come token bearer. La documentazione di AIHubMix nota che coding-xiaomi-mimo-v2.6-flash supporta solo formati compatibili con OpenAI [3].
Quale ID modello dovrei usare? mimo-v2.6-pro per a pagamento, xiaomi-mimo-v2.6-pro-free per gratuito. I due livelli utilizzano convenzioni di denominazione diverse — le varianti gratuite portano il prefisso xiaomi- e quelle a pagamento no, il che è facile da confondere.
Quali altre varianti sono disponibili? mimo-v2.6-pro-ultraspeed, mimo-v2.6-flash, mimo-v2.5-pro e ID ottimizzati per la codifica come coding-xiaomi-mimo-v2.6-pro [3]. Elencali dall'API:
curl -s https://aihubmix.com/v1/models \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
| python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
if 'mimo' in i: print(i)
"
Ricevo 429 — cosa significa? Dipende dal messaggio, e i due casi necessitano di gestioni opposte. "rate limited by provider" è un throttling per minuto: aspetta e riprova. "raggiunto il limite della quota del modello gratuito" significa che la quota gratuita del tuo account è esaurita e condivisa tra i modelli gratuiti — riprovare non aiuterà, quindi passa a mimo-v2.6-pro.
Ricevo 400 "non può essere servito al momento". Prima conferma l'ID contro l'API:
curl -s https://aihubmix.com/v1/models \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
| python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"
Se questo stampa True, ripeti la chiamata chat con curl e cerca "code": "no_available_channel". Questo significa che il modello è elencato ma non ha capacità upstream in quel momento — una condizione lato fornitore che nessuna modifica locale risolverà. Aspetta, o contatta il supporto AIHubMix con l'ID richiesta dalla risposta.
Come posso capire se un problema è mio o del fornitore? Chiama un modello di un fornitore diverso con la stessa chiave e script — ad esempio gpt-4o-mini. Se ha successo, la tua chiave, URL di base e formato della richiesta sono corretti e il problema è quel modello specifico. Se fallisce anche, controlla la tua chiave e la fatturazione.
Perché il mio output è tagliato a metà frase? Hai raggiunto max_tokens, non un limite del modello. Aumentalo.
Come faccio a controllare lo stato del mio account?
curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
-H "Authorization: Bearer $AIHUBMIX_API_KEY"
Guarda has_payment_method e i campi limite.
Prossimi passi
Lo script sopra è una base funzionante. Le capacità elencate di MiMo v2.6 Pro includono chiamate a strumenti, output strutturati, input visivi e audio, e caching dei prompt [1] — tutto attraverso la stessa interfaccia compatibile con OpenAI, quindi estendere il client è per lo più una questione di aggiungere parametri standard. Inizia con il livello gratuito per confermare la tua installazione, poi cambia l'ID modello in mimo-v2.6-pro per un uso regolare.
Fonti
- [1] Pagina modello AIHubMix,
mimo-v2.6-pro: https://aihubmix.com/model/mimo-v2.6-pro (accesso 28 settembre 2026) - [2] Pagina modello AIHubMix,
xiaomi-mimo-v2.6-pro-free: https://aihubmix.com/model/xiaomi-mimo-v2.6-pro-free (accesso 28 settembre 2026) - [3] ID varianti e note di formato dall'endpoint
GET /v1/modelse pagine modello AIHubMix (accesso 28 settembre 2026) - [4] Note di rilascio Xiaomi MiMo, serie V2.6: https://mimo.mi.com/docs/en-US/news/latest/v2-6 (accesso 28 settembre 2026)
- [5] Pagina modello AIHubMix,
mimo-v2.5-pro: https://aihubmix.com/model/mimo-v2.5-pro (accesso 28 settembre 2026) - [6] Documentazione prodotto AIHubMix: https://docs.aihubmix.com/en (accesso 28 settembre 2026)



