Krótko mówiąc: wskaż oficjalne openai SDK Python na https://aihubmix.com/v1, użyj identyfikatora modelu mimo-v2.6-pro, i uwierzytelnij się za pomocą swojego klucza AIHubMix. API jest zgodne z OpenAI (można je wywoływać w tym samym formacie co OpenAI), więc nie jest wymagany żaden specjalny klient. Konfiguracja zajmuje około pięciu minut.
Kluczowe punkty
- API zgodne z OpenAI — zmień
base_url, nic więcej - Płatny
mimo-v2.6-pro· darmowyxiaomi-mimo-v2.6-pro-free[1] [2] - $0.48/M wejście · $0.96/M wyjście [1]
- Darmowy poziom 5 zapytań/min · 100/dzień · 1M tokenów/dzień [2]
- Kontext 1.05M tokenów · maksymalne wyjście 131K tokenów [1]
- Wymagania: Python 3.9+, klucz API AIHubMix
Wartości odniesienia
| Podstawowy URL | https://aihubmix.com/v1 |
| Protokół | OpenAI Chat Completions |
| Identyfikator płatnego modelu | mimo-v2.6-pro |
| Identyfikator darmowego modelu | xiaomi-mimo-v2.6-pro-free |
| Cennik (płatny) | $0.48/M wejście · $0.96/M wyjście · $0.0038/M odczyt z pamięci podręcznej [1] |
| Limity darmowego poziomu | 5 req/min · 100 req/dzień · 1M tokenów/dzień [2] |
| Okno kontekstu | 1.05M tokenów [1] |
| Maksymalne wyjście | 131K tokenów [1] |
| Modalności wejściowe | Tekst, wizja, dźwięk, wideo — tylko tekstowe wyjście [1] |
| Wymienione funkcje | Streaming, wywoływanie narzędzi, strukturalne wyjścia, pamięć podręczna zapytań [1] |
Czy powinieneś używać v2.6 Pro czy v2.5 Pro?
Użyj v2.6 Pro. Jest w tej samej cenie i akceptuje więcej rodzajów wejść.
mimo-v2.5-pro | mimo-v2.6-pro | |
|---|---|---|
| Wejście | Tylko tekst [5] | Tekst, wizja, dźwięk, wideo [1] |
| Cena wejścia/wyjścia | $0.48/M · $0.96/M [5] | $0.48/M · $0.96/M [1] |
| Kontekst / maksymalne wyjście | 1.05M · 131K [5] | 1.05M · 131K [1] |
| Dostępność | Wycofanie 21 października 2026 [5] | Aktualny [1] |
Notatki wydania Xiaomi mówią, że V2.6 "przyjmuje tę samą cenę API co seria V2.5" i przyznają V2.6-Pro 46 punktów w Indeksie Analizy Sztucznej Inteligencji — najwyższy wynik open-source w momencie pisania, wyżej niż Kimi K3 i Qwen3.8 Max, a poniżej Claude Fable 5.1 i GPT-6 Astra [4]. Najwyraźniejsza linia generacji w notatkach dotyczy tańszego modelu: V2.6-Flash "kompleksowo przewyższył MiMo-V2.5-Pro" [4].
Dwie rzeczy, o których warto pamiętać. Xiaomi nie opublikowało bezpośredniej tabeli porównawczej V2.6-Pro i V2.5-Pro, więc powyższe porównanie dotyczy specyfikacji i ceny. A mimo-v2.5-pro ma być wycofany 21 października 2026 z mimo-v2.6-pro jako docelowym modelem migracyjnym [5], więc wszystko nowe zbudowane na v2.5 będzie musiało być przeniesione niemal natychmiast.
Dlaczego AIHubMix
- Zmiana tylko
base_url. Brama obsługuje format OpenAI Chat Completions, więc oficjalne SDK działa bez modyfikacji. Format/v1/messages(beta) i natywne wywołania Gemini są dostępne na tym samym kluczu [6]. - Jeden klucz obejmuje wielu dostawców.
GET /v1/modelszwrócił 416 identyfikatorów modeli w dniu konfiguracji, z czego 21 to warianty MiMo [3]. Zmiana modelu oznacza zmianę jednego ciągu w twoim skrypcie. - Możesz najpierw przetestować za darmo.
xiaomi-mimo-v2.6-pro-freekosztuje $0 w ramach 5 zapytań/min, 100/dzień i 1M tokenów/dzień [2] — wystarczająco, aby udowodnić, że konfiguracja działa przed wydaniem czegokolwiek. - Brak subskrypcji. Rozliczenia są na zasadzie pay-as-you-go bez członkostwa ani miesięcznej opłaty [6], a płatna stawka MiMo odpowiada stronie modelu w wysokości $0.48/M w wejściu i $0.96/M w wyjściu [1].
- Debugowanie jest szybsze. Jeśli wywołanie się nie powiedzie, wskaż ten sam skrypt na model innego dostawcy. Sukces tam oznacza, że twój klucz, URL i kształt żądania są poprawne, a problem dotyczy modelu — jedno wywołanie zamiast całego popołudnia.
Jak to skonfigurować
1. Utwórz projekt
mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"
2. Przechowaj swój klucz
printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore
Nigdy nie wpisuj klucza na stałe w swoim skrypcie i nigdy nie dodawaj .env do repozytorium.
3. Utwórz klienta
Zapisz jako chat.py:
import os
import sys
from dotenv import load_dotenv
from openai import OpenAI
load_dotenv()
client = OpenAI(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com/v1",
)
prompt = sys.argv[1] if len(sys.argv) > 1 else "Przedstaw się w jednym zdaniu."
stream = client.chat.completions.create(
model="mimo-v2.6-pro",
messages=[{"role": "user", "content": prompt}],
max_tokens=1024,
stream=True,
)
for chunk in stream:
if not chunk.choices:
continue
piece = chunk.choices[0].delta.content
if piece:
print(piece, end="", flush=True)
print()
Utrzymuj oba sprawdzenia wewnątrz pętli. Niektóre fragmenty przychodzą z pustą choices tablicą, co powoduje IndexError jeśli są indeksowane; a delta.content może być None w pierwszych i ostatnich klatkach, co print wyświetli jako dosłowny tekst None.
4. Uruchom to
.venv/bin/python chat.py "Przedstaw się w jednym zdaniu."
Jestem MiMo, dużym modelem językowym opracowanym przez zespół LLM Core Xiaomi, tutaj, aby pomóc w odpowiadaniu na pytania, pisaniu i szerokim zakresie pomocnych zadań.
Oczekuj około sześciu sekund na pierwsze tokeny, w porównaniu do 6.4s podanych na stronie modelu [1].
5. Dostosuj w razie potrzeby
W przypadku wywołania, które nie jest strumieniowe, usuń stream=True i odczytaj response.choices[0].message.content. Aby zmienić modele, zmień argument model. Zwiększ max_tokens dla dłuższego wyjścia — domyślna wartość 1024 powyżej jest znacznie poniżej limitu modelu [1].
Lista kontrolna
- [ ] Utworzono Virtualenv;
openaiipython-dotenvzainstalowane - [ ]
.envzawiera twój prawdziwy klucz,chmod 600 - [ ]
.envwymienione w.gitignore - [ ]
base_urljesthttps://aihubmix.com/v1— wymagany jest/v1 - [ ] Identyfikator modelu to
mimo-v2.6-pro(płatny) lubxiaomi-mimo-v2.6-pro-free(darmowy) - [ ] Pętla strumieniowa chroni
chunk.choicesidelta.content - [ ] Testowe wywołanie zwraca tekst
FAQ
Czy API jest naprawdę zgodne z OpenAI? Tak — standardowe Chat Completions. Każdy klient zgodny z OpenAI działa, ustawiając podstawowy URL na https://aihubmix.com/v1 i przekazując swój klucz AIHubMix jako token nośny. Dokumentacja AIHubMix zauważa, że coding-xiaomi-mimo-v2.6-flash obsługuje tylko formaty zgodne z OpenAI [3].
Który identyfikator modelu powinienem użyć? mimo-v2.6-pro dla płatnego, xiaomi-mimo-v2.6-pro-free dla darmowego. Dwa poziomy używają różnych konwencji nazewnictwa — darmowe warianty mają prefiks xiaomi- , a płatne nie, co łatwo pomylić.
Jakie inne warianty są dostępne? mimo-v2.6-pro-ultraspeed, mimo-v2.6-flash, mimo-v2.5-pro, oraz identyfikatory dostosowane do kodowania, takie jak coding-xiaomi-mimo-v2.6-pro [3]. Wymień je z API:
curl -s https://aihubmix.com/v1/models \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
| python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
if 'mimo' in i: print(i)
"
Otrzymuję 429 — co to oznacza? To zależy od komunikatu, a dwa przypadki wymagają przeciwstawnego traktowania. "ograniczenie szybkości przez dostawcę" to throttling na minutę: poczekaj i spróbuj ponownie. "osiągnięto limit darmowego modelu" oznacza, że darmowy limit twojego konta jest wyczerpany i jest dzielony między darmowe modele — ponowne próby nie pomogą, więc przełącz się na mimo-v2.6-pro.
Otrzymuję 400 "nie może być obsługiwane w tej chwili". Najpierw potwierdź identyfikator w API:
curl -s https://aihubmix.com/v1/models \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
| python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"
Jeśli to wydrukuje True, powtórz wywołanie czatu za pomocą curl i szukaj "code": "no_available_channel". To oznacza, że model jest wymieniony, ale nie ma dostępnej pojemności w danym momencie — warunek po stronie dostawcy, którego żaden lokalny zmiana nie naprawi. Poczekaj lub skontaktuj się z pomocą techniczną AIHubMix z identyfikatorem żądania z odpowiedzi.
Jak mogę stwierdzić, czy problem jest po mojej stronie, czy po stronie dostawcy? Wywołaj model innego dostawcy tym samym kluczem i skryptem — na przykład gpt-4o-mini. Jeśli to się powiedzie, twój klucz, podstawowy URL i format żądania są poprawne, a problem dotyczy tego konkretnego modelu. Jeśli również się nie powiedzie, sprawdź swój klucz i rozliczenia.
Dlaczego moje wyjście jest ucięte w połowie zdania? Osiągnąłeś max_tokens, a nie limit modelu. Zwiększ go.
Jak sprawdzić status mojego konta?
curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
-H "Authorization: Bearer $AIHUBMIX_API_KEY"
Sprawdź has_payment_method i pola limitów.
Kolejne kroki
Powyższy skrypt to działająca podstawa. Wymienione możliwości MiMo v2.6 Pro obejmują wywoływanie narzędzi, strukturalne wyjścia, wejście wizji i dźwięku oraz pamięć podręczną zapytań [1] — wszystko przez ten sam interfejs zgodny z OpenAI, więc rozszerzenie klienta to głównie kwestia dodania standardowych parametrów. Zacznij od darmowego poziomu, aby potwierdzić swoją konfigurację, a następnie zmień identyfikator modelu na mimo-v2.6-pro do regularnego użytku.
Źródła
- [1] Strona modelu AIHubMix,
mimo-v2.6-pro: https://aihubmix.com/model/mimo-v2.6-pro (dostęp 28 września 2026) - [2] Strona modelu AIHubMix,
xiaomi-mimo-v2.6-pro-free: https://aihubmix.com/model/xiaomi-mimo-v2.6-pro-free (dostęp 28 września 2026) - [3] Identyfikatory wariantów i uwagi dotyczące formatu z
GET /v1/modelspunktu końcowego oraz stron modeli AIHubMix (dostęp 28 września 2026) - [4] Notatki wydania Xiaomi MiMo, seria V2.6: https://mimo.mi.com/docs/en-US/news/latest/v2-6 (dostęp 28 września 2026)
- [5] Strona modelu AIHubMix,
mimo-v2.5-pro: https://aihubmix.com/model/mimo-v2.5-pro (dostęp 28 września 2026) - [6] Dokumentacja produktu AIHubMix: https://docs.aihubmix.com/en (dostęp 28 września 2026)



