Jak używać Xiaomi MiMo v2.6 Pro na AIHubMix: Przewodnik po konfiguracji

AIHubMix6 min czytania
Jak używać Xiaomi MiMo v2.6 Pro na AIHubMix: Przewodnik po konfiguracji

Krótko mówiąc: wskaż oficjalne openai SDK Python na https://aihubmix.com/v1, użyj identyfikatora modelu mimo-v2.6-pro, i uwierzytelnij się za pomocą swojego klucza AIHubMix. API jest zgodne z OpenAI (można je wywoływać w tym samym formacie co OpenAI), więc nie jest wymagany żaden specjalny klient. Konfiguracja zajmuje około pięciu minut.

Kluczowe punkty

  • API zgodne z OpenAI — zmień base_url, nic więcej
  • Płatny mimo-v2.6-pro · darmowy xiaomi-mimo-v2.6-pro-free [1] [2]
  • $0.48/M wejście · $0.96/M wyjście [1]
  • Darmowy poziom 5 zapytań/min · 100/dzień · 1M tokenów/dzień [2]
  • Kontext 1.05M tokenów · maksymalne wyjście 131K tokenów [1]
  • Wymagania: Python 3.9+, klucz API AIHubMix

Wartości odniesienia

Podstawowy URLhttps://aihubmix.com/v1
ProtokółOpenAI Chat Completions
Identyfikator płatnego modelumimo-v2.6-pro
Identyfikator darmowego modeluxiaomi-mimo-v2.6-pro-free
Cennik (płatny)$0.48/M wejście · $0.96/M wyjście · $0.0038/M odczyt z pamięci podręcznej [1]
Limity darmowego poziomu5 req/min · 100 req/dzień · 1M tokenów/dzień [2]
Okno kontekstu1.05M tokenów [1]
Maksymalne wyjście131K tokenów [1]
Modalności wejścioweTekst, wizja, dźwięk, wideo — tylko tekstowe wyjście [1]
Wymienione funkcjeStreaming, wywoływanie narzędzi, strukturalne wyjścia, pamięć podręczna zapytań [1]

Czy powinieneś używać v2.6 Pro czy v2.5 Pro?

Użyj v2.6 Pro. Jest w tej samej cenie i akceptuje więcej rodzajów wejść.

mimo-v2.5-promimo-v2.6-pro
WejścieTylko tekst [5]Tekst, wizja, dźwięk, wideo [1]
Cena wejścia/wyjścia$0.48/M · $0.96/M [5]$0.48/M · $0.96/M [1]
Kontekst / maksymalne wyjście1.05M · 131K [5]1.05M · 131K [1]
DostępnośćWycofanie 21 października 2026 [5]Aktualny [1]

Notatki wydania Xiaomi mówią, że V2.6 "przyjmuje tę samą cenę API co seria V2.5" i przyznają V2.6-Pro 46 punktów w Indeksie Analizy Sztucznej Inteligencji — najwyższy wynik open-source w momencie pisania, wyżej niż Kimi K3 i Qwen3.8 Max, a poniżej Claude Fable 5.1 i GPT-6 Astra [4]. Najwyraźniejsza linia generacji w notatkach dotyczy tańszego modelu: V2.6-Flash "kompleksowo przewyższył MiMo-V2.5-Pro" [4].

Dwie rzeczy, o których warto pamiętać. Xiaomi nie opublikowało bezpośredniej tabeli porównawczej V2.6-Pro i V2.5-Pro, więc powyższe porównanie dotyczy specyfikacji i ceny. A mimo-v2.5-pro ma być wycofany 21 października 2026 z mimo-v2.6-pro jako docelowym modelem migracyjnym [5], więc wszystko nowe zbudowane na v2.5 będzie musiało być przeniesione niemal natychmiast.

Dlaczego AIHubMix

  • Zmiana tylko base_url. Brama obsługuje format OpenAI Chat Completions, więc oficjalne SDK działa bez modyfikacji. Format /v1/messages (beta) i natywne wywołania Gemini są dostępne na tym samym kluczu [6].
  • Jeden klucz obejmuje wielu dostawców. GET /v1/models zwrócił 416 identyfikatorów modeli w dniu konfiguracji, z czego 21 to warianty MiMo [3]. Zmiana modelu oznacza zmianę jednego ciągu w twoim skrypcie.
  • Możesz najpierw przetestować za darmo. xiaomi-mimo-v2.6-pro-free kosztuje $0 w ramach 5 zapytań/min, 100/dzień i 1M tokenów/dzień [2] — wystarczająco, aby udowodnić, że konfiguracja działa przed wydaniem czegokolwiek.
  • Brak subskrypcji. Rozliczenia są na zasadzie pay-as-you-go bez członkostwa ani miesięcznej opłaty [6], a płatna stawka MiMo odpowiada stronie modelu w wysokości $0.48/M w wejściu i $0.96/M w wyjściu [1].
  • Debugowanie jest szybsze. Jeśli wywołanie się nie powiedzie, wskaż ten sam skrypt na model innego dostawcy. Sukces tam oznacza, że twój klucz, URL i kształt żądania są poprawne, a problem dotyczy modelu — jedno wywołanie zamiast całego popołudnia.

Jak to skonfigurować

1. Utwórz projekt

mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"

2. Przechowaj swój klucz

printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore

Nigdy nie wpisuj klucza na stałe w swoim skrypcie i nigdy nie dodawaj .env do repozytorium.

3. Utwórz klienta

Zapisz jako chat.py:

import os
import sys

from dotenv import load_dotenv
from openai import OpenAI

load_dotenv()

client = OpenAI(
    api_key=os.environ["AIHUBMIX_API_KEY"],
    base_url="https://aihubmix.com/v1",
)

prompt = sys.argv[1] if len(sys.argv) > 1 else "Przedstaw się w jednym zdaniu."

stream = client.chat.completions.create(
    model="mimo-v2.6-pro",
    messages=[{"role": "user", "content": prompt}],
    max_tokens=1024,
    stream=True,
)

for chunk in stream:
    if not chunk.choices:
        continue
    piece = chunk.choices[0].delta.content
    if piece:
        print(piece, end="", flush=True)
print()

Utrzymuj oba sprawdzenia wewnątrz pętli. Niektóre fragmenty przychodzą z pustą choices tablicą, co powoduje IndexError jeśli są indeksowane; a delta.content może być None w pierwszych i ostatnich klatkach, co print wyświetli jako dosłowny tekst None.

4. Uruchom to

.venv/bin/python chat.py "Przedstaw się w jednym zdaniu."
Jestem MiMo, dużym modelem językowym opracowanym przez zespół LLM Core Xiaomi, tutaj, aby pomóc w odpowiadaniu na pytania, pisaniu i szerokim zakresie pomocnych zadań.

Oczekuj około sześciu sekund na pierwsze tokeny, w porównaniu do 6.4s podanych na stronie modelu [1].

5. Dostosuj w razie potrzeby

W przypadku wywołania, które nie jest strumieniowe, usuń stream=True i odczytaj response.choices[0].message.content. Aby zmienić modele, zmień argument model. Zwiększ max_tokens dla dłuższego wyjścia — domyślna wartość 1024 powyżej jest znacznie poniżej limitu modelu [1].

Lista kontrolna

  • [ ] Utworzono Virtualenv; openai i python-dotenv zainstalowane
  • [ ] .env zawiera twój prawdziwy klucz, chmod 600
  • [ ] .env wymienione w .gitignore
  • [ ] base_url jest https://aihubmix.com/v1 — wymagany jest /v1
  • [ ] Identyfikator modelu to mimo-v2.6-pro (płatny) lub xiaomi-mimo-v2.6-pro-free (darmowy)
  • [ ] Pętla strumieniowa chroni chunk.choices i delta.content
  • [ ] Testowe wywołanie zwraca tekst

FAQ

Czy API jest naprawdę zgodne z OpenAI? Tak — standardowe Chat Completions. Każdy klient zgodny z OpenAI działa, ustawiając podstawowy URL na https://aihubmix.com/v1 i przekazując swój klucz AIHubMix jako token nośny. Dokumentacja AIHubMix zauważa, że coding-xiaomi-mimo-v2.6-flash obsługuje tylko formaty zgodne z OpenAI [3].

Który identyfikator modelu powinienem użyć? mimo-v2.6-pro dla płatnego, xiaomi-mimo-v2.6-pro-free dla darmowego. Dwa poziomy używają różnych konwencji nazewnictwa — darmowe warianty mają prefiks xiaomi- , a płatne nie, co łatwo pomylić.

Jakie inne warianty są dostępne? mimo-v2.6-pro-ultraspeed, mimo-v2.6-flash, mimo-v2.5-pro, oraz identyfikatory dostosowane do kodowania, takie jak coding-xiaomi-mimo-v2.6-pro [3]. Wymień je z API:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
    if 'mimo' in i: print(i)
"

Otrzymuję 429 — co to oznacza? To zależy od komunikatu, a dwa przypadki wymagają przeciwstawnego traktowania. "ograniczenie szybkości przez dostawcę" to throttling na minutę: poczekaj i spróbuj ponownie. "osiągnięto limit darmowego modelu" oznacza, że darmowy limit twojego konta jest wyczerpany i jest dzielony między darmowe modele — ponowne próby nie pomogą, więc przełącz się na mimo-v2.6-pro.

Otrzymuję 400 "nie może być obsługiwane w tej chwili". Najpierw potwierdź identyfikator w API:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"

Jeśli to wydrukuje True, powtórz wywołanie czatu za pomocą curl i szukaj "code": "no_available_channel". To oznacza, że model jest wymieniony, ale nie ma dostępnej pojemności w danym momencie — warunek po stronie dostawcy, którego żaden lokalny zmiana nie naprawi. Poczekaj lub skontaktuj się z pomocą techniczną AIHubMix z identyfikatorem żądania z odpowiedzi.

Jak mogę stwierdzić, czy problem jest po mojej stronie, czy po stronie dostawcy? Wywołaj model innego dostawcy tym samym kluczem i skryptem — na przykład gpt-4o-mini. Jeśli to się powiedzie, twój klucz, podstawowy URL i format żądania są poprawne, a problem dotyczy tego konkretnego modelu. Jeśli również się nie powiedzie, sprawdź swój klucz i rozliczenia.

Dlaczego moje wyjście jest ucięte w połowie zdania? Osiągnąłeś max_tokens, a nie limit modelu. Zwiększ go.

Jak sprawdzić status mojego konta?

curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY"

Sprawdź has_payment_method i pola limitów.

Kolejne kroki

Powyższy skrypt to działająca podstawa. Wymienione możliwości MiMo v2.6 Pro obejmują wywoływanie narzędzi, strukturalne wyjścia, wejście wizji i dźwięku oraz pamięć podręczną zapytań [1] — wszystko przez ten sam interfejs zgodny z OpenAI, więc rozszerzenie klienta to głównie kwestia dodania standardowych parametrów. Zacznij od darmowego poziomu, aby potwierdzić swoją konfigurację, a następnie zmień identyfikator modelu na mimo-v2.6-pro do regularnego użytku.


Źródła