Накратко: насочете официалния openai Python SDK към https://aihubmix.com/v1, използвайте идентификатор на модела mimo-v2.6-pro и се удостоверете с вашия ключ за AIHubMix. API-то е съвместимо с OpenAI (може да се извиква в същия формат като на OpenAI), така че не е необходим специален клиент. Настройката отнема около пет минути.
Ключови точки
- API, съвместимо с OpenAI — променете
base_url, нищо друго - Платен
mimo-v2.6-pro· безплатенxiaomi-mimo-v2.6-pro-free[1] [2] - $0.48/M вход · $0.96/M изход [1]
- Безплатен план 5 заявки/мин · 100/ден · 1M токена/ден [2]
- Контекст 1.05M токена · максимален изход 131K токена [1]
- Изисквания: Python 3.9+, ключ за API на AIHubMix
Референтни стойности
| Основен URL | https://aihubmix.com/v1 |
| Протокол | OpenAI Chat Completions |
| Платен идентификатор на модела | mimo-v2.6-pro |
| Безплатен идентификатор на модела | xiaomi-mimo-v2.6-pro-free |
| Цени (платени) | $0.48/M вход · $0.96/M изход · $0.0038/M четене от кеш [1] |
| Ограничения на безплатния план | 5 req/min · 100 req/day · 1M токена/ден [2] |
| Контекстен прозорец | 1.05M токена [1] |
| Максимален изход | 131K токена [1] |
| Входни модалности | Текст, визия, аудио, видео — само текстов изход [1] |
| Изброени функции | Стрийминг, извикване на инструменти, структурирани изходи, кеширане на подканвания [1] |
Трябва ли да използвате v2.6 Pro или v2.5 Pro?
Използвайте v2.6 Pro. Цената е същата и приема повече видове вход.
mimo-v2.5-pro | mimo-v2.6-pro | |
|---|---|---|
| Вход | Само текст [5] | Текст, визия, аудио, видео [1] |
| Цена за вход/изход | $0.48/M · $0.96/M [5] | $0.48/M · $0.96/M [1] |
| Контекст / максимален изход | 1.05M · 131K [5] | 1.05M · 131K [1] |
| Наличност | Изтегляне на 21 октомври 2026 [5] | Текущ [1] |
Според бележките за издаване на Xiaomi, V2.6 "прилага същата ценова структура на API-то като серията V2.5" и дава на V2.6-Pro 46 точки в Индекса за изкуствен анализ на интелигентността — най-високата оценка за отворен код към момента на писане, над Kimi K3 и Qwen3.8 Max и под Claude Fable 5.1 и GPT-6 Astra [4]. Най-ясната линия от поколение на поколение в бележките е относно по-евтиния модел: V2.6-Flash "значително надминава MiMo-V2.5-Pro" [4].
Две неща, които трябва да имате предвид. Xiaomi не е публикувала директна таблица за сравнение между V2.6-Pro и V2.5-Pro, така че сравнението по-горе е на базата на спецификации и цена. И mimo-v2.5-pro е планирано да бъде изтеглено на 21 октомври 2026 с mimo-v2.6-pro като цел за мигриране [5], така че всичко ново, построено на v2.5, ще трябва да бъде преместено почти веднага.
Защо AIHubMix
- Просто променяте
base_url. Шлюзът говори на формата OpenAI Chat Completions, така че официалният SDK работи без модификации. Форматът на Anthropic/v1/messages(бета) и местните извиквания на Gemini са налични с един и същ ключ [6]. - Един ключ покрива много доставчици.
GET /v1/modelsвърна 416 идентификатора на модели в деня на настройката, 21 от тях са варианти на MiMo [3]. Промяната на модела означава промяна на една стринг в скрипта ви. - Можете първо да тествате безплатно.
xiaomi-mimo-v2.6-pro-freeструва $0 в рамките на 5 заявки/мин, 100/ден и 1M токена/ден [2] — достатъчно, за да докажете, че настройката работи, преди да похарчите нещо. - Без абонамент. Фактурирането е на принципа "плати колкото ползваш" без членство или месечна такса [6], а платената ставка на MiMo съвпада с цената на модела от $0.48/M вход и $0.96/M изход [1].
- Отстраняването на грешки е по-бързо. Ако извикването не успее, насочете същия скрипт към модел на друг доставчик. Успех там означава, че вашият ключ, URL и форма на заявката са в ред, а проблемът е в модела — едно извикване вместо следобед работа.
Как да го настроите
1. Създайте проекта
mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"
2. Съхранете ключа си
printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore
Никога не записвайте ключа в скрипта си и никога не ангажирайте .env.
3. Създайте клиента
Запазете като chat.py:
import os
import sys
from dotenv import load_dotenv
from openai import OpenAI
load_dotenv()
client = OpenAI(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com/v1",
)
prompt = sys.argv[1] if len(sys.argv) > 1 else "Представете се с едно изречение."
stream = client.chat.completions.create(
model="mimo-v2.6-pro",
messages=[{"role": "user", "content": prompt}],
max_tokens=1024,
stream=True,
)
for chunk in stream:
if not chunk.choices:
continue
piece = chunk.choices[0].delta.content
if piece:
print(piece, end="", flush=True)
print()
Дръжте и двете проверки вътре в цикъла. Някои парчета пристигат с празен choices масив, което повдига IndexError ако се индексира; delta.content може да бъде None в първите и последните кадри, което print би изписало като буквален текст None.
4. Изпълнете го
.venv/bin/python chat.py "Представете се с едно изречение."
Аз съм MiMo, голям езиков модел, разработен от екипа на LLM на Xiaomi, тук, за да помогна с отговори на въпроси, писане и широк спектър от полезни задачи.
Очаквайте около шест секунди до първите токени, спрямо 6.4s, посочени на страницата на модела [1].
5. Настройте според нуждите
За извикване без стрийминг, премахнете stream=True и прочетете response.choices[0].message.content. За да смените модели, променете аргумента model. Увеличете max_tokens за по-дълъг изход — стойността по подразбиране от 1024 по-горе е значително под лимита на модела [1].
Контролен списък
- [ ] Създаден виртуален env;
openaiиpython-dotenvинсталирани - [ ]
.envсъдържа вашия реален ключ,chmod 600 - [ ]
.envизброен в.gitignore - [ ]
base_urlеhttps://aihubmix.com/v1—/v1е задължителен - [ ] Идентификатор на модела е
mimo-v2.6-pro(платен) илиxiaomi-mimo-v2.6-pro-free(безплатен) - [ ] Стрийминг цикълът защитава
chunk.choicesиdelta.content - [ ] Тестовото извикване връща текст
Често задавани въпроси
Наистина ли API-то е съвместимо с OpenAI? Да — стандартни Chat Completions. Всеки клиент, съвместим с OpenAI, работи, като зададете основния URL на https://aihubmix.com/v1 и предадете ключа си за AIHubMix като токен за носител. Документацията на AIHubMix отбелязва, че coding-xiaomi-mimo-v2.6-flash поддържа само формати, съвместими с OpenAI [3].
Кой идентификатор на модела трябва да използвам? mimo-v2.6-pro за платен, xiaomi-mimo-v2.6-pro-free за безплатен. Двете нива използват различни наименования — безплатните варианти носят префикса xiaomi- а платените не, което е лесно да се обърка.
Какви други варианти са налични? mimo-v2.6-pro-ultraspeed, mimo-v2.6-flash, mimo-v2.5-pro и идентификатори, настроени за кодиране, като coding-xiaomi-mimo-v2.6-pro [3]. Изброявайте ги от API:
curl -s https://aihubmix.com/v1/models \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
| python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
if 'mimo' in i: print(i)
"
Получавам 429 — какво означава това? Зависи от съобщението, а двете ситуации изискват противоположно управление. "ограничен от доставчика" е ограничение на база на минута: изчакайте и опитайте отново. "достигнат лимита на безплатния модел" означава, че безплатният лимит на вашия акаунт е изчерпан и е споделен между безплатните модели — повторното опитване няма да помогне, така че преминете на mimo-v2.6-pro.
Получавам 400 "не може да бъде обслужен в момента". Първо потвърдете идентификатора спрямо API:
curl -s https://aihubmix.com/v1/models \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
| python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"
Ако това изведе True, повторете извикването на чата с curl и потърсете "code": "no_available_channel". Това означава, че моделът е изброен, но в момента няма капацитет нагоре — условие от страна на доставчика, което няма да бъде поправено с местна промяна. Изчакайте или се свържете с поддръжката на AIHubMix с идентификатора на заявката от отговора.
Как мога да разбера дали проблемът е мой или на доставчика? Извикайте модел на друг доставчик със същия ключ и скрипт — например gpt-4o-mini. Ако успее, вашият ключ, основен URL и формат на заявката са правилни и проблемът е в конкретния модел. Ако не успее, проверете ключа и фактурирането си.
Защо изходът ми е прекъснат в средата на изречението? Достигнали сте max_tokens, а не лимит на модела. Увеличете го.
Как да проверя статуса на акаунта си?
curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
-H "Authorization: Bearer $AIHUBMIX_API_KEY"
Погледнете has_payment_method и полетата с лимити.
Следващи стъпки
Скриптът по-горе е работеща основа. Изброените възможности на MiMo v2.6 Pro включват извикване на инструменти, структурирани изходи, вход от визия и аудио, и кеширане на подканвания [1] — всичко това през същия интерфейс, съвместим с OpenAI, така че разширяването на клиента е предимно въпрос на добавяне на стандартни параметри. Започнете с безплатния план, за да потвърдите настройката си, след което сменете идентификатора на модела на mimo-v2.6-pro за редовна употреба.
Източници
- [1] Страница на модела AIHubMix,
mimo-v2.6-pro: https://aihubmix.com/model/mimo-v2.6-pro (достъп до 28 септември 2026) - [2] Страница на модела AIHubMix,
xiaomi-mimo-v2.6-pro-free: https://aihubmix.com/model/xiaomi-mimo-v2.6-pro-free (достъп до 28 септември 2026) - [3] Идентификатори на варианти и бележки за формати от
GET /v1/modelsкрайна точка и страниците на моделите AIHubMix (достъп до 28 септември 2026) - [4] Бележки за издаване на Xiaomi MiMo, серия V2.6: https://mimo.mi.com/docs/en-US/news/latest/v2-6 (достъп до 28 септември 2026)
- [5] Страница на модела AIHubMix,
mimo-v2.5-pro: https://aihubmix.com/model/mimo-v2.5-pro (достъп до 28 септември 2026) - [6] Документация на продукта AIHubMix: https://docs.aihubmix.com/en (достъп до 28 септември 2026)



