Как да използвате Xiaomi MiMo v2.6 Pro на AIHubMix: Ръководство за настройка

AIHubMix6 мин четене
Как да използвате Xiaomi MiMo v2.6 Pro на AIHubMix: Ръководство за настройка

Накратко: насочете официалния openai Python SDK към https://aihubmix.com/v1, използвайте идентификатор на модела mimo-v2.6-pro и се удостоверете с вашия ключ за AIHubMix. API-то е съвместимо с OpenAI (може да се извиква в същия формат като на OpenAI), така че не е необходим специален клиент. Настройката отнема около пет минути.

Ключови точки

  • API, съвместимо с OpenAI — променете base_url, нищо друго
  • Платен mimo-v2.6-pro · безплатен xiaomi-mimo-v2.6-pro-free [1] [2]
  • $0.48/M вход · $0.96/M изход [1]
  • Безплатен план 5 заявки/мин · 100/ден · 1M токена/ден [2]
  • Контекст 1.05M токена · максимален изход 131K токена [1]
  • Изисквания: Python 3.9+, ключ за API на AIHubMix

Референтни стойности

Основен URLhttps://aihubmix.com/v1
ПротоколOpenAI Chat Completions
Платен идентификатор на моделаmimo-v2.6-pro
Безплатен идентификатор на моделаxiaomi-mimo-v2.6-pro-free
Цени (платени)$0.48/M вход · $0.96/M изход · $0.0038/M четене от кеш [1]
Ограничения на безплатния план5 req/min · 100 req/day · 1M токена/ден [2]
Контекстен прозорец1.05M токена [1]
Максимален изход131K токена [1]
Входни модалностиТекст, визия, аудио, видео — само текстов изход [1]
Изброени функцииСтрийминг, извикване на инструменти, структурирани изходи, кеширане на подканвания [1]

Трябва ли да използвате v2.6 Pro или v2.5 Pro?

Използвайте v2.6 Pro. Цената е същата и приема повече видове вход.

mimo-v2.5-promimo-v2.6-pro
ВходСамо текст [5]Текст, визия, аудио, видео [1]
Цена за вход/изход$0.48/M · $0.96/M [5]$0.48/M · $0.96/M [1]
Контекст / максимален изход1.05M · 131K [5]1.05M · 131K [1]
НаличностИзтегляне на 21 октомври 2026 [5]Текущ [1]

Според бележките за издаване на Xiaomi, V2.6 "прилага същата ценова структура на API-то като серията V2.5" и дава на V2.6-Pro 46 точки в Индекса за изкуствен анализ на интелигентността — най-високата оценка за отворен код към момента на писане, над Kimi K3 и Qwen3.8 Max и под Claude Fable 5.1 и GPT-6 Astra [4]. Най-ясната линия от поколение на поколение в бележките е относно по-евтиния модел: V2.6-Flash "значително надминава MiMo-V2.5-Pro" [4].

Две неща, които трябва да имате предвид. Xiaomi не е публикувала директна таблица за сравнение между V2.6-Pro и V2.5-Pro, така че сравнението по-горе е на базата на спецификации и цена. И mimo-v2.5-pro е планирано да бъде изтеглено на 21 октомври 2026 с mimo-v2.6-pro като цел за мигриране [5], така че всичко ново, построено на v2.5, ще трябва да бъде преместено почти веднага.

Защо AIHubMix

  • Просто променяте base_url. Шлюзът говори на формата OpenAI Chat Completions, така че официалният SDK работи без модификации. Форматът на Anthropic /v1/messages (бета) и местните извиквания на Gemini са налични с един и същ ключ [6].
  • Един ключ покрива много доставчици. GET /v1/models върна 416 идентификатора на модели в деня на настройката, 21 от тях са варианти на MiMo [3]. Промяната на модела означава промяна на една стринг в скрипта ви.
  • Можете първо да тествате безплатно. xiaomi-mimo-v2.6-pro-free струва $0 в рамките на 5 заявки/мин, 100/ден и 1M токена/ден [2] — достатъчно, за да докажете, че настройката работи, преди да похарчите нещо.
  • Без абонамент. Фактурирането е на принципа "плати колкото ползваш" без членство или месечна такса [6], а платената ставка на MiMo съвпада с цената на модела от $0.48/M вход и $0.96/M изход [1].
  • Отстраняването на грешки е по-бързо. Ако извикването не успее, насочете същия скрипт към модел на друг доставчик. Успех там означава, че вашият ключ, URL и форма на заявката са в ред, а проблемът е в модела — едно извикване вместо следобед работа.

Как да го настроите

1. Създайте проекта

mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"

2. Съхранете ключа си

printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore

Никога не записвайте ключа в скрипта си и никога не ангажирайте .env.

3. Създайте клиента

Запазете като chat.py:

import os
import sys

from dotenv import load_dotenv
from openai import OpenAI

load_dotenv()

client = OpenAI(
    api_key=os.environ["AIHUBMIX_API_KEY"],
    base_url="https://aihubmix.com/v1",
)

prompt = sys.argv[1] if len(sys.argv) > 1 else "Представете се с едно изречение."

stream = client.chat.completions.create(
    model="mimo-v2.6-pro",
    messages=[{"role": "user", "content": prompt}],
    max_tokens=1024,
    stream=True,
)

for chunk in stream:
    if not chunk.choices:
        continue
    piece = chunk.choices[0].delta.content
    if piece:
        print(piece, end="", flush=True)
print()

Дръжте и двете проверки вътре в цикъла. Някои парчета пристигат с празен choices масив, което повдига IndexError ако се индексира; delta.content може да бъде None в първите и последните кадри, което print би изписало като буквален текст None.

4. Изпълнете го

.venv/bin/python chat.py "Представете се с едно изречение."
Аз съм MiMo, голям езиков модел, разработен от екипа на LLM на Xiaomi, тук, за да помогна с отговори на въпроси, писане и широк спектър от полезни задачи.

Очаквайте около шест секунди до първите токени, спрямо 6.4s, посочени на страницата на модела [1].

5. Настройте според нуждите

За извикване без стрийминг, премахнете stream=True и прочетете response.choices[0].message.content. За да смените модели, променете аргумента model. Увеличете max_tokens за по-дълъг изход — стойността по подразбиране от 1024 по-горе е значително под лимита на модела [1].

Контролен списък

  • [ ] Създаден виртуален env; openai и python-dotenv инсталирани
  • [ ] .env съдържа вашия реален ключ, chmod 600
  • [ ] .env изброен в .gitignore
  • [ ] base_url е https://aihubmix.com/v1 — /v1 е задължителен
  • [ ] Идентификатор на модела е mimo-v2.6-pro (платен) или xiaomi-mimo-v2.6-pro-free (безплатен)
  • [ ] Стрийминг цикълът защитава chunk.choices и delta.content
  • [ ] Тестовото извикване връща текст

Често задавани въпроси

Наистина ли API-то е съвместимо с OpenAI? Да — стандартни Chat Completions. Всеки клиент, съвместим с OpenAI, работи, като зададете основния URL на https://aihubmix.com/v1 и предадете ключа си за AIHubMix като токен за носител. Документацията на AIHubMix отбелязва, че coding-xiaomi-mimo-v2.6-flash поддържа само формати, съвместими с OpenAI [3].

Кой идентификатор на модела трябва да използвам? mimo-v2.6-pro за платен, xiaomi-mimo-v2.6-pro-free за безплатен. Двете нива използват различни наименования — безплатните варианти носят префикса xiaomi- а платените не, което е лесно да се обърка.

Какви други варианти са налични? mimo-v2.6-pro-ultraspeed, mimo-v2.6-flash, mimo-v2.5-pro и идентификатори, настроени за кодиране, като coding-xiaomi-mimo-v2.6-pro [3]. Изброявайте ги от API:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
    if 'mimo' in i: print(i)
"

Получавам 429 — какво означава това? Зависи от съобщението, а двете ситуации изискват противоположно управление. "ограничен от доставчика" е ограничение на база на минута: изчакайте и опитайте отново. "достигнат лимита на безплатния модел" означава, че безплатният лимит на вашия акаунт е изчерпан и е споделен между безплатните модели — повторното опитване няма да помогне, така че преминете на mimo-v2.6-pro.

Получавам 400 "не може да бъде обслужен в момента". Първо потвърдете идентификатора спрямо API:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"

Ако това изведе True, повторете извикването на чата с curl и потърсете "code": "no_available_channel". Това означава, че моделът е изброен, но в момента няма капацитет нагоре — условие от страна на доставчика, което няма да бъде поправено с местна промяна. Изчакайте или се свържете с поддръжката на AIHubMix с идентификатора на заявката от отговора.

Как мога да разбера дали проблемът е мой или на доставчика? Извикайте модел на друг доставчик със същия ключ и скрипт — например gpt-4o-mini. Ако успее, вашият ключ, основен URL и формат на заявката са правилни и проблемът е в конкретния модел. Ако не успее, проверете ключа и фактурирането си.

Защо изходът ми е прекъснат в средата на изречението? Достигнали сте max_tokens, а не лимит на модела. Увеличете го.

Как да проверя статуса на акаунта си?

curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY"

Погледнете has_payment_method и полетата с лимити.

Следващи стъпки

Скриптът по-горе е работеща основа. Изброените възможности на MiMo v2.6 Pro включват извикване на инструменти, структурирани изходи, вход от визия и аудио, и кеширане на подканвания [1] — всичко това през същия интерфейс, съвместим с OpenAI, така че разширяването на клиента е предимно въпрос на добавяне на стандартни параметри. Започнете с безплатния план, за да потвърдите настройката си, след което сменете идентификатора на модела на mimo-v2.6-pro за редовна употреба.


Източници

  • [1] Страница на модела AIHubMix, mimo-v2.6-pro: https://aihubmix.com/model/mimo-v2.6-pro (достъп до 28 септември 2026)
  • [2] Страница на модела AIHubMix, xiaomi-mimo-v2.6-pro-free: https://aihubmix.com/model/xiaomi-mimo-v2.6-pro-free (достъп до 28 септември 2026)
  • [3] Идентификатори на варианти и бележки за формати от GET /v1/models крайна точка и страниците на моделите AIHubMix (достъп до 28 септември 2026)
  • [4] Бележки за издаване на Xiaomi MiMo, серия V2.6: https://mimo.mi.com/docs/en-US/news/latest/v2-6 (достъп до 28 септември 2026)
  • [5] Страница на модела AIHubMix, mimo-v2.5-pro: https://aihubmix.com/model/mimo-v2.5-pro (достъп до 28 септември 2026)
  • [6] Документация на продукта AIHubMix: https://docs.aihubmix.com/en (достъп до 28 септември 2026)