Как использовать Xiaomi MiMo v2.6 Pro на AIHubMix: руководство по настройке

AIHubMix6 мин чтения
Как использовать Xiaomi MiMo v2.6 Pro на AIHubMix: руководство по настройке

Кратко: укажите официальный openai Python SDK на https://aihubmix.com/v1, используйте идентификатор модели mimo-v2.6-pro и аутентифицируйтесь с помощью вашего ключа AIHubMix. API совместим с OpenAI (вызывается в том же формате, что и у OpenAI), поэтому специальный клиент не требуется. Настройка занимает около пяти минут.

Ключевые моменты

  • API совместим с OpenAI — измените base_url, ничего больше
  • Платный mimo-v2.6-pro · бесплатный xiaomi-mimo-v2.6-pro-free [1] [2]
  • $0.48/M вход · $0.96/M выход [1]
  • Бесплатный уровень 5 запросов/мин · 100/день · 1M токенов/день [2]
  • Контекст 1.05M токенов · максимальный выход 131K токенов [1]
  • Требования: Python 3.9+, ключ API AIHubMix

Справочные значения

Базовый URLhttps://aihubmix.com/v1
ПротоколOpenAI Chat Completions
Идентификатор платной моделиmimo-v2.6-pro
Идентификатор бесплатной моделиxiaomi-mimo-v2.6-pro-free
Цены (платные)$0.48/M вход · $0.96/M выход · $0.0038/M чтение кэша [1]
Ограничения бесплатного уровня5 запросов/мин · 100 запросов/день · 1M токенов/день [2]
Контекстное окно1.05M токенов [1]
Максимальный выход131K токенов [1]
Модальности вводаТекст, зрение, аудио, видео — только текстовый вывод [1]
Перечисленные функцииПотоковая передача, вызов инструментов, структурированные выходы, кэширование подсказок [1]

Стоит ли использовать v2.6 Pro или v2.5 Pro?

Используйте v2.6 Pro. Он стоит столько же и принимает больше видов ввода.

mimo-v2.5-promimo-v2.6-pro
ВводТолько текст [5]Текст, зрение, аудио, видео [1]
Цена за вход/выход$0.48/M · $0.96/M [5]$0.48/M · $0.96/M [1]
Контекст / максимальный выход1.05M · 131K [5]1.05M · 131K [1]
ДоступностьСнимается с продажи 21 октября 2026 [5]Текущий [1]

В релизных заметках Xiaomi говорится, что V2.6 "принимает ту же ценовую политику API, что и серия V2.5" и присваивает V2.6-Pro 46 баллов в Индексе Искусственного Интеллекта Анализа — наивысший открытый балл на момент написания, выше Kimi K3 и Qwen3.8 Max и ниже Claude Fable 5.1 и GPT-6 Astra [4]. Самая четкая линия между поколениями в заметках касается более дешевой модели: V2.6-Flash "всесторонне превзошла MiMo-V2.5-Pro" [4].

Две вещи, которые следует иметь в виду. Xiaomi не опубликовала прямую таблицу сравнений V2.6-Pro и V2.5-Pro, поэтому вышеуказанное сравнение основано на характеристиках и цене. И mimo-v2.5-pro запланировано к снятию с продажи 21 октября 2026 года с mimo-v2.6-pro в качестве целевой модели для миграции [5], так что все новое, построенное на v2.5, нужно будет перенести почти сразу.

Почему AIHubMix

  • Вы меняете только base_url. Шлюз поддерживает формат OpenAI Chat Completions, поэтому официальный SDK работает без изменений. Доступны вызовы формата Anthropic /v1/messages (бета) и нативные вызовы Gemini по тому же ключу [6].
  • Один ключ охватывает множество поставщиков. GET /v1/models вернул 416 идентификаторов моделей в день настройки, 21 из них — варианты MiMo [3]. Изменение модели означает изменение одной строки в вашем скрипте.
  • Вы можете сначала протестировать бесплатно. xiaomi-mimo-v2.6-pro-free стоит $0 в пределах 5 запросов/мин, 100/день и 1M токенов/день [2] — достаточно, чтобы подтвердить, что настройка работает, прежде чем вы что-либо потратите.
  • Нет подписки. Оплата производится по мере использования без членских взносов или ежемесячной платы [6], а платная ставка MiMo соответствует странице модели — $0.48/M на вход и $0.96/M на выход [1].
  • Отладка быстрее. Если вызов не удался, укажите тот же скрипт на модель другого поставщика. Успех в этом случае означает, что ваш ключ, URL и форма запроса в порядке, а проблема заключается в модели — один вызов вместо целого дня.

Как это настроить

1. Создайте проект

mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"

2. Сохраните ваш ключ

printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore

Никогда не прописывайте ключ в вашем скрипте и никогда не коммитьте .env.

3. Создайте клиента

Сохраните как chat.py:

import os
import sys

from dotenv import load_dotenv
from openai import OpenAI

load_dotenv()

client = OpenAI(
    api_key=os.environ["AIHUBMIX_API_KEY"],
    base_url="https://aihubmix.com/v1",
)

prompt = sys.argv[1] if len(sys.argv) > 1 else "Представьтесь одним предложением."

stream = client.chat.completions.create(
    model="mimo-v2.6-pro",
    messages=[{"role": "user", "content": prompt}],
    max_tokens=1024,
    stream=True,
)

for chunk in stream:
    if not chunk.choices:
        continue
    piece = chunk.choices[0].delta.content
    if piece:
        print(piece, end="", flush=True)
print()

Сохраняйте оба условия внутри цикла. Некоторые части приходят с пустым choices массивом, что вызывает IndexError при индексации; также delta.content может быть None в первых и последних кадрах, что print выведет как буквальный текст None.

4. Запустите его

.venv/bin/python chat.py "Представьтесь одним предложением."
Я MiMo, большая языковая модель, разработанная командой LLM Core Xiaomi, здесь, чтобы помочь с ответами на вопросы, написанием и широким спектром полезных задач.

Ожидайте примерно шесть секунд до первых токенов, против 6.4s, указанных на странице модели [1].

5. Настройте по мере необходимости

Для вызова без потоковой передачи уберите stream=True и читайте response.choices[0].message.content. Чтобы переключить модели, измените аргумент model. Увеличьте max_tokens для более длинного вывода — значение по умолчанию 1024 выше значительно ниже лимита модели [1].

Контрольный список

  • [ ] Создан виртуальный окружение; openai и python-dotenv установлены
  • [ ] .env содержит ваш реальный ключ, chmod 600
  • [ ] .env включен в .gitignore
  • [ ] base_url это https://aihubmix.com/v1 — /v1 обязателен
  • [ ] Идентификатор модели mimo-v2.6-pro (платный) или xiaomi-mimo-v2.6-pro-free (бесплатный)
  • [ ] Защита цикла потоковой передачи chunk.choices и delta.content
  • [ ] Тестовый вызов возвращает текст

Часто задаваемые вопросы

API действительно совместим с OpenAI? Да — стандартные Chat Completions. Любой клиент, совместимый с OpenAI, работает, устанавливая базовый URL на https://aihubmix.com/v1 и передавая ваш ключ AIHubMix в качестве токена-носителя. Документация AIHubMix отмечает, что coding-xiaomi-mimo-v2.6-flash поддерживает только форматы, совместимые с OpenAI [3].

Какой идентификатор модели мне использовать? mimo-v2.6-pro для платного, xiaomi-mimo-v2.6-pro-free для бесплатного. Два уровня используют разные наименования — бесплатные варианты имеют префикс xiaomi- и платные — нет, что легко перепутать.

Какие другие варианты доступны? mimo-v2.6-pro-ultraspeed, mimo-v2.6-flash, mimo-v2.5-pro и настроенные идентификаторы, такие как coding-xiaomi-mimo-v2.6-pro [3]. Перечислите их через API:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
    if 'mimo' in i: print(i)
"

Я получаю 429 — что это значит? Это зависит от сообщения, и два случая требуют противоположного подхода. "ограничение скорости от поставщика" — это ограничение по минутам: подождите и повторите. "достигнут лимит бесплатной модели" означает, что ваш бесплатный лимит исчерпан и делится между бесплатными моделями — повторная попытка не поможет, поэтому переключитесь на mimo-v2.6-pro.

Я получаю 400 "не может быть обслужен в данный момент". Сначала подтвердите идентификатор через API:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"

Если это выведет True, повторите вызов чата с помощью curl и ищите "code": "no_available_channel". Это означает, что модель указана, но в данный момент нет доступных ресурсов — это условие со стороны поставщика, которое нельзя исправить локально. Подождите или свяжитесь с поддержкой AIHubMix, указав идентификатор запроса из ответа.

Как мне узнать, является ли проблема моей или поставщика? Вызовите модель другого поставщика с тем же ключом и скриптом — например gpt-4o-mini. Если это успешно, ваш ключ, базовый URL и формат запроса правильные, а проблема заключается в конкретной модели. Если это тоже не удалось, проверьте свой ключ и выставление счета.

Почему мой вывод обрывается на полуслове? Вы достигли max_tokens, а не лимита модели. Увеличьте его.

Как мне проверить статус моего аккаунта?

curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY"

Посмотрите на has_payment_method и поля лимитов.

Следующие шаги

Скрипт выше является рабочей основой. Перечисленные возможности MiMo v2.6 Pro включают вызов инструментов, структурированные выходы, ввод с помощью зрения и аудио, а также кэширование подсказок [1] — все через тот же совместимый с OpenAI интерфейс, поэтому расширение клиента в основном сводится к добавлению стандартных параметров. Начните с бесплатного уровня, чтобы подтвердить вашу настройку, а затем переключите идентификатор модели на mimo-v2.6-pro для регулярного использования.


Источники