Як використовувати Xiaomi MiMo v2.6 Pro на AIHubMix: Посібник з налаштування

AIHubMix6 хв читання
Як використовувати Xiaomi MiMo v2.6 Pro на AIHubMix: Посібник з налаштування

Коротко: вкажіть офіційний openai Python SDK на https://aihubmix.com/v1, використовуйте ID моделі mimo-v2.6-pro та автентифікуйтеся за допомогою вашого ключа AIHubMix. API сумісний з OpenAI (можна викликати в тому ж форматі, що й у OpenAI), тому спеціальний клієнт не потрібен. Налаштування займає близько п'яти хвилин.

Ключові моменти

  • API, сумісний з OpenAI — змініть base_url, нічого більше
  • Платний mimo-v2.6-pro · безкоштовний xiaomi-mimo-v2.6-pro-free [1] [2]
  • $0.48/M вхід · $0.96/M вихід [1]
  • Безкоштовний тариф 5 запитів/хв · 100/день · 1M токенів/день [2]
  • Контекст 1.05M токенів · максимальний вихід 131K токенів [1]
  • Вимоги: Python 3.9+, ключ API AIHubMix

Довідкові значення

Базовий URLhttps://aihubmix.com/v1
ПротоколOpenAI Chat Completions
ID платної моделіmimo-v2.6-pro
ID безкоштовної моделіxiaomi-mimo-v2.6-pro-free
Ціноутворення (платне)$0.48/M вхід · $0.96/M вихід · $0.0038/M читання кешу [1]
Обмеження безкоштовного тарифу5 запитів/хв · 100 запитів/день · 1M токенів/день [2]
Вікно контексту1.05M токенів [1]
Максимальний вихід131K токенів [1]
Вхідні модальностіТекст, зображення, аудіо, відео — тільки текстовий вихід [1]
Перераховані функціїСтрімінг, виклик інструментів, структуровані виходи, кешування запитів [1]

Чи слід використовувати v2.6 Pro чи v2.5 Pro?

Використовуйте v2.6 Pro. Це та ж ціна і приймає більше видів вхідних даних.

mimo-v2.5-promimo-v2.6-pro
ВхідТільки текст [5]Текст, зображення, аудіо, відео [1]
Ціна в / вихід$0.48/M · $0.96/M [5]$0.48/M · $0.96/M [1]
Контекст / максимальний вихід1.05M · 131K [5]1.05M · 131K [1]
ДоступністьВихід 21 жовтня 2026 [5]Актуальний [1]

Випускні нотатки Xiaomi вказують, що V2.6 "приймає таку ж цінову політику API, як і серія V2.5" та надає V2.6-Pro 46 балів за Індекс штучного аналізу — найвищий бал серед відкритих джерел на момент написання, вище Kimi K3 і Qwen3.8 Max, але нижче Claude Fable 5.1 і GPT-6 Astra [4]. Найбільш чітка лінія між поколіннями в нотатках стосується дешевшої моделі: V2.6-Flash "всеосяжно перевершила MiMo-V2.5-Pro" [4].

Дві речі, які слід пам'ятати. Xiaomi не опублікувала безпосередню таблицю порівняння V2.6-Pro та V2.5-Pro, тому вище наведено специфікації та ціну. І mimo-v2.5-pro заплановано на вихід 21 жовтня 2026 року з mimo-v2.6-pro як ціллю для міграції [5], тому все нове, створене на v2.5, потрібно буде перенести майже відразу.

Чому AIHubMix

  • Вам потрібно змінити лише base_url. Шлюз підтримує формат OpenAI Chat Completions, тому офіційний SDK працює без змін. Формати Anthropic /v1/messages (бета) та виклики рідного Gemini доступні за тим же ключем [6].
  • Один ключ охоплює багато постачальників. GET /v1/models повернув 416 ID моделей в день налаштування, 21 з них — варіанти MiMo [3]. Зміна моделі означає зміну одного рядка у вашому скрипті.
  • Ви можете спочатку протестувати безкоштовно. xiaomi-mimo-v2.6-pro-free коштує $0 при 5 запитах/хв, 100/день і 1M токенів/день [2] — достатньо, щоб підтвердити, що налаштування працює, перш ніж витрачати щось.
  • Без підписки. Оплата здійснюється за фактом використання без членства або щомісячної плати [6], а платна ставка MiMo відповідає ціновій сторінці моделі — $0.48/M вхід і $0.96/M вихід [1].
  • Виправлення помилок швидше. Якщо виклик не вдався, вкажіть той же скрипт на модель іншого постачальника. Успіх там означає, що ваш ключ, URL та форма запиту в порядку, а проблема в моделі — один виклик замість цілого дня.

Як його налаштувати

1. Створіть проект

mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"

2. Збережіть свій ключ

printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore

Ніколи не вказуйте ключ безпосередньо у вашому скрипті та ніколи не комітіть .env.

3. Створіть клієнта

Збережіть як chat.py:

import os
import sys

from dotenv import load_dotenv
from openai import OpenAI

load_dotenv()

client = OpenAI(
    api_key=os.environ["AIHUBMIX_API_KEY"],
    base_url="https://aihubmix.com/v1",
)

prompt = sys.argv[1] if len(sys.argv) > 1 else "Представте себе в одному реченні."

stream = client.chat.completions.create(
    model="mimo-v2.6-pro",
    messages=[{"role": "user", "content": prompt}],
    max_tokens=1024,
    stream=True,
)

for chunk in stream:
    if not chunk.choices:
        continue
    piece = chunk.choices[0].delta.content
    if piece:
        print(piece, end="", flush=True)
print()

Тримайте обидва перевірки всередині циклу. Деякі частини приходять з порожнім choices масивом, що викликає IndexError при індексації; також delta.content може бути None в перших і останніх кадрах, що print виведе як буквальний текст None.

4. Запустіть його

.venv/bin/python chat.py "Представте себе в одному реченні."
Я MiMo, велика мовна модель, розроблена командою LLM Xiaomi, тут, щоб допомогти з відповідями на запитання, написанням та широким спектром корисних завдань.

Очікуйте приблизно шість секунд до перших токенів, проти 6.4s, зазначених на сторінці моделі [1].

5. Налаштуйте за потреби

Для виклику без стрімінгу, видаліть stream=True і читайте response.choices[0].message.content. Щоб змінити моделі, змініть model аргумент. Підвищте max_tokens для довшого виходу — значення за замовчуванням 1024 вище є значно нижчим за межу моделі [1].

Контрольний список

  • [ ] Створено Virtualenv; openai та python-dotenv встановлено
  • [ ] .env містить ваш реальний ключ, chmod 600
  • [ ] .env перераховано в .gitignore
  • [ ] base_url є https://aihubmix.com/v1 — /v1 обов'язковий
  • [ ] ID моделі mimo-v2.6-pro (платний) або xiaomi-mimo-v2.6-pro-free (безкоштовний)
  • [ ] Цикл стрімінгу захищає chunk.choices та delta.content
  • [ ] Тестовий виклик повертає текст

Часті запитання

Чи дійсно API сумісний з OpenAI? Так — стандартні Chat Completions. Будь-який клієнт, сумісний з OpenAI, працює, встановлюючи базовий URL на https://aihubmix.com/v1 та передаючи ваш ключ AIHubMix як токен доступу. Документація AIHubMix зазначає, що coding-xiaomi-mimo-v2.6-flash підтримує лише формати, сумісні з OpenAI [3].

Який ID моделі слід використовувати? mimo-v2.6-pro для платного, xiaomi-mimo-v2.6-pro-free для безкоштовного. Обидва тарифи використовують різні назви — безкоштовні варіанти мають префікс xiaomi- і платні — ні, що легко сплутати.

Які інші варіанти доступні? mimo-v2.6-pro-ultraspeed, mimo-v2.6-flash, mimo-v2.5-pro, а також ID, налаштовані на кодування, такі як coding-xiaomi-mimo-v2.6-pro [3]. Перерахуйте їх з API:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
    if 'mimo' in i: print(i)
"

Я отримую 429 — що це означає? Це залежить від повідомлення, і два випадки потребують протилежного підходу. "обмежено постачальником" — це обмеження за хвилину: почекайте та спробуйте знову. "досягнуто межі безкоштовної моделі" означає, що безкоштовна квота вашого облікового запису вичерпана і ділиться між безкоштовними моделями — повторна спроба не допоможе, тому перейдіть на mimo-v2.6-pro.

Я отримую 400 "не може бути оброблено в даний момент". Спочатку підтвердіть ID за допомогою API:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"

Якщо це виведе True, повторіть виклик чату з curl і шукайте "code": "no_available_channel". Це означає, що модель перерахована, але в даний момент не має пропускної здатності — умова з боку постачальника, яку жодна локальна зміна не виправить. Чекайте або зв'яжіться з підтримкою AIHubMix, надавши ID запиту з відповіді.

Як я можу дізнатися, чи проблема в мені чи у постачальника? Викличте модель іншого постачальника з тим же ключем і скриптом — наприклад gpt-4o-mini. Якщо це вдасться, ваш ключ, базовий URL та формат запиту правильні, а проблема в цій конкретній моделі. Якщо це також не вдається, перевірте свій ключ і платіж.

Чому мій вихід обривається на півслові? Ви досягли max_tokens, а не межі моделі. Підвищте його.

Як я можу перевірити статус свого облікового запису?

curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY"

Перегляньте has_payment_method та поля обмежень.

Наступні кроки

Скрипт вище є робочою основою. Зазначені можливості MiMo v2.6 Pro включають виклики інструментів, структуровані виходи, вхід зображень та аудіо, а також кешування запитів [1] — все через той же інтерфейс, сумісний з OpenAI, тому розширення клієнта в основному є питанням додавання стандартних параметрів. Почніть з безкоштовного тарифу, щоб підтвердити ваше налаштування, а потім змініть ID моделі на mimo-v2.6-pro для регулярного використання.


Джерела