Cách sử dụng Xiaomi MiMo v2.6 Pro trên AIHubMix: Hướng dẫn thiết lập

AIHubMixĐọc 6 phút
Cách sử dụng Xiaomi MiMo v2.6 Pro trên AIHubMix: Hướng dẫn thiết lập

Tóm lại: chỉ cần chỉ định SDK Python chính thức của openai tại https://aihubmix.com/v1, sử dụng ID mô hình mimo-v2.6-pro, và xác thực bằng khóa AIHubMix của bạn. API tương thích với OpenAI (có thể gọi theo định dạng giống như của OpenAI), vì vậy không cần khách hàng đặc biệt. Việc thiết lập mất khoảng năm phút.

Điểm chính

  • API tương thích với OpenAI — chỉ cần thay đổi base_url, không cần gì khác
  • Mô hình trả phí mimo-v2.6-pro · miễn phí xiaomi-mimo-v2.6-pro-free [1] [2]
  • $0.48/M đầu vào · $0.96/M đầu ra [1]
  • Tầng miễn phí 5 yêu cầu/phút · 100/yêu cầu/ngày · 1M tokens/ngày [2]
  • Ngữ cảnh 1.05M tokens · đầu ra tối đa 131K tokens [1]
  • Yêu cầu: Python 3.9+, một khóa API AIHubMix

Giá trị tham khảo

Base URLhttps://aihubmix.com/v1
Giao thứcOpenAI Chat Completions
ID mô hình trả phímimo-v2.6-pro
ID mô hình miễn phíxiaomi-mimo-v2.6-pro-free
Giá (trả phí)$0.48/M đầu vào · $0.96/M đầu ra · $0.0038/M đọc bộ nhớ đệm [1]
Giới hạn tầng miễn phí5 req/phút · 100 req/ngày · 1M tokens/ngày [2]
Cửa sổ ngữ cảnh1.05M tokens [1]
Đầu ra tối đa131K tokens [1]
Các phương thức đầu vàoVăn bản, hình ảnh, âm thanh, video — chỉ đầu ra văn bản [1]
Các tính năng đã liệt kêPhát trực tiếp, gọi công cụ, đầu ra có cấu trúc, bộ nhớ đệm prompt [1]

Bạn nên sử dụng v2.6 Pro hay v2.5 Pro?

Sử dụng v2.6 Pro. Nó có cùng mức giá và chấp nhận nhiều loại đầu vào hơn.

mimo-v2.5-promimo-v2.6-pro
Đầu vàoChỉ văn bản [5]Văn bản, hình ảnh, âm thanh, video [1]
Giá vào/ra$0.48/M · $0.96/M [5]$0.48/M · $0.96/M [1]
Ngữ cảnh / đầu ra tối đa1.05M · 131K [5]1.05M · 131K [1]
Tình trạngNgừng hoạt động vào 21 tháng 10 năm 2026 [5]Hiện tại [1]

Ghi chú phát hành của Xiaomi cho biết V2.6 "áp dụng cùng mức giá API như dòng V2.5" và cho V2.6-Pro 46 điểm trên Chỉ số Phân tích Trí tuệ Nhân tạo — điểm số mã nguồn mở hàng đầu tại thời điểm viết, cao hơn Kimi K3 và Qwen3.8 Max và thấp hơn Claude Fable 5.1 và GPT-6 Astra [4]. Dòng rõ ràng nhất giữa các thế hệ trong ghi chú là về mô hình rẻ hơn: V2.6-Flash "đã vượt trội hơn MiMo-V2.5-Pro" [4].

Hai điều cần lưu ý. Xiaomi chưa công bố bảng điểm chuẩn trực tiếp giữa V2.6-Pro và V2.5-Pro, vì vậy sự so sánh ở trên chỉ dựa trên thông số kỹ thuật và giá cả. Và mimo-v2.5-pro dự kiến sẽ ngừng hoạt động vào ngày 21 tháng 10 năm 2026 với mimo-v2.6-pro được chỉ định là mục tiêu di chuyển [5], vì vậy bất kỳ thứ gì mới được xây dựng trên v2.5 sẽ cần phải chuyển ngay lập tức.

Tại sao chọn AIHubMix

  • Bạn chỉ cần thay đổi base_url. Cổng thông tin nói theo định dạng OpenAI Chat Completions, vì vậy SDK chính thức hoạt động mà không cần sửa đổi. Các cuộc gọi định dạng Anthropic /v1/messages (beta) và Gemini gốc có sẵn trên cùng một khóa [6].
  • Một khóa bao phủ nhiều nhà cung cấp. GET /v1/models trả về 416 ID mô hình vào ngày thiết lập, 21 trong số đó là các biến thể MiMo [3]. Thay đổi mô hình có nghĩa là thay đổi một chuỗi trong kịch bản của bạn.
  • Bạn có thể thử miễn phí trước. xiaomi-mimo-v2.6-pro-free miễn phí trong 5 yêu cầu/phút, 100/ngày và 1M tokens/ngày [2] — đủ để chứng minh rằng việc thiết lập hoạt động trước khi bạn chi tiêu bất kỳ khoản nào.
  • Không có đăng ký. Thanh toán theo hình thức trả tiền theo mức sử dụng mà không có phí thành viên hoặc phí hàng tháng [6], và mức giá MiMo trả phí tương ứng với trang mô hình là $0.48/M đầu vào và $0.96/M đầu ra [1].
  • Gỡ lỗi nhanh hơn. Nếu một cuộc gọi thất bại, chỉ cần chỉ định cùng một kịch bản cho mô hình của nhà cung cấp khác. Một thành công ở đó có nghĩa là khóa, URL và hình dạng yêu cầu của bạn là chính xác, và vấn đề là ở mô hình — một cuộc gọi thay vì một buổi chiều.

Cách thiết lập

1. Tạo dự án

mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"

2. Lưu khóa của bạn

printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore

Không bao giờ mã hóa cứng khóa trong kịch bản của bạn, và không bao giờ cam kết .env.

3. Tạo khách hàng

Lưu dưới dạng chat.py:

import os
import sys

from dotenv import load_dotenv
from openai import OpenAI

load_dotenv()

client = OpenAI(
    api_key=os.environ["AIHUBMIX_API_KEY"],
    base_url="https://aihubmix.com/v1",
)

prompt = sys.argv[1] if len(sys.argv) > 1 else "Giới thiệu về bản thân trong một câu."

stream = client.chat.completions.create(
    model="mimo-v2.6-pro",
    messages=[{"role": "user", "content": prompt}],
    max_tokens=1024,
    stream=True,
)

for chunk in stream:
    if not chunk.choices:
        continue
    piece = chunk.choices[0].delta.content
    if piece:
        print(piece, end="", flush=True)
print()

Giữ cả hai kiểm tra bên trong vòng lặp. Một số khối dữ liệu đến với mảng choices trống, điều này sẽ gây ra IndexError nếu được chỉ mục; và delta.content có thể là None trong các khung đầu tiên và cuối cùng, điều này sẽ được print xuất ra dưới dạng văn bản nguyên văn None.

4. Chạy nó

.venv/bin/python chat.py "Giới thiệu về bản thân trong một câu."
Tôi là MiMo, một mô hình ngôn ngữ lớn được phát triển bởi Nhóm LLM của Xiaomi, ở đây để hỗ trợ trả lời câu hỏi, viết và nhiều nhiệm vụ hữu ích khác.

Đợi khoảng sáu giây để nhận các token đầu tiên, so với 6.4s được liệt kê trên trang mô hình [1].

5. Điều chỉnh khi cần thiết

Đối với một cuộc gọi không phát trực tiếp, bỏ qua stream=True và đọc response.choices[0].message.content. Để chuyển đổi mô hình, thay đổi tham số model. Tăng max_tokens cho đầu ra dài hơn — giá trị mặc định 1024 ở trên thấp hơn giới hạn của mô hình [1].

Danh sách kiểm tra

  • [ ] Virtualenv đã được tạo; openai và python-dotenv đã được cài đặt
  • [ ] .env chứa khóa thực của bạn, chmod 600
  • [ ] .env được liệt kê trong .gitignore
  • [ ] base_url là https://aihubmix.com/v1 — phần /v1 là bắt buộc
  • [ ] ID mô hình là mimo-v2.6-pro (trả phí) hoặc xiaomi-mimo-v2.6-pro-free (miễn phí)
  • [ ] Vòng lặp phát trực tiếp bảo vệ chunk.choices và delta.content
  • [ ] Một cuộc gọi thử nghiệm trả về văn bản

Câu hỏi thường gặp

API có thực sự tương thích với OpenAI không? Có — Chat Completions tiêu chuẩn. Bất kỳ khách hàng nào tương thích với OpenAI đều hoạt động bằng cách thiết lập base URL thành https://aihubmix.com/v1 và truyền khóa AIHubMix của bạn dưới dạng mã thông báo người mang. Tài liệu của AIHubMix lưu ý rằng coding-xiaomi-mimo-v2.6-flash chỉ hỗ trợ các định dạng tương thích với OpenAI [3].

Tôi nên sử dụng ID mô hình nào? mimo-v2.6-pro cho trả phí, xiaomi-mimo-v2.6-pro-free cho miễn phí. Hai tầng sử dụng các quy ước đặt tên khác nhau — các biến thể miễn phí có tiền tố xiaomi- và các biến thể trả phí thì không, điều này dễ gây nhầm lẫn.

Các biến thể khác nào có sẵn? mimo-v2.6-pro-ultraspeed, mimo-v2.6-flash, mimo-v2.5-pro, và các ID được điều chỉnh như coding-xiaomi-mimo-v2.6-pro [3]. Liệt kê chúng từ API:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
    if 'mimo' in i: print(i)
"

Tôi nhận được 429 — điều đó có nghĩa là gì? Điều đó phụ thuộc vào thông điệp, và hai trường hợp cần xử lý ngược lại. "bị giới hạn tỷ lệ bởi nhà cung cấp" là một giới hạn theo phút: hãy chờ và thử lại. "đã đạt giới hạn của hạn ngạch mô hình miễn phí" có nghĩa là hạn ngạch miễn phí của tài khoản của bạn đã hết và được chia sẻ giữa các mô hình miễn phí — thử lại sẽ không giúp ích, vì vậy hãy chuyển sang mimo-v2.6-pro.

Tôi nhận được 400 "không thể phục vụ vào lúc này". Đầu tiên xác nhận ID với API:

curl -s https://aihubmix.com/v1/models \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY" \
  | python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"

Nếu điều đó in ra True, hãy lặp lại cuộc gọi trò chuyện với curl và tìm kiếm "code": "no_available_channel". Điều đó có nghĩa là mô hình được liệt kê nhưng không có khả năng upstream vào thời điểm đó — một điều kiện phía nhà cung cấp mà không thay đổi cục bộ nào sẽ khắc phục được. Hãy chờ, hoặc liên hệ với hỗ trợ AIHubMix với ID yêu cầu từ phản hồi.

Làm thế nào tôi có thể biết liệu một vấn đề là của tôi hay của nhà cung cấp? Gọi một mô hình của nhà cung cấp khác với cùng một khóa và kịch bản — ví dụ gpt-4o-mini. Nếu nó thành công, khóa, base URL và định dạng yêu cầu của bạn là chính xác và vấn đề là ở mô hình cụ thể đó. Nếu nó cũng thất bại, hãy kiểm tra khóa và thanh toán của bạn.

Tại sao đầu ra của tôi bị cắt giữa câu? Bạn đã đạt đến max_tokens, không phải giới hạn của mô hình. Tăng nó lên.

Làm thế nào để tôi kiểm tra trạng thái tài khoản của mình?

curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
  -H "Authorization: Bearer $AIHUBMIX_API_KEY"

Xem has_payment_method và các trường giới hạn.

Các bước tiếp theo

Kịch bản ở trên là một nền tảng hoạt động. Các khả năng được liệt kê của MiMo v2.6 Pro bao gồm gọi công cụ, đầu ra có cấu trúc, đầu vào hình ảnh và âm thanh, và bộ nhớ đệm prompt [1] — tất cả thông qua cùng một giao diện tương thích với OpenAI, vì vậy việc mở rộng khách hàng chủ yếu là thêm các tham số tiêu chuẩn. Bắt đầu với tầng miễn phí để xác nhận thiết lập của bạn, sau đó chuyển ID mô hình sang mimo-v2.6-pro để sử dụng thường xuyên.


Nguồn