Định tuyến thông minhmodel = "auto"

Không phải yêu cầu nào cũng cần mô hình mạnh nhất và đắt nhất

Định tuyến thông minh chọn mô hình tốt nhất cho mỗi yêu cầu theo thời gian thực — giảm đáng kể chi phí mà không ảnh hưởng chất lượng tác vụ. Thiết kế thân thiện với cache: mỗi phiên tự động giữ nguyên một mô hình, nên cache prompt không bao giờ bị mất.

Không cần cấu hình thêm: định danh phiên của các agent phổ biến như Claude Code, Codex và OpenCode được nhận diện tự động. Để kiểm soát chính xác phạm vi phiên, hãy thêm vào yêu cầu:X-Aihubmix-Session-Id: your-session-id

Điểm số bao phủ 5 nhóm lớn và 23 tiêu chí con, được chuẩn hóa từ đánh giá nội bộ và các bảng xếp hạng công khai.

Tài liệu API
chat.py
import openai

client = openai.OpenAI(
    api_key="<AIHUBMIX_API_KEY>",
    base_url="https://aihubmix.com/v1"
)

response = client.chat.completions.create(
    model="auto",  # không hậu tố = auto:cost_optimized (mặc định)
    messages=[{"role": "user", "content": "Hello"}]
)
print(response.choices[0].message.content)
Chiến lược định tuyến
Chiến lược định tuyến

Phạm vi mô hình của bốn chiến lược

Văn bản › Tổng quan

Cân trọng số theo "Ưu tiên chi phí"
Mô hình
18
A
claude-opus-4-6-thinkAnthropic
86.7
$2.5 / $51,673 ms
21
A
claude-opus-4-7-thinkAnthropic
86.3
$2.5 / $53,036 ms
14
A
claude-opus-4-6Anthropic
85.4
$2.5 / $5822 ms
19
A
claude-opus-4-7Anthropic
84.0
$2.5 / $5719 ms
26
G
gemini-3.1-pro-previewGoogle
81.7
$1 / $66,816 ms
20
G
gemini-3.5-flashGoogle
79.9
$0.75 / $64,328 ms
28
O
gpt-5.4-highOpenAI
79.4
$1.25 / $6
24
A
claude-opus-4-8Anthropic
79.0
$2.5 / $51,591 ms
29
O
gpt-5.5OpenAI
78.5
$2.5 / $64,766 ms
8
X
grok-4.20-beta-0309-reasoningxAI
78.5
$1 / $31,685 ms
11
A
claude-sonnet-4-6Anthropic
77.8
$1.5 / $5995 ms
12
A
claude-sonnet-4-6-thinkAnthropic
77.3
$1.5 / $51,762 ms
9
Z
glm-5.2Z.ai
76.8
$0.563 / $3.52,770 ms
1
M
xiaomi-mimo-v2.5-proLựa chọn hiện tạiXiaomi
76.1
$0.24 / $21,673 ms
10
Q
qwen3.7-plusQwen
75.0
$0.141 / $44,873 ms
13
Q
qwen3.6-max-previewQwen
74.4
$0.634 / $6651 ms
4
X
grok-4-1-fast-non-reasoningxAI
74.2
$0.1 / $2.51,188 ms
2
D
deepseek-v4-proDeepSeek
73.5
$0.232 / $22,037 ms
17
O
gpt-5.4-miniOpenAI
71.0
$0.375 / $61,354 ms
6
X
grok-4.3xAI
69.7
$0.625 / $21,224 ms
22
Q
qwen3.6-plusQwen
69.5
$0.141 / $64,120 ms
16
Q
qwen3.5-397b-a17bQwen
69.4
$0.082 / $62,106 ms
3
D
deepseek-v4-flashDeepSeek
67.3
$0.077 / $2879 ms
5
M
xiaomi-mimo-v2.5Xiaomi
66.6
$0.078 / $21,673 ms
15
G
gemini-3.1-flash-liteGoogle
66.4
$0.125 / $6733 ms
7
X
grok-4-1-fast-reasoningxAI
66.0
$0.1 / $2.52,003 ms
30
Q
qwen3.5-122b-a10bQwen
62.0
$0.056 / $8961 ms
31
Q
qwen3.5-27bQwen
59.7
$0.042 / $82,085 ms
25
O
gpt-5.4-nanoOpenAI
57.8
$0.1 / $6.25702 ms
33
Q
qwen3.5-flashQwen
56.5
$0.014 / $105,775 ms
32
Q
qwen3.5-35b-a3bQwen
55.9
$0.028 / $83,310 ms
23
O
gpt-oss-120bOpenAI
43.6
$0.09 / $5366 ms
27
O
gpt-oss-20bOpenAI
33.5
$0.055 / $5120 ms
Nguồn: đánh giá nội bộ và bảng xếp hạng công khai, chuẩn hóa chung.