스마트 라우팅model = "auto"

모든 요청에 가장 강력하고 비싼 모델이 필요한 것은 아닙니다

스마트 라우팅은 모든 요청에 대해 실시간으로 최적의 모델을 선택하여 작업 품질을 유지하면서 비용을 크게 절감합니다. 캐시 친화적 설계: 동일한 세션은 자동으로 같은 모델을 유지하므로 프롬프트 캐시가 손실되지 않습니다.

추가 설정이 필요 없습니다. Claude Code, Codex, OpenCode 등 주요 에이전트의 세션 식별자가 자동으로 인식됩니다. 세션 범위를 정밀하게 제어하려면 요청에 다음을 추가하세요:X-Aihubmix-Session-Id: your-session-id

점수는 5개 대분류, 23개 하위 차원을 포괄하며, 내부 평가와 공개 리더보드를 종합해 정규화합니다.

API 문서
chat.py
import openai

client = openai.OpenAI(
    api_key="<AIHUBMIX_API_KEY>",
    base_url="https://aihubmix.com/v1"
)

response = client.chat.completions.create(
    model="auto",  # 접미사 없음 = auto:cost_optimized (기본)
    messages=[{"role": "user", "content": "Hello"}]
)
print(response.choices[0].message.content)
라우팅 전략
라우팅 전략

4가지 라우팅 전략별 모델 범위

텍스트 › 전체

"비용 우선" 전략으로 가중 정렬
모델
18
A
claude-opus-4-6-thinkAnthropic
86.7
$2.5 / $51,673 ms
21
A
claude-opus-4-7-thinkAnthropic
86.3
$2.5 / $53,036 ms
14
A
claude-opus-4-6Anthropic
85.4
$2.5 / $5822 ms
19
A
claude-opus-4-7Anthropic
84.0
$2.5 / $5719 ms
26
G
gemini-3.1-pro-previewGoogle
81.7
$1 / $66,816 ms
20
G
gemini-3.5-flashGoogle
79.9
$0.75 / $64,328 ms
28
O
gpt-5.4-highOpenAI
79.4
$1.25 / $6
24
A
claude-opus-4-8Anthropic
79.0
$2.5 / $51,591 ms
29
O
gpt-5.5OpenAI
78.5
$2.5 / $64,766 ms
8
X
grok-4.20-beta-0309-reasoningxAI
78.5
$1 / $31,685 ms
11
A
claude-sonnet-4-6Anthropic
77.8
$1.5 / $5995 ms
12
A
claude-sonnet-4-6-thinkAnthropic
77.3
$1.5 / $51,762 ms
9
Z
glm-5.2Z.ai
76.8
$0.563 / $3.52,770 ms
1
M
xiaomi-mimo-v2.5-pro현재 최우선Xiaomi
76.1
$0.24 / $21,673 ms
10
Q
qwen3.7-plusQwen
75.0
$0.141 / $44,873 ms
13
Q
qwen3.6-max-previewQwen
74.4
$0.634 / $6651 ms
4
X
grok-4-1-fast-non-reasoningxAI
74.2
$0.1 / $2.51,188 ms
2
D
deepseek-v4-proDeepSeek
73.5
$0.232 / $22,037 ms
17
O
gpt-5.4-miniOpenAI
71.0
$0.375 / $61,354 ms
6
X
grok-4.3xAI
69.7
$0.625 / $21,224 ms
22
Q
qwen3.6-plusQwen
69.5
$0.141 / $64,120 ms
16
Q
qwen3.5-397b-a17bQwen
69.4
$0.082 / $62,106 ms
3
D
deepseek-v4-flashDeepSeek
67.3
$0.077 / $2879 ms
5
M
xiaomi-mimo-v2.5Xiaomi
66.6
$0.078 / $21,673 ms
15
G
gemini-3.1-flash-liteGoogle
66.4
$0.125 / $6733 ms
7
X
grok-4-1-fast-reasoningxAI
66.0
$0.1 / $2.52,003 ms
30
Q
qwen3.5-122b-a10bQwen
62.0
$0.056 / $8961 ms
31
Q
qwen3.5-27bQwen
59.7
$0.042 / $82,085 ms
25
O
gpt-5.4-nanoOpenAI
57.8
$0.1 / $6.25702 ms
33
Q
qwen3.5-flashQwen
56.5
$0.014 / $105,775 ms
32
Q
qwen3.5-35b-a3bQwen
55.9
$0.028 / $83,310 ms
23
O
gpt-oss-120bOpenAI
43.6
$0.09 / $5366 ms
27
O
gpt-oss-20bOpenAI
33.5
$0.055 / $5120 ms
데이터 출처: 내부 평가와 공개 리더보드, 종합 정규화.