간단히 말해서: 공식 openai Python SDK를 https://aihubmix.com/v1 에 맞추고, 모델 ID로 mimo-v2.6-pro 를 사용하며, AIHubMix 키로 인증합니다. API는 OpenAI와 호환되므로(OpenAI와 동일한 형식으로 호출 가능) 특별한 클라이언트가 필요하지 않습니다. 설정은 약 5분 정도 소요됩니다.
주요 사항
- OpenAI 호환 API —
base_url만 변경, 그 외는 필요 없음 - 유료
mimo-v2.6-pro· 무료xiaomi-mimo-v2.6-pro-free[1] [2] - $0.48/M 입력 · $0.96/M 출력 [1]
- 무료 티어 5 요청/분 · 100/일 · 1M 토큰/일 [2]
- 컨텍스트 1.05M 토큰 · 최대 출력 131K 토큰 [1]
- 요구 사항: Python 3.9+, AIHubMix API 키
참조 값
| 기본 URL | https://aihubmix.com/v1 |
| 프로토콜 | OpenAI 채팅 완성 |
| 유료 모델 ID | mimo-v2.6-pro |
| 무료 모델 ID | xiaomi-mimo-v2.6-pro-free |
| 가격(유료) | $0.48/M 입력 · $0.96/M 출력 · $0.0038/M 캐시 읽기 [1] |
| 무료 티어 한계 | 5 req/min · 100 req/day · 1M tokens/day [2] |
| 컨텍스트 윈도우 | 1.05M 토큰 [1] |
| 최대 출력 | 131K 토큰 [1] |
| 입력 방식 | 텍스트, 비전, 오디오, 비디오 — 텍스트 출력만 [1] |
| 기능 목록 | 스트리밍, 도구 호출, 구조화된 출력, 프롬프트 캐싱 [1] |
v2.6 Pro를 사용해야 할까요, v2.5 Pro를 사용해야 할까요?
v2.6 Pro를 사용하세요. 가격이 동일하며 더 다양한 입력을 수용합니다.
mimo-v2.5-pro | mimo-v2.6-pro | |
|---|---|---|
| 입력 | 텍스트만 [5] | 텍스트, 비전, 오디오, 비디오 [1] |
| 가격(입력/출력) | $0.48/M · $0.96/M [5] | $0.48/M · $0.96/M [1] |
| 컨텍스트 / 최대 출력 | 1.05M · 131K [5] | 1.05M · 131K [1] |
| 가용성 | 2026년 10월 21일 은퇴 [5] | 현재 [1] |
Xiaomi의 릴리스 노트에 따르면 V2.6은 "V2.5 시리즈와 동일한 API 가격을 채택"하며 V2.6-Pro는 인공지능 분석 지수에서 46점을 기록했습니다 — 작성 시점에서 Kimi K3 및 Qwen3.8 Max보다 높은 오픈 소스 점수이며 Claude Fable 5.1 및 GPT-6 Astra보다 낮습니다 [4]. 노트에서 가장 명확한 세대 간 차이는 더 저렴한 모델에 대한 것입니다: V2.6-Flash "MiMo-V2.5-Pro를 종합적으로 초월했습니다" [4].
유의해야 할 두 가지 사항이 있습니다. Xiaomi는 V2.6-Pro와 V2.5-Pro의 직접적인 벤치마크 표를 발표하지 않았으므로 위의 비교는 사양과 가격입니다. 그리고 mimo-v2.5-pro 는 2026년 10월 21일 은퇴할 예정이며 mimo-v2.6-pro 가 마이그레이션 대상으로 지정되었습니다 [5], 따라서 v2.5에 기반한 새로운 것은 거의 즉시 이동해야 합니다.
왜 AIHubMix인가요?
- 단지
base_url만 변경하면 됩니다. 게이트웨이는 OpenAI 채팅 완성 형식을 사용하므로 공식 SDK가 수정 없이 작동합니다. Anthropic 형식의/v1/messages(베타) 및 기본 Gemini 호출도 동일한 키에서 사용할 수 있습니다 [6]. - 하나의 키로 여러 공급업체를 커버합니다.
GET /v1/models는 설정 당일 416 모델 ID를 반환했으며, 그 중 21개가 MiMo 변형입니다 [3]. 모델을 변경하면 스크립트에서 문자열 하나만 변경하면 됩니다. - 먼저 무료로 테스트할 수 있습니다.
xiaomi-mimo-v2.6-pro-free는 5 요청/분, 100/일 및 1M 토큰/일 내에서 $0의 비용이 발생합니다 [2] — 설정이 작동하는지 증명하기에 충분합니다. - 구독이 없습니다. 청구는 사용한 만큼 지불하며, 회원가입이나 월별 요금이 없습니다 [6], 유료 MiMo 요금은 모델 페이지에서 $0.48/M 입력 및 $0.96/M 출력과 일치합니다 [1].
- 디버깅이 더 빠릅니다. 호출이 실패하면 동일한 스크립트를 다른 공급업체의 모델에 맞추면 됩니다. 그곳에서 성공하면 키, URL 및 요청 형식이 올바르며 문제는 모델입니다 — 한 번의 호출로 오후를 절약할 수 있습니다.
설정하는 방법
1. 프로젝트 생성
mkdir mimo-demo && cd mimo-demo
python3 -m venv .venv
.venv/bin/pip install "openai>=1.40" "python-dotenv>=1.0"
2. 키 저장
printf 'AIHUBMIX_API_KEY=your_key_here\n' > .env
chmod 600 .env
printf '.env\n.venv/\n__pycache__/\n' > .gitignore
스크립트에 키를 하드코딩하지 말고, 절대 .env 파일을 커밋하지 마세요.
3. 클라이언트 생성
chat.py 로 저장:
import os
import sys
from dotenv import load_dotenv
from openai import OpenAI
load_dotenv()
client = OpenAI(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com/v1",
)
prompt = sys.argv[1] if len(sys.argv) > 1 else "한 문장으로 자신을 소개하세요."
stream = client.chat.completions.create(
model="mimo-v2.6-pro",
messages=[{"role": "user", "content": prompt}],
max_tokens=1024,
stream=True,
)
for chunk in stream:
if not chunk.choices:
continue
piece = chunk.choices[0].delta.content
if piece:
print(piece, end="", flush=True)
print()
루프 안에 두 가지 검사를 유지하세요. 일부 청크는 빈 choices 배열과 함께 도착하며, 인덱싱하면 IndexError 가 발생합니다. 또한 delta.content 는 첫 번째 및 마지막 프레임에서 None 일 수 있으며, 이 경우 print 는 문자 그대로 None 로 출력됩니다.
4. 실행하기
.venv/bin/python chat.py "한 문장으로 자신을 소개하세요."
저는 Xiaomi의 LLM Core Team이 개발한 대형 언어 모델 MiMo입니다. 질문에 답하고, 글을 작성하며, 다양한 유용한 작업을 도와드리기 위해 여기 있습니다.
첫 번째 토큰까지 대략 6초가 소요되며, 모델 페이지에 나와 있는 6.4초와 비교됩니다 [1].
5. 필요에 따라 조정하기
비스트리밍 호출의 경우 stream=True 를 제거하고 response.choices[0].message.content 를 읽습니다. 모델을 전환하려면 model 인수를 변경하세요. 더 긴 출력을 위해 max_tokens 를 늘리세요 — 위의 기본값 1024는 모델의 한도보다 훨씬 낮습니다 [1].
체크리스트
- [ ] 가상 환경이 생성되었으며,
openai와python-dotenv가 설치되었습니다. - [ ]
.env에 실제 키가 포함되어 있으며,chmod 600가 적용되었습니다. - [ ]
.env가.gitignore에 나열되어 있습니다. - [ ]
base_url가https://aihubmix.com/v1로 설정되어 있으며,/v1는 필수입니다. - [ ] 모델 ID가
mimo-v2.6-pro(유료) 또는xiaomi-mimo-v2.6-pro-free(무료)입니다. - [ ] 스트리밍 루프가
chunk.choices와delta.content를 보호합니다. - [ ] 테스트 호출이 텍스트를 반환합니다.
자주 묻는 질문
API가 정말 OpenAI와 호환되나요? 네 — 표준 채팅 완성입니다. 모든 OpenAI 호환 클라이언트는 기본 URL을 https://aihubmix.com/v1 로 설정하고 AIHubMix 키를 베어러 토큰으로 전달하면 작동합니다. AIHubMix의 문서에서는 coding-xiaomi-mimo-v2.6-flash 가 OpenAI 호환 형식만 지원한다고 언급하고 있습니다 [3].
어떤 모델 ID를 사용해야 하나요? mimo-v2.6-pro 는 유료, xiaomi-mimo-v2.6-pro-free 는 무료입니다. 두 티어는 서로 다른 명명 규칙을 사용합니다 — 무료 변형은 xiaomi- 접두사를 가지고 있으며 유료 변형은 그렇지 않으므로 잘못 이해하기 쉽습니다.
어떤 다른 변형이 있나요? mimo-v2.6-pro-ultraspeed, mimo-v2.6-flash, mimo-v2.5-pro, 및 코딩 조정된 ID인 coding-xiaomi-mimo-v2.6-pro 가 있습니다 [3]. API에서 목록을 확인하세요:
curl -s https://aihubmix.com/v1/models \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
| python -c "
import json,sys
for i in sorted(m['id'] for m in json.load(sys.stdin)['data']):
if 'mimo' in i: print(i)
"
저는 429 오류가 발생합니다 — 이게 무슨 뜻인가요? 메시지에 따라 다르며, 두 가지 경우는 반대의 처리가 필요합니다. "제공자가 속도 제한을 걸었습니다"는 분당 제한입니다: 기다렸다가 다시 시도하세요. "무료 모델 할당량의 한도에 도달했습니다"는 귀하의 계정의 무료 할당량이 소진되었음을 의미하며 무료 모델 간에 공유됩니다 — 다시 시도해도 도움이 되지 않으므로 mimo-v2.6-pro 로 전환하세요.
저는 400 "현재 제공할 수 없습니다"라는 오류가 발생합니다. 먼저 API에 대해 ID를 확인하세요:
curl -s https://aihubmix.com/v1/models \
-H "Authorization: Bearer $AIHUBMIX_API_KEY" \
| python -c "import json,sys; print('mimo-v2.6-pro' in [m['id'] for m in json.load(sys.stdin)['data']])"
그 출력이 True 라면, curl로 채팅 호출을 반복하고 "code": "no_available_channel" 가 있는지 확인하세요. 이는 모델이 나열되었지만 현재 업스트림 용량이 없음을 의미합니다 — 이는 공급자 측 조건으로, 로컬 변경으로는 해결할 수 없습니다. 기다리거나 응답의 요청 ID와 함께 AIHubMix 지원에 문의하세요.
문제가 저의 것인지 제공자의 것인지 어떻게 알 수 있나요? 동일한 키와 스크립트로 다른 공급업체의 모델을 호출하세요 — 예를 들어 gpt-4o-mini. 성공하면 키, 기본 URL 및 요청 형식이 올바르며 문제는 특정 모델입니다. 실패하면 키와 청구를 확인하세요.
출력이 중간에 잘리면 왜 그런가요? 당신은 max_tokens 에 도달했습니다, 모델 한도가 아닙니다. 이를 늘리세요.
내 계정 상태를 어떻게 확인하나요?
curl -s https://aihubmix.com/v1/dashboard/billing/subscription \
-H "Authorization: Bearer $AIHUBMIX_API_KEY"
has_payment_method 와 한도 필드를 확인하세요.
다음 단계
위의 스크립트는 작동하는 기반입니다. MiMo v2.6 Pro의 나열된 기능에는 도구 호출, 구조화된 출력, 비전 및 오디오 입력, 프롬프트 캐싱이 포함됩니다 [1] — 모두 동일한 OpenAI 호환 인터페이스를 통해 이루어지므로 클라이언트를 확장하는 것은 대부분 표준 매개변수를 추가하는 문제입니다. 무료 티어로 설정을 확인한 후, 모델 ID를 mimo-v2.6-pro 로 전환하여 정기적으로 사용하세요.
출처
- [1] AIHubMix 모델 페이지,
mimo-v2.6-pro: https://aihubmix.com/model/mimo-v2.6-pro (2026년 9월 28일 접속) - [2] AIHubMix 모델 페이지,
xiaomi-mimo-v2.6-pro-free: https://aihubmix.com/model/xiaomi-mimo-v2.6-pro-free (2026년 9월 28일 접속) - [3] 변형 ID 및 형식 노트는
GET /v1/models엔드포인트 및 AIHubMix 모델 페이지에서 가져왔습니다 (2026년 9월 28일 접속) - [4] Xiaomi MiMo 릴리스 노트, V2.6 시리즈: https://mimo.mi.com/docs/en-US/news/latest/v2-6 (2026년 9월 28일 접속)
- [5] AIHubMix 모델 페이지,
mimo-v2.5-pro: https://aihubmix.com/model/mimo-v2.5-pro (2026년 9월 28일 접속) - [6] AIHubMix 제품 문서: https://docs.aihubmix.com/en (2026년 9월 28일 접속)



