이번 달 AIHubMix는 채팅, 코드, 비디오 및 이미지 전반에 걸쳐 약 20개의 새로운 모델을 추가하고 여러 플랫폼 기능을 출시했습니다. 이제 동일한 API 키로 더 많은 모델에 접근할 수 있습니다. 주요 내용은 다음과 같습니다.
LLM 라우터
모델 이름을 auto로 설정하면 게이트웨이가 요청에 따라 플랫폼의 수백 개 모델 중 최적의 모델을 선택합니다. 비용 우선, 품질 우선 또는 저지연 전략에 따라 실제로 호출된 모델에 대해 요금이 청구됩니다. 수동 비교나 모델 전환이 필요 없으며 클라이언트 코드 변경도 없습니다. LLM 라우터를 참조하세요.
응답 프로토콜의 모든 모델
/v1/responses 엔드포인트는 더 이상 GPT 계열에 국한되지 않습니다: 이제 플랫폼의 모든 모델을 호출할 수 있습니다. 응답 프로토콜을 기반으로 구축된 도구(예: Codex CLI)는 OpenAI의 공식 모델에 제한되지 않고 GLM, Gemini, DeepSeek, Kimi, Qwen 등을 로컬 모델 카탈로그를 통해 사용할 수 있습니다. Codex CLI · 사용자 정의 모델를 참조하세요.
모델 매핑 및 폴백
콘솔에서 API 키별로 별칭 매핑 및 실패 폴백을 구성하세요: 클라이언트는 어떤 모델 이름을 사용하든 게이트웨이가 실제 대상 모델로 재작성합니다. 기본 모델이 실패하면 자동으로 백업으로 전환되며, 최종적으로 응답한 모델에 대해 요금이 청구됩니다. 단일 장애로 인해 생산 트래픽이 중단되지 않으며 클라이언트 코드는 변경되지 않습니다. 모델 매핑 및 폴백를 참조하세요.
AIHubMix CLI
종속성이 없는 단일 바이너리: Python, Node 또는 Go가 필요 없습니다. 터미널에서 잔액 조회, API 키 관리 및 사용 가능한 모델 목록을 확인할 수 있으며, Claude Code와 같은 스크립트 및 AI 에이전트에 대한 일급 지원을 제공합니다. AIHubMix CLI를 참조하세요.
AIHubMix Skill (AI 코딩 에이전트를 위한 확장)
Skills(Codex, Claude Code, Cursor, Cline 등)를 지원하는 AI 에이전트를 위한 로컬 확장입니다. 자연어를 사용하여 AIHubMix를 통합하고, 모델을 쿼리하며, 기능별로 선택하고, 예제를 생성하고, 오류를 해결할 수 있습니다. Skill은 AIHubMix의 공식 API에서 실시간 모델, 가격 및 프로토콜 정보를 요청하여 에이전트가 오래된 번들 모델 목록에 의존하지 않도록 합니다. Skills를 참조하세요.
백업 도메인: api.inferera.com
주 도메인 aihubmix.com에 접근할 수 없거나 시간이 초과되면 요청을 https://api.inferera.com로 전환하세요. 엔드포인트와 기능은 동일하며 API 키, 모델 및 요청 본문은 변경되지 않습니다.
추가 출시된 내용
- Gemini 오디오 입력: OpenAI 호환 엔드포인트(
/v1/chat/completions)가 이제input_audio를 수용하고 사용량에 따라 audio_tokens를 반환합니다. - GLM 5.2 추론 노력: 기본 Zhipu 채널이 조정 가능한 사고 깊이를 위한
reasoning_effort를 지원합니다. - Open Design 통합: AIHubMix가 이제 Open Design를 위한 내장 BYOK 게이트웨이가 되었습니다.
- OpenClaw 플러그인 수정: aihubmix-auth가 수정되어 안정적으로 사용할 수 있습니다.
안정성 및 수정 사항
- 청구 정확도 및 캐시 계량 정확도가 개선되었습니다.
/v1/models에서 누락된 모델이 수정되었습니다.- 여러 비디오 생성 및 채널 테스트 문제가 수정되었습니다.
이번 달의 새로운 모델 (~20)
채팅 / 일반
- claude-fable-5 [은퇴]: Claude의 최신 세대, 더 강력한 안전 장치가 포함되어 있습니다(자세한 내용은 변경 로그 · Fable 5 노트를 참조하세요).
- minimax-m3, qwen3.7-plus, glm-5.2, 및 Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.
코드
- kimi-k2.7-code 및 kimi-k2.7-code-highspeed: Kimi의 코드 시리즈, 고속 변형 포함.
- coding-glm-5.2 및 무료 coding-glm-5.2-free.
비디오
- Kling: 텍스트-비디오, 이미지-비디오, 다중 이미지 참조 및 전방위 다중 모드 생성.
- happyhorse-1.1: 텍스트-비디오(t2v), 참조(r2v), 및 이미지-비디오(i2v).
이미지
- Baidu musesteamer-air-image를 통한 이미지 생성.
또한 새로운 모델
- grok-build-0.1, hy3-preview, 및 무료 step-3.7-flash-free.
가격 및 공지사항
- step-3.7-flash, 90% 할인(한정 기간): $0.022 / M 입력 토큰, $0.132 / M 출력 토큰.
- 사용 중단 및 자동 라우팅:
claude-opus-4-20250514및claude-sonnet-4-20250514는 6월 15일 모델 제공업체에 의해 은퇴되었으며, 플랫폼은 이를 동일 계열의 4-5 버전으로 자동 라우팅합니다.
자주 묻는 질문
이번 달에 추가된 모델은 무엇인가요?
약 20개로, 채팅(claude-fable-5 [은퇴], minimax-m3, qwen3.7-plus, glm-5.2, doubao-seed-2-1 시리즈), 코드(kimi-k2.7-code 시리즈, coding-glm-5.2), 비디오(Kling, happyhorse-1.1), 이미지(musesteamer-air-image)를 포함합니다.
LLM 라우터를 어떻게 사용하나요?
요청에서 모델 이름을 auto로 설정하세요; 게이트웨이가 요청에 따라 최적의 모델을 선택하고 실제로 호출된 모델에 대해 요금을 청구하며 클라이언트 코드 변경이 필요 없습니다. LLM 라우터를 참조하세요.
주 도메인에 접근할 수 없으면 어떻게 하나요?
요청 주소를 백업 도메인 https://api.inferera.com로 교체하세요. 엔드포인트와 기능은 동일하며 매개변수를 변경할 필요가 없습니다.
step-3.7-flash의 한정 기간 가격은 얼마인가요?
$0.022 / M 입력 토큰 및 $0.132 / M 출력 토큰입니다.
모델 카탈로그에서 모든 모델을 탐색하고 문서에서 통합 세부정보를 확인하세요.
업데이트: 2026-06-30