AIHubMix 블로그

AIHubMix 팀의 발표, 튜토리얼, 모델 분석 및 변경 로그.

GLM-5.3-Flash 가격 비교: OpenRouter, Z.ai, AIHubMix

GLM-5.3-Flash 가격 비교: OpenRouter, Z.ai, AIHubMix

OpenRouter, Z.ai, AIHubMix의 GLM-5.3-Flash 가격, OpenRouter의 5.5% 플랫폼 수수료 및 캐시 비율 비용 예시 포함.

4분 분량뉴스
AI 에이전트 아키텍처: 모델 라우팅 및 도구 발견

AI 에이전트 아키텍처: 모델 라우팅 및 도구 발견

생산 AI 에이전트가 실시간 모델 라우팅을 위한 AIHubMix와 런타임 도구 발견 및 API 접근을 위한 Monid의 두 가지 통합이 필요한 이유를 알아보세요.

8분 분량의견
에이전트 경제 구축: AIHubMix와 FluxA의 전략적 협력 발표

에이전트 경제 구축: AIHubMix와 FluxA의 전략적 협력 발표

AIHubMix에서는 인공지능의 다음 단계가 모델이 이해할 수 있는 것뿐만 아니라 AI 에이전트가 책임감 있게 수행할 수 있는 것에 의해 정의될 것이라고 믿습니다. 그래서 우리는 지갑, 신원, 인증, 서비스 수익화 및 자율 시스템을 위한 결제에 중점을 둔 에이전트 네이티브 결제 인프라 제공업체인 FluxA와 전략적 협력을 발표합니다. AIHubMix와 FluxA는 에이전트 경제의 두 가지 필수 레이어인 지능에 대한 접근과 사용자 승인 제어 하에 상업 서비스와 상호작용할 수 있는 능력을 연결하기 위해 협력하고 있습니다.

3분 분량뉴스
GLM-5.3 가격 비교: OpenRouter, Z.ai, AIHubMix

GLM-5.3 가격 비교: OpenRouter, Z.ai, AIHubMix

GLM-5.3는 코딩 및 장기 에이전트 작업을 위한 가장 흥미로운 모델 중 하나로 빠르게 자리 잡았습니다. 하지만 지불하는 가격은 접근하는 곳에 따라 크게 달라집니다. 공식 Z.ai API와 OpenRouter는 현재 모델을 백만 개 입력 토큰당 $1.40, 백만 개 출력 토큰당 $4.40로 나열하고 있습니다. AIHubMix는 백만 개 입력 토큰당 $0.06, 백만 개 출력 토큰당 $0.22로 별도의 coding-glm-5.3 미리보기 경로를 제공합니다. 이는 극적인 차이입니다. 또한 단순한 비교가 아닙니다.

3분 분량뉴스
GLM-5.3 핸즈온 가이드: 항상 켜져 있는 사고, 세 가지 노력 수준, 그리고 API 지원 매트릭스

GLM-5.3 핸즈온 가이드: 항상 켜져 있는 사고, 세 가지 노력 수준, 그리고 API 지원 매트릭스

2026년 8월 GLM-5.3 호출에 대한 가이드: 세 가지 사고_노력 수준, 사고 요약, 병렬 도구 호출, 구조화된 출력 및 자동 캐싱을 통한 항상 켜져 있는 사고 — AIHubMix Chat, Responses 및 Messages API에 대한 테스트된 예제 포함.

7분 분량튜토리얼
DeepSeek V4 Pro (0813): 사고 패스백 및 3-API 매트릭스

DeepSeek V4 Pro (0813): 사고 패스백 및 3-API 매트릭스

DeepSeek V4 Pro (0813) 핸즈온 가이드: 사고 전환 및 추론 노력 수준, 필수 사고 기록 패스백, 도구, 캐싱 및 3-API 매트릭스.

15분 분량튜토리얼
DeepSeek V4 Flash가 오늘 저하되었습니다. 다중 공급자 장애 조치가 중요한 이유는 무엇인가요?

DeepSeek V4 Flash가 오늘 저하되었습니다. 다중 공급자 장애 조치가 중요한 이유는 무엇인가요?

2026년 8월 4일, DeepSeek의 공식 상태 페이지는 두 건의 API 성능 저하 사건을 기록했습니다. 첫 번째 사건은 1시간 18분 동안 지속되었으며, UTC 기준 02:02부터 03:20까지 DeepSeek V4 Flash, V4 Pro 및 Expert Mode에 영향을 미쳤습니다. 두 번째 사건은 36분 동안 지속되었으며, UTC 기준 03:43부터 04:20까지 DeepSeek V4 Flash API에 영향을 미쳤습니다. 두 사건 모두 해결되었습니다. OpenCode는 또한 DeepSeek Flash가 전례 없는 수요로 인해 용량 문제를 겪고 있다고 보고했습니다. 그러나 DeepSeek

4분 분량의견
2026년 6월 릴리스 스포트라이트: ~20개의 새로운 모델

2026년 6월 릴리스 스포트라이트: ~20개의 새로운 모델

2026년 6월 AIHubMix는 ~20개의 모델(glm-5.2, minimax-m3, qwen3.7-plus, kimi-k2.7-code, Kling video)과 LLM 라우터, 매핑 및 폴백, CLI, 백업 도메인을 추가했습니다.

3분 분량변경사항
글로벌 가속화: 75% 낮은 지연 시간, 99.99% 가용성

글로벌 가속화: 75% 낮은 지연 시간, 99.99% 가용성

AIHubMix는 자체 구축한 가속화 네트워크를 운영합니다: 75% 낮은 지연 시간, 60% 적은 변동성, 99.99% 가용성, 분 단위 프로브, 자동 장애 조치.

2분 분량공지사항
OpenAI 호환 인터페이스 업그레이드: Claude에 대한 깊은 지원

OpenAI 호환 인터페이스 업그레이드: Claude에 대한 깊은 지원

AIHubMix는 Claude에 대한 OpenAI 호환 API를 업그레이드했습니다: 추가 매개변수 없이 교차 사고, 프롬프트 캐싱, Anthropic 베타 기능 지원.

8분 분량뉴스
GPT-5.6 출시: 프롬프트 캐싱 청구 변경 사항 설명

GPT-5.6 출시: 프롬프트 캐싱 청구 변경 사항 설명

2026년 7월: AIHubMix에서 GPT-5.6 gpt-5.6-sol / terra / luna: 1.05M 컨텍스트, 1.25배 캐시 쓰기, prompt_cache_key, 명시적 중단점, Claude 캐싱과 비교.

8분 분량의견
2026년 7월 릴리스 스포트라이트: ~30개의 새로운 모델 및 미디어 API

2026년 7월 릴리스 스포트라이트: ~30개의 새로운 모델 및 미디어 API

AIHubMix는 2026년 7월에 claude-opus-5, GPT-5.6, kimi-k3 및 qwen3.8-max-preview를 포함하여 ~30개의 모델을 추가했으며, 미디어 생성, 3D 생성 및 MCP 서버도 출시했습니다.

6분 분량변경사항
AIHubMix의 무료 AI 모델

AIHubMix의 무료 AI 모델

무료 AI 모델: 2026년 AIHubMix에서 제로 비용으로 구축하는 궁극적인 가이드

13분 분량공지사항
Kimi K3 핸즈온 가이드: 새로운 매개변수 및 API 지원 매트릭스

Kimi K3 핸즈온 가이드: 새로운 매개변수 및 API 지원 매트릭스

2026년 7월 Kimi K3 가이드: reasoning_effort 최대값, 사고 역사, 동적 도구 로딩, 구조화된 출력, 자동 캐싱, 부분 접두사 및 비전 입력.

8분 분량튜토리얼
Claude Opus 4.7 새로운 매개변수 가이드

Claude Opus 4.7 새로운 매개변수 가이드

이 글에서는 Claude Opus 4.7의 추론 제어에 대한 두 가지 주요 변경 사항과 AIHubmix 네이티브 API 및 Chat 통합 인터페이스에 대한 전체 사용 지침을 다룹니다. 또한 Anthropic 공식 발표 및 모델 변경 로그를 참조하세요.

3분 분량튜토리얼