2026년 7월 릴리스 스포트라이트: ~30개의 새로운 모델 및 미디어 API

2026년 7월 31일 · AIHubMix · 6 min read · 변경 로그

2026년 7월 릴리스 스포트라이트: ~30개의 새로운 모델 및 미디어 API

이번 달 AIHubMix는 채팅, 코딩, 오디오, 이미지 및 3D 분야에서 거의 30개의 새로운 모델을 추가하고, 미디어 생성 API, 구조화된 출력 수리 및 3D 생성 API를 포함한 여러 플랫폼 기능을 출시했습니다. 단일 API 키를 통해 사용할 수 있는 모달리티의 범위가 계속 확장되고 있습니다. 하이라이트는 다음과 같습니다.

미디어 생성 API 및 통합 비동기 작업

새로운 미디어 생성 엔드포인트 /ai/v1/images/generations/ai/v1/images/edits가 이제 사용 가능하며, 통합 비동기 작업, 결과 쿼리, 아티팩트 다운로드 및 웹훅 콜백도 함께 제공됩니다. 이미지 및 비디오 워크플로우는 동일한 작업 생명 주기를 통해 통합할 수 있어 장기 생성 결과를 쉽게 추적할 수 있습니다. 생성된 아티팩트는 직접 다운로드 및 배치 검색을 지원합니다. 비동기 작업를 참조하세요.

구조화된 출력 수리

새로운 키 수준의 구조화된 출력 수리 기능이 제공되며, 기본적으로 비활성화되어 있습니다. 활성화되면 구조화된 JSON 출력을 선언한 비스트리밍 요청의 경우, 모델이 잘림, 후행 쉼표 또는 코드 블록 래퍼와 같은 형식 오류가 있는 JSON을 반환할 때 플랫폼이 자동으로 이를 구문 분석 가능한 유효한 JSON으로 수리하여 반환합니다. 값은 변경되지 않으며 클라이언트 변경이 필요하지 않습니다. 이 기능은 채팅 완료, 응답, Claude 및 Gemini 프로토콜을 지원하며, 수리된 응답은 X-JSON-Repaired: true 헤더를 포함합니다. 구조화된 출력 수리를 참조하세요.

3D 생성 API

새로운 /v1/3d/generations 비동기 3D 생성 API가 Tencent Hunyuan 3D (hy-3d-3.1)를 첫 번째 지원 모델로 출시됩니다. 이 API는 텍스트-투-3D, 이미지-투-3D 및 다중 뷰 입력을 지원하며, obj, glb, stl, usdz 및 fbx 형식의 아티팩트와 PBR 재료를 포함하여 게임, 전자상거래 디스플레이, 3D 프린팅 및 제품 디자인에 적합합니다. 3D 생성 API를 참조하세요.

공식 AIHubMix MCP 서버

MCP 클라이언트를 위한 공식 호스팅 진입점이 이제 활성화되었습니다: mcp.aihubmix.com/mcp (백업: mcp.inferera.com/mcp). Claude Code, Codex, Cursor 및 기타 도구에서 이를 연결하여 모델 및 가격을 쿼리하고, 문서를 검색하고, 잔액을 확인하며, 채팅, 이미지 생성 및 비디오 생성 도구를 호출할 수 있습니다. 자격 증명은 클라이언트에 의해 요청마다 전달되며 서버는 API 키를 저장하지 않습니다.

Jina 검색 및 웹 읽기

새로운 Jina 검색 및 리더 기능을 통해 AIHubMix API 키로 검색 결과 및 웹 페이지 콘텐츠를 검색할 수 있으며, 외부 정보 검색, 문서 읽기 및 에이전트 도구 호출에 적합합니다. 두 기능 모두 POST 요청을 지원하며, 리더는 PDF, Word, Excel, PPT, HTML 및 이미지와 같은 로컬 파일의 멀티파트 업로드도 수용합니다. Jina AI를 참조하세요.

기타 기능 업데이트

  • Qwen TTS 오디오 생성: qwen-audio-3.0-tts-plusqwen-audio-3.0-tts-flash/v1/audio/speech를 통해 호출할 수 있습니다. 비스트리밍 요청은 오디오 결과 링크를 반환하고, 스트리밍 요청은 SSE 오디오 생성 이벤트를 반환하며, 감정 태그 및 자연어 음성 지침을 지원합니다. TTS를 참조하세요.
  • GPT 프롬프트 캐싱 문서: GPT-5.6 시리즈부터 캐시 쓰기는 입력 가격의 1.25배로 청구되며, 캐시 읽기는 0.1배로 청구되며, 캐시는 최소 30분 동안 유지됩니다. prompt_cache_key 매개변수 세부정보 및 캐시 적중 문제 해결을 포함합니다. GPT 프롬프트 캐싱를 참조하세요.
  • Veo 3.1 이미지-투-비디오 첫/마지막 프레임 및 참조 이미지 지원: 오프닝 및 클로징 샷, 캐릭터 참조 및 스타일 참조를 더 정밀하게 제어할 수 있습니다. 비디오 생성를 참조하세요.
  • gpt-5.5 이상 도구 호출을 위한 자동 응답 브리징: /v1/chat/completions를 통해 도구와 reasoning_effort가 자동으로 응답 기능을 사용하여 기존 클라이언트가 변경 없이 더 신뢰할 수 있는 도구 호출을 할 수 있도록 합니다. 응답 API를 참조하세요.
  • Gemini 네이티브 엔드포인트 완료: @google/genai SDK는 이제 AIHubMix를 통해 호출할 때 네이티브 임베딩, 상호작용 및 컨텍스트 캐싱을 지원합니다. Gemini 네이티브 SDK를 참조하세요.
  • 스트리밍 연결이 2시간으로 연장됨: 최대 스트리밍 연결 시간이 1시간에서 2시간으로 연장되어 긴 사고 및 긴 생성 작업이 조기에 중단될 가능성이 줄어듭니다.
  • Gemini 이미지 매개변수 패스스루: OpenAI 호환 API를 통해 Gemini 이미지 출력 모델을 호출할 때 aspectRatioimageSizeextra_body.generationConfig.imageConfig에 전달할 수 있습니다.
  • 프로토콜 전반에 걸친 구조화된 출력: OpenAI 호환 response_format 및 Claude 네이티브 output_config.format이 관련 경로에서 양방향으로 조정됩니다. 구조화된 출력를 참조하세요.

안정성 및 수정 사항

  • 다중 프로토콜 호환성 개선: 메시지 응답 필드, 사고 매개변수, stop 매개변수 및 도구 호출 응답 구조가 각 프로토콜 생태계와 더욱 일치하도록 조정되었습니다.
  • 스트리밍 신뢰성 개선: 일부 모델에 대해 잘린 스트리밍 출력 및 비어 있는 것으로 잘못 분류된 응답을 수정하였으며, 클라이언트가 연결을 끊을 때 더 완전한 사용 기록이 남습니다.
  • 캐시 계량 및 청구 정확성 개선으로 청구 세부정보가 실제 사용량을 더 잘 반영합니다.
  • 더 명확한 오류 메시지: 매개변수 검증 실패가 더 빨리 반환되며, 알 수 없는 모델 및 소진된 키 쿼타에 대한 오류가 더 명확해졌습니다.

이번 달 새 모델 (거의 30개)

채팅 / 일반

  • claude-opus-5: 1M 컨텍스트 윈도우와 128K 최대 출력을 가진 Anthropic 플래그십 모델로, 고급 추론, 코딩 및 장기 에이전트 작업을 위해 설계되었습니다.
  • claude-sonnet-5: 채팅, 추론 및 에이전트 시나리오를 위한 모델입니다.
  • gpt-5.6-sol / gpt-5.6-terra / gpt-5.6-luna: OpenAI GPT-5.6 시리즈의 세 가지 계층으로, 각각 1,050,000 컨텍스트 윈도우, 128K 최대 출력을 가지며 텍스트 및 이미지 입력을 지원합니다. Sol은 플래그십 계층이며, Terra는 GPT-5.5 성능을 절반 가격으로 제공합니다. Luna는 비용 민감한 작업을 목표로 합니다.
  • qwen3.8-max-preview: 2.4T 매개변수를 가진 최신 세대 Qwen 기초 모델로, 한정된 시간 동안 90% 할인된 가격으로 제공됩니다.
  • kimi-k3: 2.8T 매개변수를 가진 Moonshot AI 오픈 롱 컨텍스트 모델로, 1M 컨텍스트 윈도우 및 네이티브 비전 입력을 지원합니다. Kimi K3 핸즈온 가이드를 참조하세요.
  • grok-4.5: 구성 가능한 추론, 도구 호출 및 500K 컨텍스트를 지원하며, 코드 수리 및 에이전트 워크플로우에 적합합니다.
  • tencent-hy3: Tencent Hunyuan Hy3의 GA 릴리스로, 295B 총 / 21B 활성 매개변수를 가진 MoE 아키텍처를 사용하며, 256K 컨텍스트 윈도우를 지원하고 Apache 2.0 라이센스 하에 오픈 소스입니다.
  • gemini-3.6-flash, gemini-3.5-flash-lite, gemini-2.5-flash-lite: Google Flash 시리즈의 새로운 계층입니다.
  • glm-5.2-fast-preview, Qwen3-235B-A22B-Instruct-2507, command-a-plus-05-2026, gemma-4-31b, longcat-2.0.

코딩

  • qwen3-coder-480b-a35b-instruct: 코드 생성, 소프트웨어 엔지니어링 에이전트 및 도구 호출 워크플로우를 위한 Qwen3-Coder 플래그십 코드 모델입니다.

오디오

  • gpt-audio-1.5: 오디오 입력 및 출력을 지원하는 첫 번째 일반 제공 (GA) OpenAI 오디오 모델입니다.
  • gpt-4o-transcribe-diarize: 화자 구분이 포함된 ASR 전사로, 전사 API를 통해서만 사용할 수 있습니다.
  • qwen-audio-3.0-tts-plus, qwen-audio-3.0-tts-flash: Qwen 음성 합성 모델입니다. 플러스 계층은 감정 및 캐릭터에 대한 세밀한 제어를 제공하며, 플래시 계층은 첫 패킷 지연이 200ms 이하로 제공됩니다.

이미지

  • mai-image-2.5-pro: 고충실도 현실감 및 이미지 내 텍스트 렌더링을 지원하는 Microsoft 플래그십 이미지 생성 및 편집 모델입니다. mai-image-2.5mai-image-2.5-flash도 같은 시리즈에서 제공됩니다.
  • gemini-3.1-flash-lite-image: Google 이미지 기능 모델입니다.

3D

  • hy-3d-3.1: 텐센트 Hunyuan 3D 전문판으로, 텍스트-투-3D, 이미지-투-3D 및 8뷰 다각 입력을 지원합니다.

검색 / 재순위

  • jina-reranker-v3.5: RAG, 검색 및 구조화된 데이터 순위를 위한 Jina AI 다국어 리스트 문서 재순위 모델입니다.

가격 및 공지사항

  • GLM-5.2 한정 시간대 할인: glm-5.2는 매일 시간대에 따라 할인되며, UTC 기준으로 14:00부터 24:00까지 50% 할인, 00:00부터 14:00까지 30% 할인됩니다. 한정 시간 제공입니다.
  • Qwen3.8-Max-Preview 90% 할인: 호출은 목록 가격의 10%로 청구되며, 동일한 지출로 10배 더 많은 사용이 가능합니다. 한정 시간 제공, 선착순입니다.
  • DeepSeek V4 시간대 청구: DeepSeek V4 모델은 피크 및 비피크 청구를 지원합니다. 요금은 요청 제출 시간의 시간대에 따라 부과되며, 경계를 넘는 스트리밍 요청도 제출 시간에 따라 가격이 책정됩니다.

자주 묻는 질문

이번 달에 추가된 모델은 무엇인가요?
거의 30개로, 채팅(claude-opus-5, claude-sonnet-5, GPT-5.6 시리즈, qwen3.8-max-preview, kimi-k3, grok-4.5, tencent-hy3 등), 코딩(qwen3-coder-480b-a35b-instruct), 오디오(gpt-audio-1.5 및 qwen-audio-3.0-tts 시리즈), 이미지(mai-image-2.5 시리즈), 3D(hy-3d-3.1) 및 재순위(jina-reranker-v3.5)를 포함합니다.

AIHubMix MCP 서버에 어떻게 연결하나요?
모든 MCP 지원 클라이언트(Claude Code, Codex, Cursor 등)에 https://mcp.aihubmix.com/mcp 진입점을 추가하세요. 자격 증명은 요청마다 클라이언트에 의해 전달됩니다. 그런 다음 모델 및 가격을 쿼리하고, 문서를 검색하고, 잔액을 확인하며, 채팅, 이미지 생성 및 비디오 생성 도구를 호출할 수 있습니다.

미디어 생성 API는 무엇을 지원하나요?
/ai/v1/images/generations/ai/v1/images/edits를 통해 이미지 생성 및 편집 요청을 제출한 후, 통합 비동기 작업 API를 사용하여 상태를 쿼리하고, 아티팩트를 다운로드하며, 웹훅 콜백을 받을 수 있습니다. 비동기 작업를 참조하세요.

Qwen3.8-Max-Preview 한정 시간 제공은 무엇인가요?
호출은 목록 가격의 10%로 청구되며, 동일한 지출로 10배 더 많은 사용이 가능합니다. 한정 시간 제공, 선착순입니다.

모든 모델은 모델 갤러리에서 확인하고, 통합 세부정보는 문서에서 찾을 수 있습니다.


업데이트: 2026-07-31

More from the blog