Destaque do Lançamento de Junho de 2026: ~20 Novos Modelos

31 de jul. de 2026 · AIHubMix · 3 min read · Registro de Mudanças

Destaque do Lançamento de Junho de 2026: ~20 Novos Modelos

Este mês, o AIHubMix adicionou cerca de 20 novos modelos em chat, código, vídeo e imagem, e lançou várias capacidades da plataforma. A mesma chave de API agora alcança ainda mais. Aqui estão os destaques.

LLM Router

Defina o nome do modelo como auto, e o gateway seleciona o melhor modelo entre os centenas disponíveis na plataforma com base na sua solicitação, utilizando estratégias de custo-primeiro, qualidade-primeiro ou baixa-latência, cobrando pelo modelo que realmente é acessado. Sem comparação manual ou troca de modelos, e sem mudanças no código do cliente. Veja LLM Router.

Qualquer modelo no protocolo de Respostas

O endpoint /v1/responses não está mais limitado à família GPT: agora pode chamar qualquer modelo na plataforma. Ferramentas construídas no protocolo de Respostas (como Codex CLI) podem, portanto, usar GLM, Gemini, DeepSeek, Kimi, Qwen e mais através de um catálogo de modelos local, em vez de serem restritas aos modelos oficiais da OpenAI. Veja Codex CLI · Modelos Personalizados.

Mapeamento de Modelos & Fallback

Configure o mapeamento de alias e o fallback de falhas por chave de API no console: seu cliente pode usar qualquer nome de modelo, que o gateway reescreve para o modelo alvo real; se o primário falhar, ele muda automaticamente para um backup, cobrando pelo modelo que finalmente responde. Um único contratempo não derrubará seu tráfego de produção, e o código do cliente permanece inalterado. Veja Mapeamento de Modelos & Fallback.

AIHubMix CLI

Um único binário com zero dependências: sem Python, Node ou Go necessários. Consulte seu saldo, gerencie chaves de API e liste modelos disponíveis diretamente do terminal, com suporte de primeira classe para scripts e agentes de IA como Claude Code. Veja AIHubMix CLI.

AIHubMix Skill (extensão para agentes de codificação de IA)

Uma extensão local para agentes de IA que suportam Skills (Codex, Claude Code, Cursor, Cline e mais). Use linguagem natural para integrar o AIHubMix, consultar modelos, selecionar por capacidade, gerar exemplos e solucionar erros. A Skill lê informações de modelo, preços e protocolo ao vivo das APIs oficiais do AIHubMix sob demanda, para que o agente nunca dependa de uma lista de modelos desatualizada. Veja Skills.

Domínio de backup: api.inferera.com

Quando o domínio principal aihubmix.com estiver inacessível ou expirar, direcione suas solicitações para https://api.inferera.com. Os endpoints e capacidades são idênticos: sua chave de API, modelo e corpo da solicitação não mudam.

Também lançado

  • Entrada de áudio Gemini: o endpoint compatível com OpenAI (/v1/chat/completions) agora aceita input_audio e retorna audio_tokens no uso.
  • Esforço de raciocínio GLM 5.2: o canal nativo Zhipu suporta reasoning_effort para profundidade de pensamento ajustável.
  • Integração Open Design: o AIHubMix agora é um gateway BYOK integrado para Open Design.
  • Correção do plugin OpenClaw: aihubmix-auth está corrigido e estável para uso.

Estabilidade & correções

  • Precisão de cobrança melhorada e precisão de medição de cache.
  • Corrigidos modelos ausentes em /v1/models.
  • Corrigidos vários problemas de geração de vídeo e testes de canal.

Novos modelos este mês (~20)

Chat / Geral

  • claude-fable-5 [Aposentado]: A última geração de Claude, com guardrails de segurança mais fortes (veja Changelog · Notas do Fable 5).
  • minimax-m3, qwen3.7-plus, glm-5.2, e Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.

Código

  • kimi-k2.7-code e kimi-k2.7-code-highspeed: A série de código de Kimi, incluindo uma variante de alta velocidade.
  • coding-glm-5.2 e o gratuito coding-glm-5.2-free.

Vídeo

  • Kling: texto-para-vídeo, imagem-para-vídeo, referência de múltiplas imagens e geração multimodal ômega.
  • happyhorse-1.1: texto-para-vídeo (t2v), referência (r2v) e imagem-para-vídeo (i2v).

Imagem

  • Baidu musesteamer-air-image para geração de imagem.

Também novo

  • grok-build-0.1, hy3-preview, e o gratuito step-3.7-flash-free.

Preços & avisos

  • step-3.7-flash, 90% de desconto (tempo limitado): $0.022 / M tokens de entrada, $0.132 / M tokens de saída.
  • Descontinuação & roteamento automático: claude-opus-4-20250514 e claude-sonnet-4-20250514 foram aposentados pelo provedor do modelo em 15 de junho; a plataforma os roteia automaticamente para as versões da mesma família 4-5.

FAQ

Quais modelos foram adicionados este mês?
Cerca de 20, abrangendo chat (claude-fable-5 [Aposentado], minimax-m3, qwen3.7-plus, glm-5.2, série doubao-seed-2-1), código (série kimi-k2.7-code, coding-glm-5.2), vídeo (Kling, happyhorse-1.1) e imagem (musesteamer-air-image).

Como uso o LLM Router?
Defina o nome do modelo na sua solicitação como auto; o gateway seleciona o melhor modelo com base na sua solicitação e cobra pelo modelo que realmente é acessado, sem mudanças no código do cliente. Veja LLM Router.

E se o domínio principal estiver inacessível?
Substitua o endereço da solicitação pelo domínio de backup https://api.inferera.com. Os endpoints e capacidades são idênticos, e nenhum parâmetro precisa mudar.

Qual é o preço por tempo limitado para step-3.7-flash?
$0.022 / M tokens de entrada e $0.132 / M tokens de saída.

Navegue por todos os modelos no catálogo de modelos, e encontre detalhes de integração na documentação.


Atualizado: 2026-06-30

More from the blog