Este mes, AIHubMix agregó alrededor de 20 nuevos modelos en chat, código, video e imagen, y lanzó varias capacidades de la plataforma. La misma clave de API ahora llega a aún más. Aquí están los aspectos destacados.
LLM Router
Establezca el nombre del modelo en auto, y la puerta de enlace selecciona el mejor modelo de entre los cientos en la plataforma según su solicitud, con estrategias de costo primero, calidad primero o baja latencia, facturadas por el modelo que realmente utiliza. No hay comparación manual ni cambio de modelo, y no hay cambios en el código del cliente. Vea LLM Router.
Cualquier modelo en el protocolo de Respuestas
El endpoint /v1/responses ya no está limitado a la familia GPT: ahora puede llamar a cualquier modelo en la plataforma. Las herramientas construidas sobre el protocolo de Respuestas (como Codex CLI) pueden, por lo tanto, utilizar GLM, Gemini, DeepSeek, Kimi, Qwen y más a través de un catálogo de modelos local, en lugar de estar restringidas a los modelos oficiales de OpenAI. Vea Codex CLI · Modelos personalizados.
Mapeo de modelos y respaldo
Configure el mapeo de alias y el respaldo por clave de API en la consola: su cliente puede usar cualquier nombre de modelo, que la puerta de enlace reescribe al modelo objetivo real; si el primario falla, cambia automáticamente a un respaldo, facturado por el modelo que finalmente responde. Un solo contratiempo no hará caer su tráfico de producción, y el código del cliente permanece intacto. Vea Mapeo de modelos y respaldo.
AIHubMix CLI
Un solo binario sin dependencias: no se requiere Python, Node o Go. Consulte su saldo, gestione claves de API y liste modelos disponibles directamente desde la terminal, con soporte de primera clase para scripts y agentes de IA como Claude Code. Vea AIHubMix CLI.
AIHubMix Skill (extensión para agentes de codificación de IA)
Una extensión local para agentes de IA que soportan Skills (Codex, Claude Code, Cursor, Cline y más). Use lenguaje natural para integrar AIHubMix, consultar modelos, seleccionar por capacidad, generar ejemplos y solucionar errores. La Skill lee información en vivo sobre modelos, precios y protocolos de las APIs oficiales de AIHubMix bajo demanda, por lo que el agente nunca depende de una lista de modelos empaquetados obsoleta. Vea Skills.
Dominio de respaldo: api.inferera.com
Cuando el dominio principal aihubmix.com no está disponible o se agota el tiempo, dirija sus solicitudes a https://api.inferera.com. Los endpoints y capacidades son idénticos: su clave de API, modelo y cuerpo de solicitud no cambian.
También se lanzó
- Entrada de audio de Gemini: el endpoint compatible con OpenAI (
/v1/chat/completions) ahora aceptainput_audioy devuelve audio_tokens en uso. - Esfuerzo de razonamiento de GLM 5.2: el canal nativo de Zhipu soporta
reasoning_effortpara ajustar la profundidad de pensamiento. - Integración de Open Design: AIHubMix ahora es una puerta de enlace BYOK integrada para Open Design.
- Corrección del plugin OpenClaw: aihubmix-auth está corregido y estable para usar.
Estabilidad y correcciones
- Mejorada la precisión de facturación y la precisión de medición de caché.
- Corregidos modelos faltantes en
/v1/models. - Corregidos varios problemas de generación de video y pruebas de canal.
Nuevos modelos este mes (~20)
Chat / General
- claude-fable-5 [Retirado]: La última generación de Claude, con guardrails de seguridad más fuertes (ver Changelog · Notas de Fable 5).
- minimax-m3, qwen3.7-plus, glm-5.2, y Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.
Código
- kimi-k2.7-code y kimi-k2.7-code-highspeed: la serie de código de Kimi, incluyendo una variante de alta velocidad.
- coding-glm-5.2 y el gratuito coding-glm-5.2-free.
Video
- Kling: texto a video, imagen a video, referencia de múltiples imágenes y generación multimodal omni.
- happyhorse-1.1: texto a video (t2v), referencia (r2v) e imagen a video (i2v).
Imagen
- Baidu musesteamer-air-image para generación de imágenes.
También nuevo
- grok-build-0.1, hy3-preview, y el gratuito step-3.7-flash-free.
Precios y avisos
- step-3.7-flash, 90% de descuento (tiempo limitado): $0.022 / M tokens de entrada, $0.132 / M tokens de salida.
- Deprecación y enrutamiento automático:
claude-opus-4-20250514yclaude-sonnet-4-20250514fueron retirados por el proveedor del modelo el 15 de junio; la plataforma los enruta automáticamente a las versiones de la misma familia 4-5.
Preguntas frecuentes
¿Qué modelos se agregaron este mes?
Alrededor de 20, abarcando chat (claude-fable-5 [Retirado], minimax-m3, qwen3.7-plus, glm-5.2, serie doubao-seed-2-1), código (serie kimi-k2.7-code, coding-glm-5.2), video (Kling, happyhorse-1.1) e imagen (musesteamer-air-image).
¿Cómo uso el LLM Router?
Establezca el nombre del modelo en su solicitud a auto; la puerta de enlace selecciona el mejor modelo según su solicitud y factura por el modelo que realmente utiliza, sin cambios en el código del cliente. Vea LLM Router.
¿Qué pasa si el dominio principal no está disponible?
Reemplace la dirección de solicitud con el dominio de respaldo https://api.inferera.com. Los endpoints y capacidades son idénticos, y no es necesario cambiar parámetros.
¿Cuál es el precio por tiempo limitado para step-3.7-flash?
$0.022 / M tokens de entrada y $0.132 / M tokens de salida.
Explore todos los modelos en el catálogo de modelos, y encuentre detalles de integración en la documentación.
Actualizado: 2026-06-30