Mise en lumière de la version de juin 2026 : ~20 nouveaux modèles

31 juil. 2026 · AIHubMix · 3 min read · Journal des modifications

Mise en lumière de la version de juin 2026 : ~20 nouveaux modèles

Ce mois-ci, AIHubMix a ajouté environ 20 nouveaux modèles dans les domaines du chat, du code, de la vidéo et de l'image, et a expédié plusieurs fonctionnalités de la plateforme. La même clé API atteint désormais encore plus de modèles. Voici les points forts.

LLM Router

Définissez le nom du modèle sur auto, et la passerelle sélectionne le meilleur modèle parmi les centaines disponibles sur la plateforme en fonction de votre demande, avec des stratégies axées sur le coût, la qualité ou la faible latence, facturées par le modèle réellement utilisé. Pas de comparaison manuelle ou de changement de modèle, et aucun changement de code client. Voir LLM Router.

N'importe quel modèle sur le protocole des réponses

Le point de terminaison /v1/responses n'est plus limité à la famille GPT : il peut désormais appeler n'importe quel modèle sur la plateforme. Les outils construits sur le protocole des réponses (comme Codex CLI) peuvent donc utiliser GLM, Gemini, DeepSeek, Kimi, Qwen, et plus encore via un catalogue de modèles local, au lieu d'être restreints aux modèles officiels d'OpenAI. Voir Codex CLI · Modèles personnalisés.

Mapping et Fallback des modèles

Configurez le mapping des alias et le fallback en cas d'échec par clé API dans la console : votre client peut utiliser n'importe quel nom de modèle, que la passerelle réécrit pour le modèle cible réel ; si le modèle principal échoue, il passe automatiquement à un modèle de secours, facturé par le modèle qui répond finalement. Un seul incident ne fera pas chuter votre trafic de production, et le code client reste inchangé. Voir Mapping et Fallback des modèles.

AIHubMix CLI

Un seul binaire sans dépendances : aucun Python, Node ou Go requis. Interrogez votre solde, gérez vos clés API et listez les modèles disponibles directement depuis le terminal, avec un support de premier ordre pour les scripts et les agents IA comme Claude Code. Voir AIHubMix CLI.

AIHubMix Skill (extension pour agents de codage IA)

Une extension locale pour les agents IA qui supportent les Skills (Codex, Claude Code, Cursor, Cline, et plus). Utilisez un langage naturel pour intégrer AIHubMix, interroger des modèles, sélectionner par capacité, générer des exemples et résoudre des erreurs. La Skill lit en direct les informations sur les modèles, les prix et les protocoles des API officielles d'AIHubMix à la demande, de sorte que l'agent ne s'appuie jamais sur une liste de modèles obsolète. Voir Skills.

Domaine de secours : api.inferera.com

Lorsque le domaine principal aihubmix.com est inaccessible ou expire, dirigez vos demandes vers https://api.inferera.com. Les points de terminaison et les capacités sont identiques : votre clé API, modèle et corps de demande ne changent pas.

Également expédié

  • Entrée audio Gemini : le point de terminaison compatible OpenAI (/v1/chat/completions) accepte désormais input_audio et renvoie des audio_tokens dans l'utilisation.
  • Effort de raisonnement GLM 5.2 : le canal Zhipu natif prend en charge reasoning_effort pour une profondeur de réflexion ajustable.
  • Intégration Open Design : AIHubMix est désormais une passerelle BYOK intégrée pour Open Design.
  • Correction du plugin OpenClaw : aihubmix-auth est corrigé et stable à utiliser.

Stabilité & corrections

  • Précision de facturation améliorée et précision de mesure du cache.
  • Correction des modèles manquants dans /v1/models.
  • Correction de plusieurs problèmes de génération vidéo et de test de canal.

Nouveaux modèles ce mois-ci (~20)

Chat / Général

  • claude-fable-5 [Retiré] : dernière génération de Claude, avec des garde-fous de sécurité renforcés (voir Changelog · Notes sur Fable 5).
  • minimax-m3, qwen3.7-plus, glm-5.2, et Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.

Code

  • kimi-k2.7-code et kimi-k2.7-code-highspeed : la série de code de Kimi, y compris une variante à grande vitesse.
  • coding-glm-5.2 et le gratuit coding-glm-5.2-free.

Vidéo

  • Kling : texte en vidéo, image en vidéo, référence multi-image et génération multimodale omni.
  • happyhorse-1.1 : texte en vidéo (t2v), référence (r2v) et image en vidéo (i2v).

Image

  • Baidu musesteamer-air-image pour la génération d'images.

Également nouveau

  • grok-build-0.1, hy3-preview, et le gratuit step-3.7-flash-free.

Tarification & avis

  • step-3.7-flash, 90 % de réduction (temps limité) : 0,022 $ / M tokens d'entrée, 0,132 $ / M tokens de sortie.
  • Dépréciation & routage automatique : claude-opus-4-20250514 et claude-sonnet-4-20250514 ont été retirés par le fournisseur de modèles le 15 juin ; la plateforme les redirige automatiquement vers les versions 4-5 de la même famille.

FAQ

Quels modèles ont été ajoutés ce mois-ci ?
Environ 20, couvrant le chat (claude-fable-5 [Retiré], minimax-m3, qwen3.7-plus, glm-5.2, série doubao-seed-2-1), le code (série kimi-k2.7-code, coding-glm-5.2), la vidéo (Kling, happyhorse-1.1), et l'image (musesteamer-air-image).

Comment utiliser le LLM Router ?
Définissez le nom du modèle dans votre demande sur auto ; la passerelle sélectionne le meilleur modèle en fonction de votre demande et facture par le modèle qu'elle utilise réellement, sans changements de code client. Voir LLM Router.

Que faire si le domaine principal est inaccessible ?
Remplacez l'adresse de la demande par le domaine de secours https://api.inferera.com. Les points de terminaison et les capacités sont identiques, et aucun paramètre n'a besoin de changer.

Quel est le prix à durée limitée pour step-3.7-flash ?
0,022 $ / M tokens d'entrée et 0,132 $ / M tokens de sortie.

Parcourez tous les modèles dans le catalogue de modèles, et trouvez les détails d'intégration dans la documentation.


Mis à jour : 2026-06-30

More from the blog