Deze maand heeft AIHubMix ongeveer 20 nieuwe modellen toegevoegd op het gebied van chat, code, video en afbeelding, en verschillende platformfunctionaliteiten uitgebracht. Dezelfde API-sleutel bereikt nu nog meer. Hier zijn de hoogtepunten.
LLM Router
Stel de modelnaam in op auto, en de gateway selecteert het beste model uit de honderden op het platform op basis van uw verzoek, met kostenprioriteit, kwaliteitsprioriteit of lage-latentie strategieën, gefactureerd op basis van het model dat daadwerkelijk wordt aangesproken. Geen handmatige vergelijking of modelwisseling, en geen wijzigingen in de clientcode. Zie LLM Router.
Elk model op het Responses-protocol
De /v1/responses endpoint is niet langer beperkt tot de GPT-familie: het kan nu elk model op het platform aanroepen. Tools die zijn gebouwd op het Responses-protocol (zoals Codex CLI) kunnen daarom GLM, Gemini, DeepSeek, Kimi, Qwen en meer gebruiken via een lokale modelcatalogus, in plaats van beperkt te zijn tot de officiële modellen van OpenAI. Zie Codex CLI · Aangepaste Modellen.
Model Mapping & Fallback
Configureer aliasmapping en foutfallback per API-sleutel in de console: uw client kan elke modelnaam gebruiken, die de gateway herschrijft naar het echte doelformaat; als de primaire faalt, schakelt deze automatisch over naar een back-up, gefactureerd op basis van het model dat uiteindelijk reageert. Een enkele hapering zal uw productieverkeer niet onderbreken, en de clientcode blijft onaangeroerd. Zie Model Mapping & Fallback.
AIHubMix CLI
Een enkele binaire met nul afhankelijkheden: geen Python, Node of Go vereist. Vraag uw saldo op, beheer API-sleutels en lijst beschikbare modellen rechtstreeks vanuit de terminal, met eersteklas ondersteuning voor scripts en AI-agenten zoals Claude Code. Zie AIHubMix CLI.
AIHubMix Skill (uitbreiding voor AI-coderingsagenten)
Een lokale uitbreiding voor AI-agenten die Skills ondersteunen (Codex, Claude Code, Cursor, Cline, en meer). Gebruik natuurlijke taal om AIHubMix te integreren, modellen op te vragen, te selecteren op basis van mogelijkheden, voorbeelden te genereren en fouten op te lossen. De Skill leest live model-, prijs- en protocolinformatie van de officiële API's van AIHubMix op aanvraag, zodat de agent nooit afhankelijk is van een verouderde gebundelde modellenlijst. Zie Skills.
Backup domein: api.inferera.com
Wanneer het hoofddomein aihubmix.com niet bereikbaar is of time-out, richt uw verzoeken dan op https://api.inferera.com. Endpoints en mogelijkheden zijn identiek: uw API-sleutel, model en aanvraaglichaam veranderen niet.
Ook verzonden
- Gemini audio-invoer: de OpenAI-compatibele endpoint (
/v1/chat/completions) accepteert nuinput_audioen retourneert audio_tokens in gebruik. - GLM 5.2 redeneervermogen: het native Zhipu-kanaal ondersteunt
reasoning_effortvoor instelbare denkdiepte. - Open Design-integratie: AIHubMix is nu een ingebouwde BYOK-gateway voor Open Design.
- OpenClaw-pluginfix: aihubmix-auth is gerepareerd en stabiel te gebruiken.
Stabiliteit & fixes
- Verbeterde factureringsprecisie en cachemeting nauwkeurigheid.
- Verschillende ontbrekende modellen in
/v1/modelsopgelost. - Verschillende problemen met video-generatie en kanaaltesten opgelost.
Nieuwe modellen deze maand (~20)
Chat / Algemeen
- claude-fable-5 [Gepensioneerd]: Claude's nieuwste generatie, met sterkere veiligheidsmaatregelen (zie Changelog · Fable 5 notities).
- minimax-m3, qwen3.7-plus, glm-5.2, en Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.
Code
- kimi-k2.7-code en kimi-k2.7-code-highspeed: Kimi's codeserie, inclusief een hogesnelheidsvariant.
- coding-glm-5.2 en de gratis coding-glm-5.2-free.
Video
- Kling: tekst-naar-video, afbeelding-naar-video, multi-afbeelding referentie, en omni multimodale generatie.
- happyhorse-1.1: tekst-naar-video (t2v), referentie (r2v), en afbeelding-naar-video (i2v).
Afbeelding
- Baidu musesteamer-air-image voor afbeeldingsgeneratie.
Ook nieuw
- grok-build-0.1, hy3-preview, en de gratis step-3.7-flash-free.
Prijzen & mededelingen
- step-3.7-flash, 90% korting (beperkte tijd): $0.022 / M invoertokens, $0.132 / M uitvoertokens.
- Afbouw & auto-routing:
claude-opus-4-20250514enclaude-sonnet-4-20250514zijn op 15 juni door de modelprovider gepensioneerd; het platform routet ze automatisch naar de zelfde-familie 4-5 versies.
FAQ
Welke modellen zijn deze maand toegevoegd?
Ongeveer 20, variërend van chat (claude-fable-5 [Gepensioneerd], minimax-m3, qwen3.7-plus, glm-5.2, doubao-seed-2-1 serie), code (kimi-k2.7-code serie, coding-glm-5.2), video (Kling, happyhorse-1.1), en afbeelding (musesteamer-air-image).
Hoe gebruik ik de LLM Router?
Stel de modelnaam in uw verzoek in op auto; de gateway selecteert het beste model op basis van uw verzoek en factureert op basis van het model dat daadwerkelijk wordt aangesproken, zonder wijzigingen in de clientcode. Zie LLM Router.
Wat als het hoofddomein niet bereikbaar is?
Vervang het aanvraagadres door het backupdomein https://api.inferera.com. Endpoints en mogelijkheden zijn identiek, en er hoeven geen parameters te veranderen.
Wat is de tijdelijke prijs voor step-3.7-flash?
$0.022 / M invoertokens en $0.132 / M uitvoertokens.
Blader door alle modellen in de modelcatalogus, en vind integratiedetails in de documentatie.



