Juni 2026 Release Spotlight: ~20 Nieuwe Modellen

31 jul 2026 · AIHubMix · 3 min read · Wijzigingslog

Juni 2026 Release Spotlight: ~20 Nieuwe Modellen

Deze maand heeft AIHubMix ongeveer 20 nieuwe modellen toegevoegd voor chat, code, video en afbeelding, en verschillende platformfunctionaliteiten uitgebracht. Dezelfde API-sleutel bereikt nu nog meer. Hier zijn de hoogtepunten.

LLM Router

Stel de modelnaam in op auto, en de gateway selecteert het beste model uit de honderden op het platform op basis van uw verzoek, met kostenprioriteit, kwaliteitsprioriteit of lage-latentie strategieën, gefactureerd op basis van het model dat daadwerkelijk wordt aangesproken. Geen handmatige vergelijking of modelwisseling, en geen wijzigingen in de clientcode. Zie LLM Router.

Elk model op het Responses-protocol

De /v1/responses endpoint is niet langer beperkt tot de GPT-familie: het kan nu elk model op het platform aanroepen. Tools die zijn gebouwd op het Responses-protocol (zoals Codex CLI) kunnen daarom GLM, Gemini, DeepSeek, Kimi, Qwen en meer gebruiken via een lokale modelcatalogus, in plaats van beperkt te zijn tot de officiële modellen van OpenAI. Zie Codex CLI · Aangepaste Modellen.

Model Mapping & Fallback

Configureer alias mapping en foutfallback per API-sleutel in de console: uw client kan elke modelnaam gebruiken, die de gateway herschrijft naar het echte doelformodel; als de primaire faalt, schakelt het automatisch over naar een reserve, gefactureerd op basis van het model dat uiteindelijk reageert. Een enkele hapering zal uw productieverkeer niet onderbreken, en de clientcode blijft onaangetast. Zie Model Mapping & Fallback.

AIHubMix CLI

Een enkele binaire met nul afhankelijkheden: geen Python, Node of Go vereist. Vraag uw saldo op, beheer API-sleutels en lijst beschikbare modellen rechtstreeks vanuit de terminal, met eersteklas ondersteuning voor scripts en AI-agenten zoals Claude Code. Zie AIHubMix CLI.

AIHubMix Skill (uitbreiding voor AI-coding-agenten)

Een lokale uitbreiding voor AI-agenten die Skills ondersteunen (Codex, Claude Code, Cursor, Cline en meer). Gebruik natuurlijke taal om AIHubMix te integreren, modellen op te vragen, te selecteren op basis van mogelijkheden, voorbeelden te genereren en fouten op te lossen. De Skill leest live model-, prijs- en protocolinformatie van de officiële API's van AIHubMix op aanvraag, zodat de agent nooit afhankelijk is van een verouderde gebundelde modellenlijst. Zie Skills.

Backup domein: api.inferera.com

Wanneer het hoofddomein aihubmix.com niet bereikbaar is of time-out, richt uw verzoeken dan op https://api.inferera.com. Endpoints en mogelijkheden zijn identiek: uw API-sleutel, model en aanvraaglichaam veranderen niet.

Ook verzonden

  • Gemini audio-invoer: de OpenAI-compatibele endpoint (/v1/chat/completions) accepteert nu input_audio en retourneert audio_tokens in gebruik.
  • GLM 5.2 redeneervermogen: het native Zhipu-kanaal ondersteunt reasoning_effort voor instelbare denkdiepte.
  • Open Design-integratie: AIHubMix is nu een ingebouwde BYOK-gateway voor Open Design.
  • OpenClaw-pluginfix: aihubmix-auth is gefixt en stabiel te gebruiken.

Stabiliteit & fixes

  • Verbeterde factureringsprecisie en cachemeteringsnauwkeurigheid.
  • Verschillende ontbrekende modellen in /v1/models opgelost.
  • Verschillende problemen met video-generatie en kanaaltesten opgelost.

Nieuwe modellen deze maand (~20)

Chat / Algemeen

  • claude-fable-5 [Met pensioen]: Claude's nieuwste generatie, met sterkere veiligheidsmaatregelen (zie Changelog · Fable 5 notities).
  • minimax-m3, qwen3.7-plus, glm-5.2, en Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.

Code

  • kimi-k2.7-code en kimi-k2.7-code-highspeed: Kimi's codeserie, inclusief een hogesnelheidsvariant.
  • coding-glm-5.2 en de gratis coding-glm-5.2-free.

Video

  • Kling: tekst-naar-video, afbeelding-naar-video, multi-afbeelding referentie, en omni multimodale generatie.
  • happyhorse-1.1: tekst-naar-video (t2v), referentie (r2v), en afbeelding-naar-video (i2v).

Afbeelding

  • Baidu musesteamer-air-image voor afbeeldingsgeneratie.

Ook nieuw

  • grok-build-0.1, hy3-preview, en de gratis step-3.7-flash-free.

Prijzen & mededelingen

  • step-3.7-flash, 90% korting (beperkte tijd): $0.022 / M invoertokens, $0.132 / M uitvoertokens.
  • Afbouw & automatische routering: claude-opus-4-20250514 en claude-sonnet-4-20250514 zijn op 15 juni door de modelprovider met pensioen gegaan; het platform routet ze automatisch naar de zelfde-familie 4-5 versies.

FAQ

Welke modellen zijn deze maand toegevoegd?
Ongeveer 20, verspreid over chat (claude-fable-5 [Met pensioen], minimax-m3, qwen3.7-plus, glm-5.2, doubao-seed-2-1 serie), code (kimi-k2.7-code serie, coding-glm-5.2), video (Kling, happyhorse-1.1), en afbeelding (musesteamer-air-image).

Hoe gebruik ik de LLM Router?
Stel de modelnaam in uw verzoek in op auto; de gateway selecteert het beste model op basis van uw verzoek en factureert op basis van het model dat daadwerkelijk wordt aangesproken, zonder wijzigingen in de clientcode. Zie LLM Router.

Wat als het hoofddomein niet bereikbaar is?
Vervang het aanvraagadres door het backupdomein https://api.inferera.com. Endpoints en mogelijkheden zijn identiek, en er hoeven geen parameters te veranderen.

Wat is de tijdelijke prijs voor step-3.7-flash?
$0.022 / M invoertokens en $0.132 / M uitvoertokens.

Blader door alle modellen op de modelcatalogus, en vind integratiedetails in de documentatie.


Bijgewerkt: 2026-06-30

More from the blog