In diesem Monat hat AIHubMix rund 20 neue Modelle in den Bereichen Chat, Code, Video und Bild hinzugefügt und mehrere Plattformfunktionen bereitgestellt. Der gleiche API-Schlüssel erreicht jetzt noch mehr. Hier sind die Highlights.
LLM Router
Setzen Sie den Modellnamen auf auto, und das Gateway wählt das beste Modell aus den Hunderte auf der Plattform basierend auf Ihrer Anfrage aus, mit kostenorientierten, qualitätsorientierten oder latenzarmen Strategien, abgerechnet nach dem Modell, das tatsächlich verwendet wird. Kein manueller Vergleich oder Modellwechsel und keine Änderungen am Client-Code. Siehe LLM Router.
Jedes Modell im Responses-Protokoll
Der /v1/responses Endpunkt ist nicht mehr auf die GPT-Familie beschränkt: Er kann jetzt jedes Modell auf der Plattform aufrufen. Werkzeuge, die auf dem Responses-Protokoll basieren (wie Codex CLI), können daher GLM, Gemini, DeepSeek, Kimi, Qwen und mehr über einen lokalen Modellkatalog verwenden, anstatt auf die offiziellen Modelle von OpenAI beschränkt zu sein. Siehe Codex CLI · Benutzerdefinierte Modelle.
Modell-Mapping & Fallback
Konfigurieren Sie Alias-Mapping und Fallback bei Fehlern pro API-Schlüssel in der Konsole: Ihr Client kann jeden Modellnamen verwenden, den das Gateway in das tatsächliche Zielmodell umschreibt; wenn das primäre Modell ausfällt, wechselt es automatisch zu einem Backup, abgerechnet nach dem Modell, das schließlich antwortet. Ein einzelner Ausfall wird Ihren Produktionsverkehr nicht beeinträchtigen, und der Client-Code bleibt unverändert. Siehe Modell-Mapping & Fallback.
AIHubMix CLI
Eine einzige Binärdatei ohne Abhängigkeiten: kein Python, Node oder Go erforderlich. Abfragen Sie Ihr Guthaben, verwalten Sie API-Schlüssel und listen Sie verfügbare Modelle direkt über das Terminal auf, mit erstklassiger Unterstützung für Skripte und KI-Agenten wie Claude Code. Siehe AIHubMix CLI.
AIHubMix Skill (Erweiterung für KI-Coding-Agenten)
Eine lokale Erweiterung für KI-Agenten, die Skills unterstützen (Codex, Claude Code, Cursor, Cline und mehr). Verwenden Sie natürliche Sprache, um AIHubMix zu integrieren, Modelle abzufragen, nach Fähigkeiten auszuwählen, Beispiele zu generieren und Fehler zu beheben. Der Skill liest live Modell-, Preis- und Protokollinformationen von den offiziellen APIs von AIHubMix auf Abruf, sodass der Agent niemals auf eine veraltete gebündelte Modellliste angewiesen ist. Siehe Skills.
Backup-Domain: api.inferera.com
Wenn die Hauptdomain aihubmix.com nicht erreichbar ist oder eine Zeitüberschreitung auftritt, richten Sie Ihre Anfragen an https://api.inferera.com. Endpunkte und Funktionen sind identisch: Ihr API-Schlüssel, Modell und Anfragekörper ändern sich nicht.
Außerdem geliefert
- Gemini Audioeingang: Der OpenAI-kompatible Endpunkt (
/v1/chat/completions) akzeptiert jetztinput_audiound gibt audio_tokens in der Nutzung zurück. - GLM 5.2 Denkaufwand: Der native Zhipu-Kanal unterstützt
reasoning_effortfür anpassbare Denktiefe. - Open Design-Integration: AIHubMix ist jetzt ein integriertes BYOK-Gateway für Open Design.
- OpenClaw-Plugin-Fix: aihubmix-auth ist behoben und stabil zu verwenden.
Stabilität & Fehlerbehebungen
- Verbesserte Abrechnungsgenauigkeit und Cache-Messgenauigkeit.
- Fehlende Modelle im
/v1/modelsbehoben. - Mehrere Probleme bei der Videoerstellung und Kanaltests behoben.
Neue Modelle in diesem Monat (~20)
Chat / Allgemein
- claude-fable-5 [Eingestellt]: Claudes neueste Generation, mit stärkeren Sicherheitsvorkehrungen (siehe Changelog · Fable 5 Hinweise).
- minimax-m3, qwen3.7-plus, glm-5.2 und Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.
Code
- kimi-k2.7-code und kimi-k2.7-code-highspeed: Kimis Code-Serie, einschließlich einer Hochgeschwindigkeitsvariante.
- coding-glm-5.2 und das kostenlose coding-glm-5.2-free.
Video
- Kling: Text-zu-Video, Bild-zu-Video, Multi-Bild-Referenz und omni-multimodale Generierung.
- happyhorse-1.1: Text-zu-Video (t2v), Referenz (r2v) und Bild-zu-Video (i2v).
Bild
- Baidu musesteamer-air-image zur Bilderzeugung.
Auch neu
- grok-build-0.1, hy3-preview und das kostenlose step-3.7-flash-free.
Preise & Hinweise
- step-3.7-flash, 90% Rabatt (begrenzte Zeit): $0.022 / M Eingabetokens, $0.132 / M Ausgabetokens.
- Abkündigung & Auto-Routing:
claude-opus-4-20250514undclaude-sonnet-4-20250514wurden am 15. Juni vom Modellanbieter eingestellt; die Plattform routet sie automatisch zu den Versionen der gleichen Familie 4-5.
FAQ
Welche Modelle wurden in diesem Monat hinzugefügt?
Rund 20, die Chat (claude-fable-5 [Eingestellt], minimax-m3, qwen3.7-plus, glm-5.2, doubao-seed-2-1-Serie), Code (kimi-k2.7-code-Serie, coding-glm-5.2), Video (Kling, happyhorse-1.1) und Bild (musesteamer-air-image) abdecken.
Wie benutze ich den LLM Router?
Setzen Sie den Modellnamen in Ihrer Anfrage auf auto; das Gateway wählt das beste Modell basierend auf Ihrer Anfrage aus und rechnet nach dem Modell ab, das tatsächlich verwendet wird, ohne Änderungen am Client-Code. Siehe LLM Router.
Was ist, wenn die Hauptdomain nicht erreichbar ist?
Ersetzen Sie die Anfrageadresse durch die Backup-Domain https://api.inferera.com. Endpunkte und Funktionen sind identisch, und keine Parameter müssen geändert werden.
Was ist der zeitlich begrenzte Preis für step-3.7-flash?
$0.022 / M Eingabetokens und $0.132 / M Ausgabetokens.
Durchsuchen Sie alle Modelle im Modellkatalog und finden Sie Integrationsdetails in den Dokumenten.
Aktualisiert: 2026-06-30