W tym miesiącu AIHubMix dodał około 20 nowych modeli w obszarach czatu, kodu, wideo i obrazu oraz wprowadził kilka funkcji platformy. Ten sam klucz API teraz obsługuje jeszcze więcej. Oto najważniejsze informacje.
LLM Router
Ustaw nazwę modelu na auto, a brama wybierze najlepszy model spośród setek dostępnych na platformie w zależności od twojego zapytania, z wykorzystaniem strategii kosztowej, jakościowej lub niskolatencyjnej, rozliczanej na podstawie modelu, który faktycznie zostanie użyty. Brak ręcznego porównywania lub przełączania modeli oraz brak zmian w kodzie klienta. Zobacz LLM Router.
Dowolny model w protokole odpowiedzi
Endpoint /v1/responses nie jest już ograniczony do rodziny GPT: teraz może wywoływać dowolny model na platformie. Narzędzia zbudowane na protokole odpowiedzi (takie jak Codex CLI) mogą zatem korzystać z GLM, Gemini, DeepSeek, Kimi, Qwen i innych za pośrednictwem lokalnego katalogu modeli, zamiast być ograniczonymi do oficjalnych modeli OpenAI. Zobacz Codex CLI · Modele niestandardowe.
Mapowanie modeli i fallback
Skonfiguruj mapowanie aliasów i fallback w przypadku awarii dla każdego klucza API w konsoli: twój klient może używać dowolnej nazwy modelu, którą brama przekształca na rzeczywisty model docelowy; jeśli główny model zawiedzie, automatycznie przełączy się na zapasowy, rozliczany na podstawie modelu, który ostatecznie odpowiada. Jedno opóźnienie nie przerwie twojego ruchu produkcyjnego, a kod klienta pozostaje nietknięty. Zobacz Mapowanie modeli i fallback.
AIHubMix CLI
Jedna binarka bez zależności: nie wymaga Pythona, Node ani Go. Sprawdzaj swoje saldo, zarządzaj kluczami API i wyświetlaj dostępne modele bezpośrednio z terminala, z doskonałym wsparciem dla skryptów i agentów AI, takich jak Claude Code. Zobacz AIHubMix CLI.
AIHubMix Skill (rozszerzenie dla agentów kodujących AI)
Lokalne rozszerzenie dla agentów AI, które wspierają umiejętności (Codex, Claude Code, Cursor, Cline i inne). Użyj naturalnego języka, aby zintegrować AIHubMix, zapytać o modele, wybrać według możliwości, generować przykłady i rozwiązywać błędy. Umiejętność odczytuje na żywo informacje o modelach, cenach i protokołach z oficjalnych API AIHubMix na żądanie, więc agent nigdy nie polega na przestarzałej liście modeli. Zobacz Umiejętności.
Zapasowa domena: api.inferera.com
Kiedy główna domena aihubmix.com jest niedostępna lub czas oczekiwania wygasa, kieruj swoje zapytania na https://api.inferera.com. Endpoints i możliwości są identyczne: twój klucz API, model i treść zapytania nie zmieniają się.
Również wydane
- Gemini audio input: endpoint zgodny z OpenAI (
/v1/chat/completions) teraz akceptujeinput_audioi zwraca audio_tokens w użyciu. - GLM 5.2 reasoning effort: natywny kanał Zhipu wspiera
reasoning_effortdla regulowanej głębokości myślenia. - Integracja Open Design: AIHubMix jest teraz wbudowaną bramą BYOK dla Open Design.
- Poprawka wtyczki OpenClaw: aihubmix-auth jest naprawiony i stabilny w użyciu.
Stabilność i poprawki
- Poprawiona precyzja rozliczeń i dokładność pomiaru pamięci podręcznej.
- Naprawiono brakujące modele w
/v1/models. - Naprawiono kilka problemów z generowaniem wideo i testowaniem kanałów.
Nowe modele w tym miesiącu (~20)
Czat / Ogólne
- claude-fable-5 [Wycofany]: Najnowsza generacja Claude'a, z silniejszymi zabezpieczeniami (zobacz Dziennik zmian · Notatki Fable 5).
- minimax-m3, qwen3.7-plus, glm-5.2 oraz Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.
Kod
- kimi-k2.7-code i kimi-k2.7-code-highspeed: seria kodów Kimi, w tym wariant o wysokiej prędkości.
- coding-glm-5.2 oraz darmowy coding-glm-5.2-free.
Wideo
- Kling: tekst na wideo, obraz na wideo, odniesienie do wielu obrazów oraz generacja multimodalna omni.
- happyhorse-1.1: tekst na wideo (t2v), odniesienie (r2v) oraz obraz na wideo (i2v).
Obraz
- Baidu musesteamer-air-image do generacji obrazów.
Również nowe
- grok-build-0.1, hy3-preview oraz darmowy step-3.7-flash-free.
Ceny i ogłoszenia
- step-3.7-flash, 90% zniżki (ograniczony czas): $0.022 / M tokenów wejściowych, $0.132 / M tokenów wyjściowych.
- Wycofanie i automatyczne kierowanie:
claude-opus-4-20250514orazclaude-sonnet-4-20250514zostały wycofane przez dostawcę modelu 15 czerwca; platforma automatycznie kieruje je do modeli z tej samej rodziny 4-5.
FAQ
Jakie modele zostały dodane w tym miesiącu?
Około 20, obejmujących czat (claude-fable-5 [Wycofany], minimax-m3, qwen3.7-plus, glm-5.2, seria doubao-seed-2-1), kod (seria kimi-k2.7-code, coding-glm-5.2), wideo (Kling, happyhorse-1.1) oraz obraz (musesteamer-air-image).
Jak używać LLM Router?
Ustaw nazwę modelu w swoim zapytaniu na auto; brama wybiera najlepszy model na podstawie twojego zapytania i rozlicza na podstawie modelu, który faktycznie zostanie użyty, bez zmian w kodzie klienta. Zobacz LLM Router.
Co jeśli główna domena jest niedostępna?
Zastąp adres zapytania zapasową domeną https://api.inferera.com. Endpoints i możliwości są identyczne, a żadne parametry nie muszą się zmieniać.
Jaka jest cena promocyjna dla step-3.7-flash?
$0.022 / M tokenów wejściowych i $0.132 / M tokenów wyjściowych.
Przeglądaj wszystkie modele w katalogu modeli i znajdź szczegóły integracji w dokumentacji.
Zaktualizowano: 2026-06-30