Czerwcowe wydanie 2026: ~20 nowych modeli

AIHubMix3 min czytania
Czerwcowe wydanie 2026: ~20 nowych modeli

W tym miesiącu AIHubMix dodał około 20 nowych modeli w obszarach czatu, kodu, wideo i obrazu oraz wprowadził kilka możliwości platformy. Ten sam klucz API teraz obsługuje jeszcze więcej. Oto najważniejsze informacje.

LLM Router

Ustaw nazwę modelu na auto, a brama wybierze najlepszy model spośród setek dostępnych na platformie na podstawie Twojego zapytania, z strategiami koszt-przede wszystkim, jakość-przede wszystkim lub niskie opóźnienie, rozliczając według modelu, który faktycznie zostanie użyty. Brak ręcznego porównywania lub przełączania modeli, a kod klienta pozostaje niezmieniony. Zobacz LLM Router.

Dowolny model w protokole odpowiedzi

Endpoint /v1/responses nie jest już ograniczony do rodziny GPT: teraz może wywoływać dowolny model na platformie. Narzędzia zbudowane na protokole odpowiedzi (takie jak Codex CLI) mogą zatem korzystać z GLM, Gemini, DeepSeek, Kimi, Qwen i innych za pośrednictwem lokalnego katalogu modeli, zamiast być ograniczonymi do oficjalnych modeli OpenAI. Zobacz Codex CLI · Modele niestandardowe.

Mapowanie modeli i Fallback

Skonfiguruj mapowanie aliasów i awaryjny fallback dla każdego klucza API w konsoli: Twój klient może używać dowolnej nazwy modelu, którą brama przekształca na rzeczywisty model docelowy; jeśli główny model zawiedzie, automatycznie przełącza się na zapasowy, rozliczając według modelu, który ostatecznie odpowiada. Jedno potknięcie nie spowoduje utraty ruchu produkcyjnego, a kod klienta pozostaje nietknięty. Zobacz Mapowanie modeli i Fallback.

AIHubMix CLI

Jedna binarka bez zależności: nie wymaga Pythona, Node ani Go. Sprawdzaj swoje saldo, zarządzaj kluczami API i wyświetlaj dostępne modele bezpośrednio z terminala, z doskonałym wsparciem dla skryptów i agentów AI, takich jak Claude Code. Zobacz AIHubMix CLI.

AIHubMix Skill (rozszerzenie dla agentów kodujących AI)

Lokalne rozszerzenie dla agentów AI, które wspierają umiejętności (Codex, Claude Code, Cursor, Cline i inne). Użyj języka naturalnego, aby zintegrować AIHubMix, zapytać o modele, wybierać według możliwości, generować przykłady i rozwiązywać błędy. Umiejętność odczytuje na żywo informacje o modelach, cenach i protokołach z oficjalnych API AIHubMix na żądanie, więc agent nigdy nie polega na przestarzałej liście modeli. Zobacz Umiejętności.

Zapasowa domena: api.inferera.com

Kiedy główna domena aihubmix.com jest niedostępna lub czas oczekiwania wygasa, kieruj swoje zapytania na https://api.inferera.com. Endpointy i możliwości są identyczne: Twój klucz API, model i treść zapytania nie zmieniają się.

Również wydane

  • Gemini audio input: endpoint zgodny z OpenAI (/v1/chat/completions) teraz akceptuje input_audio i zwraca audio_tokens w użyciu.
  • GLM 5.2 reasoning effort: natywny kanał Zhipu wspiera reasoning_effort dla regulowanej głębokości myślenia.
  • Integracja Open Design: AIHubMix jest teraz wbudowaną bramą BYOK dla Open Design.
  • Poprawka wtyczki OpenClaw: aihubmix-auth jest naprawiony i stabilny do użycia.

Stabilność i poprawki

  • Poprawiona precyzja rozliczeń i dokładność pomiaru pamięci podręcznej.
  • Naprawiono brakujące modele w /v1/models.
  • Naprawiono kilka problemów z generowaniem wideo i testowaniem kanałów.

Nowe modele w tym miesiącu (~20)

Czat / Ogólne

  • claude-fable-5 [Wycofany]: Najnowsza generacja Claude'a, z silniejszymi zabezpieczeniami (zobacz Dziennik zmian · Uwagi do Fable 5).
  • minimax-m3, qwen3.7-plus, glm-5.2 oraz Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.

Kod

  • kimi-k2.7-code oraz kimi-k2.7-code-highspeed: seria kodów Kimi, w tym wariant o wysokiej prędkości.
  • coding-glm-5.2 oraz darmowy coding-glm-5.2-free.

Wideo

  • Kling: tekst-do-wideo, obraz-do-wideo, odniesienie do wielu obrazów oraz generacja multimodalna omni.
  • happyhorse-1.1: tekst-do-wideo (t2v), odniesienie (r2v) oraz obraz-do-wideo (i2v).

Obraz

  • Baidu musesteamer-air-image do generacji obrazów.

Również nowe

  • grok-build-0.1, hy3-preview oraz darmowy step-3.7-flash-free.

Ceny i ogłoszenia

  • step-3.7-flash, 90% zniżki (ograniczony czas): $0.022 / M tokenów wejściowych, $0.132 / M tokenów wyjściowych.
  • Wycofanie i automatyczne kierowanie: claude-opus-4-20250514 oraz claude-sonnet-4-20250514 zostały wycofane przez dostawcę modelu 15 czerwca; platforma automatycznie kieruje je do wersji 4-5 tej samej rodziny.

FAQ

Jakie modele zostały dodane w tym miesiącu?
Około 20, obejmujących czat (claude-fable-5 [Wycofany], minimax-m3, qwen3.7-plus, glm-5.2, seria doubao-seed-2-1), kod (seria kimi-k2.7-code, coding-glm-5.2), wideo (Kling, happyhorse-1.1) oraz obraz (musesteamer-air-image).

Jak używać LLM Router?
Ustaw nazwę modelu w swoim zapytaniu na auto; brama wybiera najlepszy model na podstawie Twojego zapytania i rozlicza według modelu, który faktycznie zostanie użyty, bez zmian w kodzie klienta. Zobacz LLM Router.

Co jeśli główna domena jest niedostępna?
Zamień adres zapytania na zapasową domenę https://api.inferera.com. Endpointy i możliwości są identyczne, a żadne parametry nie muszą się zmieniać.

Jaka jest cena promocyjna dla step-3.7-flash?
$0.022 / M tokenów wejściowych i $0.132 / M tokenów wyjściowych.

Przeglądaj wszystkie modele w katalogu modeli i znajdź szczegóły integracji w dokumentacji.