Czerwiec 2026: Nowości w wersji - ~20 nowych modeli

31 lip 2026 · AIHubMix · 3 min read · Dziennik zmian

Czerwiec 2026: Nowości w wersji - ~20 nowych modeli

W tym miesiącu AIHubMix dodał około 20 nowych modeli w obszarach czatu, kodu, wideo i obrazu oraz wprowadził kilka funkcji platformy. Ten sam klucz API teraz obsługuje jeszcze więcej. Oto najważniejsze informacje.

LLM Router

Ustaw nazwę modelu na auto, a brama wybierze najlepszy model spośród setek dostępnych na platformie w zależności od twojego zapytania, z wykorzystaniem strategii kosztowej, jakościowej lub niskolatencyjnej, rozliczanej na podstawie modelu, który faktycznie zostanie użyty. Brak ręcznego porównywania lub przełączania modeli oraz brak zmian w kodzie klienta. Zobacz LLM Router.

Dowolny model w protokole odpowiedzi

Endpoint /v1/responses nie jest już ograniczony do rodziny GPT: teraz może wywoływać dowolny model na platformie. Narzędzia zbudowane na protokole odpowiedzi (takie jak Codex CLI) mogą zatem korzystać z GLM, Gemini, DeepSeek, Kimi, Qwen i innych za pośrednictwem lokalnego katalogu modeli, zamiast być ograniczonymi do oficjalnych modeli OpenAI. Zobacz Codex CLI · Modele niestandardowe.

Mapowanie modeli i fallback

Skonfiguruj mapowanie aliasów i fallback w przypadku awarii dla każdego klucza API w konsoli: twój klient może używać dowolnej nazwy modelu, którą brama przekształca na rzeczywisty model docelowy; jeśli główny model zawiedzie, automatycznie przełączy się na zapasowy, rozliczany na podstawie modelu, który ostatecznie odpowiada. Jedno opóźnienie nie przerwie twojego ruchu produkcyjnego, a kod klienta pozostaje nietknięty. Zobacz Mapowanie modeli i fallback.

AIHubMix CLI

Jedna binarka bez zależności: nie wymaga Pythona, Node ani Go. Sprawdzaj swoje saldo, zarządzaj kluczami API i wyświetlaj dostępne modele bezpośrednio z terminala, z doskonałym wsparciem dla skryptów i agentów AI, takich jak Claude Code. Zobacz AIHubMix CLI.

AIHubMix Skill (rozszerzenie dla agentów kodujących AI)

Lokalne rozszerzenie dla agentów AI, które wspierają umiejętności (Codex, Claude Code, Cursor, Cline i inne). Użyj naturalnego języka, aby zintegrować AIHubMix, zapytać o modele, wybrać według możliwości, generować przykłady i rozwiązywać błędy. Umiejętność odczytuje na żywo informacje o modelach, cenach i protokołach z oficjalnych API AIHubMix na żądanie, więc agent nigdy nie polega na przestarzałej liście modeli. Zobacz Umiejętności.

Zapasowa domena: api.inferera.com

Kiedy główna domena aihubmix.com jest niedostępna lub czas oczekiwania wygasa, kieruj swoje zapytania na https://api.inferera.com. Endpoints i możliwości są identyczne: twój klucz API, model i treść zapytania nie zmieniają się.

Również wydane

  • Gemini audio input: endpoint zgodny z OpenAI (/v1/chat/completions) teraz akceptuje input_audio i zwraca audio_tokens w użyciu.
  • GLM 5.2 reasoning effort: natywny kanał Zhipu wspiera reasoning_effort dla regulowanej głębokości myślenia.
  • Integracja Open Design: AIHubMix jest teraz wbudowaną bramą BYOK dla Open Design.
  • Poprawka wtyczki OpenClaw: aihubmix-auth jest naprawiony i stabilny w użyciu.

Stabilność i poprawki

  • Poprawiona precyzja rozliczeń i dokładność pomiaru pamięci podręcznej.
  • Naprawiono brakujące modele w /v1/models.
  • Naprawiono kilka problemów z generowaniem wideo i testowaniem kanałów.

Nowe modele w tym miesiącu (~20)

Czat / Ogólne

  • claude-fable-5 [Wycofany]: Najnowsza generacja Claude'a, z silniejszymi zabezpieczeniami (zobacz Dziennik zmian · Notatki Fable 5).
  • minimax-m3, qwen3.7-plus, glm-5.2 oraz Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.

Kod

  • kimi-k2.7-code i kimi-k2.7-code-highspeed: seria kodów Kimi, w tym wariant o wysokiej prędkości.
  • coding-glm-5.2 oraz darmowy coding-glm-5.2-free.

Wideo

  • Kling: tekst na wideo, obraz na wideo, odniesienie do wielu obrazów oraz generacja multimodalna omni.
  • happyhorse-1.1: tekst na wideo (t2v), odniesienie (r2v) oraz obraz na wideo (i2v).

Obraz

  • Baidu musesteamer-air-image do generacji obrazów.

Również nowe

  • grok-build-0.1, hy3-preview oraz darmowy step-3.7-flash-free.

Ceny i ogłoszenia

  • step-3.7-flash, 90% zniżki (ograniczony czas): $0.022 / M tokenów wejściowych, $0.132 / M tokenów wyjściowych.
  • Wycofanie i automatyczne kierowanie: claude-opus-4-20250514 oraz claude-sonnet-4-20250514 zostały wycofane przez dostawcę modelu 15 czerwca; platforma automatycznie kieruje je do modeli z tej samej rodziny 4-5.

FAQ

Jakie modele zostały dodane w tym miesiącu?
Około 20, obejmujących czat (claude-fable-5 [Wycofany], minimax-m3, qwen3.7-plus, glm-5.2, seria doubao-seed-2-1), kod (seria kimi-k2.7-code, coding-glm-5.2), wideo (Kling, happyhorse-1.1) oraz obraz (musesteamer-air-image).

Jak używać LLM Router?
Ustaw nazwę modelu w swoim zapytaniu na auto; brama wybiera najlepszy model na podstawie twojego zapytania i rozlicza na podstawie modelu, który faktycznie zostanie użyty, bez zmian w kodzie klienta. Zobacz LLM Router.

Co jeśli główna domena jest niedostępna?
Zastąp adres zapytania zapasową domeną https://api.inferera.com. Endpoints i możliwości są identyczne, a żadne parametry nie muszą się zmieniać.

Jaka jest cena promocyjna dla step-3.7-flash?
$0.022 / M tokenów wejściowych i $0.132 / M tokenów wyjściowych.

Przeglądaj wszystkie modele w katalogu modeli i znajdź szczegóły integracji w dokumentacji.


Zaktualizowano: 2026-06-30

More from the blog