Фокус върху версията от юни 2026: ~20 нови модела

31.07.2026 г. · AIHubMix · 3 min read · Промени

Фокус върху версията от юни 2026: ~20 нови модела

Този месец AIHubMix добави около 20 нови модела в области като чат, код, видео и изображения, и пусна няколко нови възможности на платформата. Същият API ключ вече достига дори повече. Ето основните акценти.

LLM Router

Задайте името на модела на auto, и шлюзът избира най-добрия модел от стотиците на платформата в зависимост от вашето запитване, с стратегии за първо разходи, първо качество или ниска латентност, таксувани от модела, който всъщност се използва. Няма нужда от ръчно сравнение или смяна на модели, и кодът на клиента остава непроменен. Вижте LLM Router.

Всеки модел на протокола за отговори

Точката за достъп /v1/responses вече не е ограничена до семейството на GPT: сега може да извиква всеки модел на платформата. Инструменти, изградени на протокола за отговори (като Codex CLI), могат следователно да използват GLM, Gemini, DeepSeek, Kimi, Qwen и други чрез локален каталог на модели, вместо да бъдат ограничени до официалните модели на OpenAI. Вижте Codex CLI · Персонализирани модели.

Картографиране на модели и резервиране

Конфигурирайте картографиране на псевдоними и резервиране на неуспехи за всеки API ключ в конзолата: вашият клиент може да използва всяко име на модел, което шлюзът пренаписва на реалния целеви модел; ако основният модел не успее, автоматично се превключва на резервен, таксуван от модела, който накрая отговаря. Едно единствено забавяне няма да прекъсне вашия производствен трафик, а кодът на клиента остава непокътнат. Вижте Картографиране на модели и резервиране.

AIHubMix CLI

Един бинарен файл без зависимости: не се изисква Python, Node или Go. Запитайте баланса си, управлявайте API ключове и изброявайте наличните модели директно от терминала, с първокласна поддръжка за скриптове и AI агенти като Claude Code. Вижте AIHubMix CLI.

AIHubMix Skill (разширение за AI кодиращи агенти)

Локално разширение за AI агенти, които поддържат умения (Codex, Claude Code, Cursor, Cline и др.). Използвайте естествен език, за да интегрирате AIHubMix, запитвайте модели, изберете по възможности, генерирайте примери и отстранявайте грешки. Умението чете информация за модели, цени и протоколи в реално време от официалните API на AIHubMix при поискване, така че агентът никога не разчита на остарял списък с модели. Вижте Умения.

Резервен домейн: api.inferera.com

Когато основният домейн aihubmix.com е недостъпен или времето за отговор е изтекло, насочете запитванията си към https://api.inferera.com. Точките за достъп и възможностите са идентични: вашият API ключ, модел и тяло на запитването не се променят.

Също така пуснато

  • Gemini аудио вход: точката за достъп, съвместима с OpenAI (/v1/chat/completions), вече приема input_audio и връща audio_tokens в употреба.
  • GLM 5.2 усилие за разсъждение: родният канал Zhipu поддържа reasoning_effort за регулируема дълбочина на мислене.
  • Интеграция с Open Design: AIHubMix вече е вграден BYOK шлюз за Open Design.
  • Поправка на плъгина OpenClaw: aihubmix-auth е поправен и стабилен за употреба.

Стабилност и поправки

  • Подобрена прецизност на таксуването и точност на измерване на кеша.
  • Поправени липсващи модели в /v1/models.
  • Поправени няколко проблема с генерирането на видео и тестването на канали.

Нови модели този месец (~20)

Чат / Общи

  • claude-fable-5 [Оттеглен]: Най-новото поколение на Claude, с по-силни защитни механизми (вж. Changelog · Забележки за Fable 5).
  • minimax-m3, qwen3.7-plus, glm-5.2, и Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.

Код

  • kimi-k2.7-code и kimi-k2.7-code-highspeed: Кодова серия на Kimi, включваща вариант с висока скорост.
  • coding-glm-5.2 и безплатния coding-glm-5.2-free.

Видео

  • Kling: текст към видео, изображение към видео, многократно изображение за справка и омни модалната генерация.
  • happyhorse-1.1: текст към видео (t2v), справка (r2v) и изображение към видео (i2v).

Изображение

  • Baidu musesteamer-air-image за генериране на изображения.

Също нови

  • grok-build-0.1, hy3-preview, и безплатния step-3.7-flash-free.

Цени и известия

  • step-3.7-flash, 90% отстъпка (ограничено време): $0.022 / M входящи токени, $0.132 / M изходящи токени.
  • Оттегляне и автоматично маршрутизиране: claude-opus-4-20250514 и claude-sonnet-4-20250514 бяха оттеглени от доставчика на модела на 15 юни; платформата автоматично ги маршрутизира към версии от същото семейство 4-5.

Често задавани въпроси

Кои модели бяха добавени този месец?
Около 20, обхващащи чат (claude-fable-5 [Оттеглен], minimax-m3, qwen3.7-plus, glm-5.2, серия doubao-seed-2-1), код (серия kimi-k2.7-code, coding-glm-5.2), видео (Kling, happyhorse-1.1) и изображение (musesteamer-air-image).

Как да използвам LLM Router?
Задайте името на модела в запитването си на auto; шлюзът избира най-добрия модел в зависимост от вашето запитване и таксува от модела, който всъщност се използва, без промени в кода на клиента. Вижте LLM Router.

Какво да правя, ако основният домейн е недостъпен?
Заменете адреса на запитването с резервния домейн https://api.inferera.com. Точките за достъп и възможностите са идентични и няма нужда от промяна на параметрите.

Каква е цената за step-3.7-flash за ограничено време?
$0.022 / M входящи токени и $0.132 / M изходящи токени.

Прегледайте всички модели в каталога на модели и намерете детайли за интеграция в документацията.


Актуализирано: 2026-06-30

More from the blog