Выпуск июня 2026 года: ~20 новых моделей

31 июл. 2026 г. · AIHubMix · 3 min read · Журнал изменений

Выпуск июня 2026 года: ~20 новых моделей

В этом месяце AIHubMix добавил около 20 новых моделей в области чата, кода, видео и изображений, а также выпустил несколько возможностей платформы. Теперь тот же API-ключ охватывает еще больше. Вот основные моменты.

LLM Router

Установите имя модели на auto, и шлюз выберет лучшую модель из сотен на платформе в зависимости от вашего запроса, с учетом стратегий по стоимости, качеству или низкой задержке, с оплатой по модели, к которой он фактически обращается. Никакого ручного сравнения или переключения моделей, и никаких изменений в клиентском коде. Смотрите LLM Router.

Любая модель в протоколе Responses

Эндпоинт /v1/responses больше не ограничен семейством GPT: теперь он может вызывать любую модель на платформе. Инструменты, построенные на протоколе Responses (такие как Codex CLI), могут использовать GLM, Gemini, DeepSeek, Kimi, Qwen и другие через локальный каталог моделей, вместо того чтобы ограничиваться официальными моделями OpenAI. Смотрите Codex CLI · Пользовательские модели.

Сопоставление моделей и резервирование

Настройте сопоставление псевдонимов и резервирование на случай сбоя для каждого API-ключа в консоли: ваш клиент может использовать любое имя модели, которое шлюз переписывает на реальную целевую модель; если основная модель не работает, она автоматически переключается на резервную, с оплатой по модели, которая в конечном итоге отвечает. Один сбой не приведет к падению вашего производственного трафика, и клиентский код останется неизменным. Смотрите Сопоставление моделей и резервирование.

AIHubMix CLI

Единственный бинарный файл без зависимостей: не требуется Python, Node или Go. Запрашивайте свой баланс, управляйте API-ключами и перечисляйте доступные модели прямо из терминала, с первоклассной поддержкой скриптов и ИИ-агентов, таких как Claude Code. Смотрите AIHubMix CLI.

AIHubMix Skill (расширение для ИИ-агентов программирования)

Локальное расширение для ИИ-агентов, поддерживающих Skills (Codex, Claude Code, Cursor, Cline и другие). Используйте естественный язык для интеграции AIHubMix, запроса моделей, выбора по возможностям, генерации примеров и устранения ошибок. Skill получает актуальную информацию о моделях, ценах и протоколах из официальных API AIHubMix по запросу, так что агент никогда не полагается на устаревший список моделей. Смотрите Skills.

Резервный домен: api.inferera.com

Когда основной домен aihubmix.com недоступен или истекает время ожидания, направьте свои запросы на https://api.inferera.com. Эндпоинты и возможности идентичны: ваш API-ключ, модель и тело запроса не изменяются.

Также выпущено

  • Аудиовход Gemini: совместимый с OpenAI эндпоинт (/v1/chat/completions) теперь принимает input_audio и возвращает audio_tokens в использовании.
  • Усилие на размышления GLM 5.2: родной канал Zhipu поддерживает reasoning_effort для настройки глубины размышлений.
  • Интеграция Open Design: AIHubMix теперь встроенный шлюз BYOK для Open Design.
  • Исправление плагина OpenClaw: aihubmix-auth исправлен и стабилен для использования.

Стабильность и исправления

  • Улучшена точность выставления счетов и точность измерения кэша.
  • Исправлены отсутствующие модели в /v1/models.
  • Исправлены несколько проблем с генерацией видео и тестированием каналов.

Новые модели в этом месяце (~20)

Чат / Общие

  • claude-fable-5 [Снято с эксплуатации]: Последнее поколение Claude с более надежными мерами безопасности (см. Changelog · Примечания к Fable 5).
  • minimax-m3, qwen3.7-plus, glm-5.2 и Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.

Код

  • kimi-k2.7-code и kimi-k2.7-code-highspeed: серия кода Kimi, включая вариант высокой скорости.
  • coding-glm-5.2 и бесплатный coding-glm-5.2-free.

Видео

  • Kling: текст-в-видео, изображение-в-видео, многокартинная ссылка и многомодальная генерация.
  • happyhorse-1.1: текст-в-видео (t2v), ссылка (r2v) и изображение-в-видео (i2v).

Изображение

  • Baidu musesteamer-air-image для генерации изображений.

Также новое

  • grok-build-0.1, hy3-preview и бесплатный step-3.7-flash-free.

Цены и уведомления

  • step-3.7-flash, 90% скидка (ограниченное время): $0.022 / M входных токенов, $0.132 / M выходных токенов.
  • Устаревание и автоматическая маршрутизация: claude-opus-4-20250514 и claude-sonnet-4-20250514 были сняты с эксплуатации поставщиком модели 15 июня; платформа автоматически маршрутизирует их на версии 4-5 того же семейства.

Часто задаваемые вопросы

Какие модели были добавлены в этом месяце?
Около 20, охватывающих чат (claude-fable-5 [Снято с эксплуатации], minimax-m3, qwen3.7-plus, glm-5.2, серия doubao-seed-2-1), код (серия kimi-k2.7-code, coding-glm-5.2), видео (Kling, happyhorse-1.1) и изображение (musesteamer-air-image).

Как использовать LLM Router?
Установите имя модели в вашем запросе на auto; шлюз выбирает лучшую модель на основе вашего запроса и выставляет счет по модели, к которой он фактически обращается, без изменений в клиентском коде. Смотрите LLM Router.

Что делать, если основной домен недоступен?
Замените адрес запроса на резервный домен https://api.inferera.com. Эндпоинты и возможности идентичны, и параметры менять не нужно.

Какова цена на step-3.7-flash на ограниченное время?
$0.022 / M входных токенов и $0.132 / M выходных токенов.

Просмотрите все модели в каталоге моделей и найдите детали интеграции в документации.


Обновлено: 2026-06-30

More from the blog