В этом месяце AIHubMix добавил около 20 новых моделей в области чата, кода, видео и изображений, а также выпустил несколько возможностей платформы. Теперь тот же API-ключ охватывает еще больше. Вот основные моменты.
LLM Router
Установите имя модели на auto, и шлюз выберет лучшую модель из сотен на платформе в зависимости от вашего запроса, с учетом стратегий по стоимости, качеству или низкой задержке, с оплатой по модели, к которой он фактически обращается. Никакого ручного сравнения или переключения моделей, и никаких изменений в клиентском коде. Смотрите LLM Router.
Любая модель в протоколе Responses
Эндпоинт /v1/responses больше не ограничен семейством GPT: теперь он может вызывать любую модель на платформе. Инструменты, построенные на протоколе Responses (такие как Codex CLI), могут использовать GLM, Gemini, DeepSeek, Kimi, Qwen и другие через локальный каталог моделей, вместо того чтобы ограничиваться официальными моделями OpenAI. Смотрите Codex CLI · Пользовательские модели.
Сопоставление моделей и резервирование
Настройте сопоставление псевдонимов и резервирование на случай сбоя для каждого API-ключа в консоли: ваш клиент может использовать любое имя модели, которое шлюз переписывает на реальную целевую модель; если основная модель не работает, она автоматически переключается на резервную, с оплатой по модели, которая в конечном итоге отвечает. Один сбой не приведет к падению вашего производственного трафика, и клиентский код останется неизменным. Смотрите Сопоставление моделей и резервирование.
AIHubMix CLI
Единственный бинарный файл без зависимостей: не требуется Python, Node или Go. Запрашивайте свой баланс, управляйте API-ключами и перечисляйте доступные модели прямо из терминала, с первоклассной поддержкой скриптов и ИИ-агентов, таких как Claude Code. Смотрите AIHubMix CLI.
AIHubMix Skill (расширение для ИИ-агентов программирования)
Локальное расширение для ИИ-агентов, поддерживающих Skills (Codex, Claude Code, Cursor, Cline и другие). Используйте естественный язык для интеграции AIHubMix, запроса моделей, выбора по возможностям, генерации примеров и устранения ошибок. Skill получает актуальную информацию о моделях, ценах и протоколах из официальных API AIHubMix по запросу, так что агент никогда не полагается на устаревший список моделей. Смотрите Skills.
Резервный домен: api.inferera.com
Когда основной домен aihubmix.com недоступен или истекает время ожидания, направьте свои запросы на https://api.inferera.com. Эндпоинты и возможности идентичны: ваш API-ключ, модель и тело запроса не изменяются.
Также выпущено
- Аудиовход Gemini: совместимый с OpenAI эндпоинт (
/v1/chat/completions) теперь принимаетinput_audioи возвращает audio_tokens в использовании. - Усилие на размышления GLM 5.2: родной канал Zhipu поддерживает
reasoning_effortдля настройки глубины размышлений. - Интеграция Open Design: AIHubMix теперь встроенный шлюз BYOK для Open Design.
- Исправление плагина OpenClaw: aihubmix-auth исправлен и стабилен для использования.
Стабильность и исправления
- Улучшена точность выставления счетов и точность измерения кэша.
- Исправлены отсутствующие модели в
/v1/models. - Исправлены несколько проблем с генерацией видео и тестированием каналов.
Новые модели в этом месяце (~20)
Чат / Общие
- claude-fable-5 [Снято с эксплуатации]: Последнее поколение Claude с более надежными мерами безопасности (см. Changelog · Примечания к Fable 5).
- minimax-m3, qwen3.7-plus, glm-5.2 и Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.
Код
- kimi-k2.7-code и kimi-k2.7-code-highspeed: серия кода Kimi, включая вариант высокой скорости.
- coding-glm-5.2 и бесплатный coding-glm-5.2-free.
Видео
- Kling: текст-в-видео, изображение-в-видео, многокартинная ссылка и многомодальная генерация.
- happyhorse-1.1: текст-в-видео (t2v), ссылка (r2v) и изображение-в-видео (i2v).
Изображение
- Baidu musesteamer-air-image для генерации изображений.
Также новое
- grok-build-0.1, hy3-preview и бесплатный step-3.7-flash-free.
Цены и уведомления
- step-3.7-flash, 90% скидка (ограниченное время): $0.022 / M входных токенов, $0.132 / M выходных токенов.
- Устаревание и автоматическая маршрутизация:
claude-opus-4-20250514иclaude-sonnet-4-20250514были сняты с эксплуатации поставщиком модели 15 июня; платформа автоматически маршрутизирует их на версии 4-5 того же семейства.
Часто задаваемые вопросы
Какие модели были добавлены в этом месяце?
Около 20, охватывающих чат (claude-fable-5 [Снято с эксплуатации], minimax-m3, qwen3.7-plus, glm-5.2, серия doubao-seed-2-1), код (серия kimi-k2.7-code, coding-glm-5.2), видео (Kling, happyhorse-1.1) и изображение (musesteamer-air-image).
Как использовать LLM Router?
Установите имя модели в вашем запросе на auto; шлюз выбирает лучшую модель на основе вашего запроса и выставляет счет по модели, к которой он фактически обращается, без изменений в клиентском коде. Смотрите LLM Router.
Что делать, если основной домен недоступен?
Замените адрес запроса на резервный домен https://api.inferera.com. Эндпоинты и возможности идентичны, и параметры менять не нужно.
Какова цена на step-3.7-flash на ограниченное время?
$0.022 / M входных токенов и $0.132 / M выходных токенов.
Просмотрите все модели в каталоге моделей и найдите детали интеграции в документации.
Обновлено: 2026-06-30