Цього місяця AIHubMix додав близько 20 нових моделей у сферах чату, коду, відео та зображень, а також випустив кілька можливостей платформи. Тепер той же API-ключ охоплює ще більше. Ось основні моменти.
LLM Router
Встановіть ім'я моделі на auto, і шлюз вибере найкращу модель з сотень на платформі на основі вашого запиту, з урахуванням стратегій за вартістю, якістю або низькою затримкою, з оплатою за модель, до якої насправді звертаються. Ніякого ручного порівняння або перемикання моделей, і жодних змін у коді клієнта. Дивіться LLM Router.
Будь-яка модель на протоколі Responses
Точка доступу /v1/responses більше не обмежена сім'єю GPT: тепер вона може викликати будь-яку модель на платформі. Інструменти, побудовані на протоколі Responses (такі як Codex CLI), можуть використовувати GLM, Gemini, DeepSeek, Kimi, Qwen та інші через локальний каталог моделей, замість того щоб бути обмеженими офіційними моделями OpenAI. Дивіться Codex CLI · Користувацькі моделі.
Мапування моделей та резервування
Налаштуйте мапування псевдонімів та резервування на випадок збою для кожного API-ключа в консолі: ваш клієнт може використовувати будь-яке ім'я моделі, яке шлюз переписує на реальну цільову модель; якщо основна модель не працює, вона автоматично переключається на резервну, з оплатою за модель, яка врешті-решт відповідає. Один збій не вплине на ваш виробничий трафік, а код клієнта залишиться незмінним. Дивіться Мапування моделей та резервування.
AIHubMix CLI
Єдиний бінарний файл без залежностей: не потрібні Python, Node або Go. Запитуйте свій баланс, керуйте API-ключами та перераховуйте доступні моделі прямо з терміналу, з першокласною підтримкою скриптів та AI-агентів, таких як Claude Code. Дивіться AIHubMix CLI.
AIHubMix Skill (розширення для AI-кодуючих агентів)
Локальне розширення для AI-агентів, які підтримують навички (Codex, Claude Code, Cursor, Cline та інші). Використовуйте природну мову для інтеграції AIHubMix, запитування моделей, вибору за можливостями, генерації прикладів та усунення помилок. Навичка читає актуальну інформацію про моделі, ціни та протоколи з офіційних API AIHubMix на вимогу, тому агент ніколи не покладається на застарілий список моделей. Дивіться Навички.
Резервний домен: api.inferera.com
Коли основний домен aihubmix.com недоступний або перевищує час очікування, направте свої запити на https://api.inferera.com. Точки доступу та можливості ідентичні: ваш API-ключ, модель та тіло запиту не змінюються.
Також випущено
- Аудіовхід Gemini: точка доступу, сумісна з OpenAI (
/v1/chat/completions), тепер приймаєinput_audioта повертає audio_tokens у використанні. - Зусилля розуміння GLM 5.2: рідний канал Zhipu підтримує
reasoning_effortдля регульованої глибини мислення. - Інтеграція Open Design: AIHubMix тепер є вбудованим шлюзом BYOK для Open Design.
- Виправлення плагіна OpenClaw: aihubmix-auth виправлено та стабільно використовувати.
Стабільність та виправлення
- Покращена точність виставлення рахунків та точність вимірювання кешу.
- Виправлено відсутні моделі в
/v1/models. - Виправлено кілька проблем з генерацією відео та тестуванням каналів.
Нові моделі цього місяця (~20)
Чат / Загальні
- claude-fable-5 [Відкликано]: останнє покоління Claude з більш потужними засобами безпеки (див. Changelog · Примітки до Fable 5).
- minimax-m3, qwen3.7-plus, glm-5.2 та Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.
Код
- kimi-k2.7-code та kimi-k2.7-code-highspeed: серія кодів Kimi, включаючи варіант з високою швидкістю.
- coding-glm-5.2 та безкоштовний coding-glm-5.2-free.
Відео
- Kling: текст у відео, зображення у відео, багатозображеневе посилання та омні мультимодальна генерація.
- happyhorse-1.1: текст у відео (t2v), посилання (r2v) та зображення у відео (i2v).
Зображення
- Baidu musesteamer-air-image для генерації зображень.
Також нове
- grok-build-0.1, hy3-preview та безкоштовний step-3.7-flash-free.
Ціни та повідомлення
- step-3.7-flash, 90% знижка (обмежений час): $0.022 / M вхідних токенів, $0.132 / M вихідних токенів.
- Скасування та автоматичне маршрутизація:
claude-opus-4-20250514таclaude-sonnet-4-20250514були відкликані постачальником моделі 15 червня; платформа автоматично маршрутизує їх до моделей тієї ж сім'ї 4-5 версій.
Часті запитання
Які моделі були додані цього місяця?
Близько 20, охоплюючи чат (claude-fable-5 [Відкликано], minimax-m3, qwen3.7-plus, glm-5.2, серія doubao-seed-2-1), код (серія kimi-k2.7-code, coding-glm-5.2), відео (Kling, happyhorse-1.1) та зображення (musesteamer-air-image).
Як я можу використовувати LLM Router?
Встановіть ім'я моделі у вашому запиті на auto; шлюз вибирає найкращу модель на основі вашого запиту та виставляє рахунок за модель, до якої насправді звертаються, без змін у коді клієнта. Дивіться LLM Router.
Що робити, якщо основний домен недоступний?
Замініть адресу запиту на резервний домен https://api.inferera.com. Точки доступу та можливості ідентичні, і жодні параметри не потрібно змінювати.
Яка ціна на step-3.7-flash на обмежений час?
$0.022 / M вхідних токенів та $0.132 / M вихідних токенів.
Перегляньте всі моделі в каталозі моделей та знайдіть деталі інтеграції в документації.
Оновлено: 2026-06-30