Червневий реліз 2026 року: ~20 нових моделей

AIHubMix3 хв читання
Червневий реліз 2026 року: ~20 нових моделей

Цього місяця AIHubMix додав близько 20 нових моделей у сферах чату, коду, відео та зображень, а також випустив кілька можливостей платформи. Тепер той самий API-ключ охоплює ще більше. Ось основні моменти.

LLM Router

Встановіть ім'я моделі на auto, і шлюз вибере найкращу модель з сотень на платформі, виходячи з вашого запиту, з використанням стратегій за вартістю, якістю або низькою затримкою, з оплатою за модель, до якої фактично звертаються. Ніякого ручного порівняння або перемикання моделей, і жодних змін у коді клієнта. Дивіться LLM Router.

Будь-яка модель на протоколі Responses

Точка доступу /v1/responses більше не обмежена сім'єю GPT: тепер вона може викликати будь-яку модель на платформі. Інструменти, побудовані на протоколі Responses (такі як Codex CLI), можуть використовувати GLM, Gemini, DeepSeek, Kimi, Qwen та інші через локальний каталог моделей, замість того, щоб бути обмеженими офіційними моделями OpenAI. Дивіться Codex CLI · Користувацькі моделі.

Картографування моделей та резервування

Налаштуйте відображення псевдонімів та резервування на випадок невдачі для кожного API-ключа в консолі: ваш клієнт може використовувати будь-яке ім'я моделі, яке шлюз переписує на реальну цільову модель; якщо основна модель не спрацює, вона автоматично переключається на резервну, з оплатою за модель, яка врешті-решт відповідає. Один збій не вплине на ваш виробничий трафік, а код клієнта залишиться незмінним. Дивіться Картографування моделей та резервування.

AIHubMix CLI

Єдиний бінарний файл з нульовими залежностями: не потрібні Python, Node або Go. Запитуйте свій баланс, керуйте API-ключами та переліком доступних моделей прямо з терміналу, з першокласною підтримкою скриптів та AI-агентів, таких як Claude Code. Дивіться AIHubMix CLI.

AIHubMix Skill (розширення для AI-кодуючих агентів)

Локальне розширення для AI-агентів, які підтримують навички (Codex, Claude Code, Cursor, Cline та інші). Використовуйте природну мову для інтеграції AIHubMix, запитів до моделей, вибору за можливостями, генерації прикладів та усунення помилок. Навичка читає актуальну інформацію про моделі, ціни та протоколи з офіційних API AIHubMix за запитом, тому агент ніколи не покладається на застарілий список моделей. Дивіться Навички.

Резервний домен: api.inferera.com

Коли основний домен aihubmix.com недоступний або перевищує час очікування, направте свої запити на https://api.inferera.com. Точки доступу та можливості ідентичні: ваш API-ключ, модель та тіло запиту не змінюються.

Також випущено

  • Аудіовхід Gemini: точка доступу, сумісна з OpenAI (/v1/chat/completions), тепер приймає input_audio та повертає audio_tokens у використанні.
  • Зусилля розуміння GLM 5.2: рідний канал Zhipu підтримує reasoning_effort для регульованої глибини мислення.
  • Інтеграція Open Design: AIHubMix тепер є вбудованим шлюзом BYOK для Open Design.
  • Виправлення плагіна OpenClaw: aihubmix-auth виправлено та стабільно використовувати.

Стабільність та виправлення

  • Покращена точність виставлення рахунків та точність вимірювання кешу.
  • Виправлено відсутні моделі в /v1/models.
  • Виправлено кілька проблем з генерацією відео та тестуванням каналів.

Нові моделі цього місяця (~20)

Чат / Загальні

  • claude-fable-5 [Відкликано]: останнє покоління Claude з більш потужними засобами безпеки (див. Changelog · Примітки до Fable 5).
  • minimax-m3, qwen3.7-plus, glm-5.2, та Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.

Код

  • kimi-k2.7-code та kimi-k2.7-code-highspeed: серія кодів Kimi, включаючи варіант високої швидкості.
  • coding-glm-5.2 та безкоштовний coding-glm-5.2-free.

Відео

  • Kling: текст у відео, зображення у відео, багатозображеневе посилання та омні мультимодальна генерація.
  • happyhorse-1.1: текст у відео (t2v), посилання (r2v) та зображення у відео (i2v).

Зображення

  • Baidu musesteamer-air-image для генерації зображень.

Також нове

  • grok-build-0.1, hy3-preview, та безкоштовний step-3.7-flash-free.

Ціни та повідомлення

  • step-3.7-flash, 90% знижка (обмежений час): $0.022 / M вхідних токенів, $0.132 / M вихідних токенів.
  • Скасування та автоматичне маршрутизування: claude-opus-4-20250514 та claude-sonnet-4-20250514 були відкликані постачальником моделі 15 червня; платформа автоматично маршрутизує їх до версій однієї сім'ї 4-5.

Часті запитання

Які моделі були додані цього місяця?
Близько 20, охоплюючи чат (claude-fable-5 [Відкликано], minimax-m3, qwen3.7-plus, glm-5.2, серія doubao-seed-2-1), код (серія kimi-k2.7-code, coding-glm-5.2), відео (Kling, happyhorse-1.1) та зображення (musesteamer-air-image).

Як я можу використовувати LLM Router?
Встановіть ім'я моделі у вашому запиті на auto; шлюз вибирає найкращу модель на основі вашого запиту та виставляє рахунок за модель, до якої фактично звертаються, без змін у коді клієнта. Дивіться LLM Router.

Що робити, якщо основний домен недоступний?
Замініть адресу запиту на резервний домен https://api.inferera.com. Точки доступу та можливості ідентичні, і жодні параметри не потрібно змінювати.

Яка ціна на обмежений час для step-3.7-flash?
$0.022 / M вхідних токенів та $0.132 / M вихідних токенів.

Перегляньте всі моделі в каталозі моделей та знайдіть деталі інтеграції в документації.