Questo mese AIHubMix ha aggiunto circa 20 nuovi modelli in chat, codice, video e immagini, e ha rilasciato diverse funzionalità della piattaforma. La stessa chiave API ora raggiunge ancora di più. Ecco i punti salienti.
LLM Router
Imposta il nome del modello su auto, e il gateway seleziona il miglior modello tra i centinaia disponibili sulla piattaforma in base alla tua richiesta, con strategie cost-first, quality-first o low-latency, fatturato in base al modello che effettivamente utilizza. Nessun confronto manuale o cambio di modello, e nessuna modifica del codice client. Vedi LLM Router.
Qualsiasi modello sul protocollo Responses
L'endpoint /v1/responses non è più limitato alla famiglia GPT: ora può chiamare qualsiasi modello sulla piattaforma. Gli strumenti costruiti sul protocollo Responses (come Codex CLI) possono quindi utilizzare GLM, Gemini, DeepSeek, Kimi, Qwen e altro tramite un catalogo di modelli locale, invece di essere limitati ai modelli ufficiali di OpenAI. Vedi Codex CLI · Modelli personalizzati.
Mapping e Fallback dei Modelli
Configura il mapping degli alias e il fallback in caso di errore per chiave API nella console: il tuo client può utilizzare qualsiasi nome di modello, che il gateway riscrive nel vero modello target; se il primario fallisce, passa automaticamente a un backup, fatturato in base al modello che risponde infine. Un singolo intoppo non interromperà il tuo traffico di produzione, e il codice client rimane intatto. Vedi Mapping e Fallback dei Modelli.
AIHubMix CLI
Un singolo binario senza dipendenze: non è richiesto Python, Node o Go. Controlla il tuo saldo, gestisci le chiavi API e elenca i modelli disponibili direttamente dal terminale, con supporto di prima classe per script e agenti AI come Claude Code. Vedi AIHubMix CLI.
AIHubMix Skill (estensione per agenti di codifica AI)
Un'estensione locale per agenti AI che supportano le Skill (Codex, Claude Code, Cursor, Cline e altro). Usa il linguaggio naturale per integrare AIHubMix, interrogare modelli, selezionare per capacità, generare esempi e risolvere errori. La Skill legge informazioni sui modelli, prezzi e protocolli in tempo reale dalle API ufficiali di AIHubMix su richiesta, quindi l'agente non si basa mai su un elenco di modelli obsoleto. Vedi Skills.
Dominio di backup: api.inferera.com
Quando il dominio principale aihubmix.com non è raggiungibile o scade, indirizza le tue richieste a https://api.inferera.com. Gli endpoint e le funzionalità sono identici: la tua chiave API, modello e corpo della richiesta non cambiano.
Inoltre rilasciato
- Input audio Gemini: l'endpoint compatibile con OpenAI (
/v1/chat/completions) ora accettainput_audioe restituisce audio_tokens nell'uso. - GLM 5.2 sforzo di ragionamento: il canale nativo Zhipu supporta
reasoning_effortper una profondità di pensiero regolabile. - Integrazione Open Design: AIHubMix è ora un gateway BYOK integrato per Open Design.
- Correzione del plugin OpenClaw: aihubmix-auth è stato corretto e stabile da usare.
Stabilità e correzioni
- Precisione di fatturazione migliorata e accuratezza del misuratore di cache.
- Corretto il problema dei modelli mancanti in
/v1/models. - Corretto vari problemi di generazione video e test dei canali.
Nuovi modelli questo mese (~20)
Chat / Generale
- claude-fable-5 [Ritirato]: l'ultima generazione di Claude, con guardrail di sicurezza più forti (vedi Changelog · Note su Fable 5).
- minimax-m3, qwen3.7-plus, glm-5.2, e Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.
Codice
- kimi-k2.7-code e kimi-k2.7-code-highspeed: la serie di codice di Kimi, inclusa una variante ad alta velocità.
- coding-glm-5.2 e il gratuito coding-glm-5.2-free.
Video
- Kling: text-to-video, image-to-video, riferimento multi-immagine e generazione multimodale omni.
- happyhorse-1.1: text-to-video (t2v), riferimento (r2v) e image-to-video (i2v).
Immagine
- Baidu musesteamer-air-image per la generazione di immagini.
Inoltre nuovi
- grok-build-0.1, hy3-preview, e il gratuito step-3.7-flash-free.
Prezzi e avvisi
- step-3.7-flash, 90% di sconto (tempo limitato): $0.022 / M token di input, $0.132 / M token di output.
- Deprecazione e auto-routing:
claude-opus-4-20250514eclaude-sonnet-4-20250514sono stati ritirati dal fornitore del modello il 15 giugno; la piattaforma li reindirizza automaticamente alle versioni della stessa famiglia 4-5.
FAQ
Quali modelli sono stati aggiunti questo mese?
Circa 20, che spaziano da chat (claude-fable-5 [Ritirato], minimax-m3, qwen3.7-plus, glm-5.2, serie doubao-seed-2-1), codice (serie kimi-k2.7-code, coding-glm-5.2), video (Kling, happyhorse-1.1) e immagine (musesteamer-air-image).
Come posso utilizzare il LLM Router?
Imposta il nome del modello nella tua richiesta su auto; il gateway seleziona il miglior modello in base alla tua richiesta e fattura in base al modello che effettivamente utilizza, senza modifiche al codice client. Vedi LLM Router.
Cosa succede se il dominio principale non è raggiungibile?
Sostituisci l'indirizzo della richiesta con il dominio di backup https://api.inferera.com. Gli endpoint e le funzionalità sono identici, e non è necessario cambiare parametri.
Qual è il prezzo limitato per step-3.7-flash?
$0.022 / M token di input e $0.132 / M token di output.
Esplora tutti i modelli nel catalogo modelli, e trova i dettagli di integrazione nella documentazione.
Aggiornato: 2026-06-30