Riflettori sulla Release di Giugno 2026: ~20 Nuovi Modelli

31 lug 2026 · AIHubMix · 3 min read · Registro modifiche

Riflettori sulla Release di Giugno 2026: ~20 Nuovi Modelli

Questo mese AIHubMix ha aggiunto circa 20 nuovi modelli in chat, codice, video e immagini, e ha rilasciato diverse funzionalità della piattaforma. La stessa chiave API ora raggiunge ancora di più. Ecco i punti salienti.

LLM Router

Imposta il nome del modello su auto, e il gateway seleziona il miglior modello tra i centinaia disponibili sulla piattaforma in base alla tua richiesta, con strategie cost-first, quality-first o low-latency, fatturato in base al modello che effettivamente utilizza. Nessun confronto manuale o cambio di modello, e nessuna modifica del codice client. Vedi LLM Router.

Qualsiasi modello sul protocollo Responses

L'endpoint /v1/responses non è più limitato alla famiglia GPT: ora può chiamare qualsiasi modello sulla piattaforma. Gli strumenti costruiti sul protocollo Responses (come Codex CLI) possono quindi utilizzare GLM, Gemini, DeepSeek, Kimi, Qwen e altro tramite un catalogo di modelli locale, invece di essere limitati ai modelli ufficiali di OpenAI. Vedi Codex CLI · Modelli personalizzati.

Mapping e Fallback dei Modelli

Configura il mapping degli alias e il fallback in caso di errore per chiave API nella console: il tuo client può utilizzare qualsiasi nome di modello, che il gateway riscrive nel vero modello target; se il primario fallisce, passa automaticamente a un backup, fatturato in base al modello che risponde infine. Un singolo intoppo non interromperà il tuo traffico di produzione, e il codice client rimane intatto. Vedi Mapping e Fallback dei Modelli.

AIHubMix CLI

Un singolo binario senza dipendenze: non è richiesto Python, Node o Go. Controlla il tuo saldo, gestisci le chiavi API e elenca i modelli disponibili direttamente dal terminale, con supporto di prima classe per script e agenti AI come Claude Code. Vedi AIHubMix CLI.

AIHubMix Skill (estensione per agenti di codifica AI)

Un'estensione locale per agenti AI che supportano le Skill (Codex, Claude Code, Cursor, Cline e altro). Usa il linguaggio naturale per integrare AIHubMix, interrogare modelli, selezionare per capacità, generare esempi e risolvere errori. La Skill legge informazioni sui modelli, prezzi e protocolli in tempo reale dalle API ufficiali di AIHubMix su richiesta, quindi l'agente non si basa mai su un elenco di modelli obsoleto. Vedi Skills.

Dominio di backup: api.inferera.com

Quando il dominio principale aihubmix.com non è raggiungibile o scade, indirizza le tue richieste a https://api.inferera.com. Gli endpoint e le funzionalità sono identici: la tua chiave API, modello e corpo della richiesta non cambiano.

Inoltre rilasciato

  • Input audio Gemini: l'endpoint compatibile con OpenAI (/v1/chat/completions) ora accetta input_audio e restituisce audio_tokens nell'uso.
  • GLM 5.2 sforzo di ragionamento: il canale nativo Zhipu supporta reasoning_effort per una profondità di pensiero regolabile.
  • Integrazione Open Design: AIHubMix è ora un gateway BYOK integrato per Open Design.
  • Correzione del plugin OpenClaw: aihubmix-auth è stato corretto e stabile da usare.

Stabilità e correzioni

  • Precisione di fatturazione migliorata e accuratezza del misuratore di cache.
  • Corretto il problema dei modelli mancanti in /v1/models.
  • Corretto vari problemi di generazione video e test dei canali.

Nuovi modelli questo mese (~20)

Chat / Generale

  • claude-fable-5 [Ritirato]: l'ultima generazione di Claude, con guardrail di sicurezza più forti (vedi Changelog · Note su Fable 5).
  • minimax-m3, qwen3.7-plus, glm-5.2, e Doubao doubao-seed-2-1-pro / doubao-seed-2-1-turbo.

Codice

  • kimi-k2.7-code e kimi-k2.7-code-highspeed: la serie di codice di Kimi, inclusa una variante ad alta velocità.
  • coding-glm-5.2 e il gratuito coding-glm-5.2-free.

Video

  • Kling: text-to-video, image-to-video, riferimento multi-immagine e generazione multimodale omni.
  • happyhorse-1.1: text-to-video (t2v), riferimento (r2v) e image-to-video (i2v).

Immagine

  • Baidu musesteamer-air-image per la generazione di immagini.

Inoltre nuovi

  • grok-build-0.1, hy3-preview, e il gratuito step-3.7-flash-free.

Prezzi e avvisi

  • step-3.7-flash, 90% di sconto (tempo limitato): $0.022 / M token di input, $0.132 / M token di output.
  • Deprecazione e auto-routing: claude-opus-4-20250514 e claude-sonnet-4-20250514 sono stati ritirati dal fornitore del modello il 15 giugno; la piattaforma li reindirizza automaticamente alle versioni della stessa famiglia 4-5.

FAQ

Quali modelli sono stati aggiunti questo mese?
Circa 20, che spaziano da chat (claude-fable-5 [Ritirato], minimax-m3, qwen3.7-plus, glm-5.2, serie doubao-seed-2-1), codice (serie kimi-k2.7-code, coding-glm-5.2), video (Kling, happyhorse-1.1) e immagine (musesteamer-air-image).

Come posso utilizzare il LLM Router?
Imposta il nome del modello nella tua richiesta su auto; il gateway seleziona il miglior modello in base alla tua richiesta e fattura in base al modello che effettivamente utilizza, senza modifiche al codice client. Vedi LLM Router.

Cosa succede se il dominio principale non è raggiungibile?
Sostituisci l'indirizzo della richiesta con il dominio di backup https://api.inferera.com. Gli endpoint e le funzionalità sono identici, e non è necessario cambiare parametri.

Qual è il prezzo limitato per step-3.7-flash?
$0.022 / M token di input e $0.132 / M token di output.

Esplora tutti i modelli nel catalogo modelli, e trova i dettagli di integrazione nella documentazione.


Aggiornato: 2026-06-30

More from the blog