AIHubMix Blog

Ankündigungen, Tutorials, Modellanalysen und Änderungsprotokolle vom AIHubMix-Team.

GPT-5.6 Sol API Preisgestaltung: 50% Rabatt auf AIHubMix und OpenRouter

GPT-5.6 Sol API Preisgestaltung: 50% Rabatt auf AIHubMix und OpenRouter

GPT-5.6 Sol ist derzeit 50% günstiger auf AIHubMix und OpenRouter, aber OpenRouter erhebt eine Plattformgebühr von 5,5% für die Nutzung nach Bedarf. Vergleichen Sie die tatsächlichen Endkosten.

5 Min. LesezeitNeuigkeiten
GLM-5.3 Preisvergleich: OpenRouter, Z.ai und AIHubMix

GLM-5.3 Preisvergleich: OpenRouter, Z.ai und AIHubMix

GLM-5.3 ist schnell zu einem der interessantesten Modelle für Programmierung und langfristige Agentenarbeit geworden. Aber der Preis, den Sie zahlen, hängt stark davon ab, wo Sie darauf zugreifen. Die offizielle Z.ai API und OpenRouter listen das Modell derzeit mit $1,40 pro Million Eingabetokens und $4,40 pro Million Ausgabetokens. AIHubMix bietet eine separate Vorschau-Route für coding-glm-5.3 zu $0,06 pro Million Eingabetokens und $0,22 pro Million Ausgabetokens an. Das ist ein dramatischer Unterschied. Es ist auch kein einfacher Vergleich.

3 Min. LesezeitNeuigkeiten
GLM-5.3 Praktischer Leitfaden: Immer aktives Denken, drei Anstrengungsstufen und die API-Unterstützungsmatrix

GLM-5.3 Praktischer Leitfaden: Immer aktives Denken, drei Anstrengungsstufen und die API-Unterstützungsmatrix

Ein Leitfaden aus August 2026 zur Verwendung von GLM-5.3: immer aktives Denken mit drei Anstrengungsstufen, Denkzusammenfassungen, parallelen Toolaufrufen, strukturiertem Output und automatischem Caching — mit getesteten Beispielen für die AIHubMix Chat-, Responses- und Messages-APIs.

7 Min. LesezeitAnleitung
DeepSeek V4 Pro (0813): Denk-Passback & 3-API-Matrix

DeepSeek V4 Pro (0813): Denk-Passback & 3-API-Matrix

DeepSeek V4 Pro (0813) praktische Anleitung: Denkumschaltung und Denkaufwandsstufen, obligatorischer Denkverlauf-Passback, Werkzeuge, Caching und eine 3-API-Matrix.

15 Min. LesezeitAnleitung
DeepSeek V4 Flash wurde heute beeinträchtigt. Warum Multi-Provider-Failover wichtig ist

DeepSeek V4 Flash wurde heute beeinträchtigt. Warum Multi-Provider-Failover wichtig ist

Am 4. August 2026 verzeichnete die offizielle Statusseite von DeepSeek zwei Vorfälle mit beeinträchtigter API-Leistung. Der erste Vorfall dauerte 1 Stunde und 18 Minuten, von 02:02 bis 03:20 UTC, und betraf DeepSeek V4 Flash, V4 Pro und den Expertenmodus. Der zweite Vorfall dauerte 36 Minuten, von 03:43 bis 04:20 UTC, und betraf die DeepSeek V4 Flash API. Beide Vorfälle sind inzwischen behoben. OpenCode berichtete außerdem, dass DeepSeek Flash aufgrund einer beispiellosen Nachfrage mit Kapazitätsproblemen zu kämpfen hatte. Die offizielle Statusseite von DeepSeek bestätigte jedoch nur die beeinträchtigte Leistung und veröffentlichte keine Ursachenanalyse.

4 Min. LesezeitMeinung
Juni 2026 Release-Spotlight: ~20 neue Modelle

Juni 2026 Release-Spotlight: ~20 neue Modelle

Im Juni 2026 hat AIHubMix ~20 Modelle (glm-5.2, minimax-m3, qwen3.7-plus, kimi-k2.7-code, Kling Video) sowie LLM Router, Mapping & Fallback, CLI, Backup-Domain hinzugefügt.

3 Min. LesezeitÄnderungsprotokoll
Globale Beschleunigung: 75% geringere Latenz, 99,99% Verfügbarkeit

Globale Beschleunigung: 75% geringere Latenz, 99,99% Verfügbarkeit

AIHubMix betreibt ein selbstgebautes Beschleunigungsnetzwerk: 75% geringere Latenz, 60% weniger Schwankungen, 99,99% Verfügbarkeit, Minuten-Überwachungen, automatischer Failover.

2 Min. LesezeitAnkündigung
OpenAI-kompatibles Schnittstellen-Upgrade: Tiefgehende Unterstützung für Claude

OpenAI-kompatibles Schnittstellen-Upgrade: Tiefgehende Unterstützung für Claude

AIHubMix hat seine OpenAI-kompatible API für Claude aktualisiert: interleaved thinking ohne zusätzliche Parameter, Prompt-Caching und Unterstützung für Beta-Funktionen von Anthropic.

8 Min. LesezeitNeuigkeiten
GPT-5.6 ist live: Änderungen bei der Abrechnung des Prompt-Cachings erklärt

GPT-5.6 ist live: Änderungen bei der Abrechnung des Prompt-Cachings erklärt

Juli 2026: GPT-5.6 gpt-5.6-sol / terra / luna auf AIHubMix: 1,05M Kontext, 1,25x Cache-Schreibvorgänge, prompt_cache_key, explizite Breakpoints, im Vergleich zu Claude-Caching.

8 Min. LesezeitMeinung
Juli 2026 Release Spotlight: ~30 neue Modelle und Medien-APIs

Juli 2026 Release Spotlight: ~30 neue Modelle und Medien-APIs

AIHubMix hat im Juli 2026 ~30 Modelle hinzugefügt, darunter claude-opus-5, GPT-5.6, kimi-k3 und qwen3.8-max-preview, sowie Medien-Generierung, 3D-Generierung und MCP-Server.

6 Min. LesezeitÄnderungsprotokoll
Kostenlose KI-Modelle auf AIHubMix

Kostenlose KI-Modelle auf AIHubMix

Kostenlose KI-Modelle: Der ultimative Leitfaden zum Aufbau mit kostenfreier KI im Jahr 2026 auf AIHubMix

13 Min. LesezeitAnkündigung
Kimi K3 Hands-On Anleitung: Neue Parameter & API-Unterstützungsmatrix

Kimi K3 Hands-On Anleitung: Neue Parameter & API-Unterstützungsmatrix

Juli 2026 Kimi K3 Anleitung: reasoning_effort max, Denkgeschichte, dynamisches Laden von Werkzeugen, strukturierte Ausgabe, automatisches Caching, partieller Präfix und Visionseingaben.

8 Min. LesezeitAnleitung
Claude Opus 4.7 Neue Parameter Anleitung

Claude Opus 4.7 Neue Parameter Anleitung

Dieser Artikel behandelt zwei wichtige Änderungen zur Steuerung des Denkens in Claude Opus 4.7 sowie vollständige Nutzungshinweise für die native API von AIHubmix und die einheitliche Chat-Oberfläche. Siehe auch: Offizielle Ankündigung von Anthropic und Änderungsprotokoll des Modells.

3 Min. LesezeitAnleitung