DeepSeek V4.1 Flash ist jetzt auf AIHubMix und OpenRouter verfügbar. Es unterstützt Text- und Bild-Eingaben, ein Kontextfenster von 1 Million Tokens, Toolaufrufe, strukturierte Ausgaben und agentenorientierte Workflows.
AIHubMix bietet derzeit einen zeitlich begrenzten Rabatt von 30% auf ausgewählte Anbieter-Routen, gültig bis zum 27. September 2026. OpenRouter listet den Preis mit 0,13 $ pro Million Eingabetokens und 0,52 $ pro Million Ausgabetokens, mit Cache-Lesungen zu 0,0026 $ pro Million Tokens.
DeepSeek V4.1 Flash API Preise auf einen Blick
| Plattform / Route | Eingabepreis | Ausgabepreis | Cache-Lesung |
|---|---|---|---|
| OpenRouter | 0,13 $ / 1M | 0,52 $ / 1M | 0,0026 $ / 1M |
| AIHubMix — Bytedance außerhalb der Spitzenzeiten | 0,0986 $ / 1M | 0,3942 $ / 1M | 0,002 $ / 1M |
Der Bytedance-Preis außerhalb der Spitzenzeiten bei AIHubMix spiegelt den aktuellen Rabatt von 30% wider, reduziert von 0,1408 $ für Eingaben und 0,5632 $ für Ausgaben pro 1 Million Tokens. Der Zeitplan für Bytedance außerhalb der Spitzenzeiten ist von 13:00 bis 15:00 und von 19:00 bis 10:00 GMT+9.
Was spart der 30% Rabatt?
Für eine Arbeitslast mit 10 Millionen Eingabetokens und 2 Millionen Ausgabetokens kostet die Bytedance-Route außerhalb der Spitzenzeiten ungefähr 1,7756 $. Die entsprechende Spitzenroute kostet ungefähr 3,548 $. Vor dem Rabatt würde die gleiche Nutzung außerhalb der Spitzenzeiten 2,9764 $ kosten.
Unterstützt DeepSeek V4.1 Flash lange Kontexte?
Ja. DeepSeek V4.1 Flash unterstützt ein Kontextfenster von ungefähr 1.048.576 Tokens. Dies ist nützlich für große Codebasen, lange technische Dokumente, mehrstufige Recherchen, anhaltende Agentengespräche, Browser-Workflows und große Sammlungen von Protokollen oder Geschäftsdaten.
Was macht DeepSeek V4.1 Flash anders?
DeepSeek V4.1 Flash ist ein spärliches Mischmodell von Experten, das auf der Causal Encoder-Decoder-Architektur von DeepSeek basiert. OpenRouter beschreibt ein Backbone mit 552 Milliarden Parametern, wobei ungefähr 8 Milliarden Parameter für die Eingabeverarbeitung und 16 Milliarden für die Ausgabegenerierung aktiviert sind.
Das Modell umfasst auch ein natives visuelles Verständnis. Text- und Bilddarstellungen werden gemeinsam trainiert, sodass das Modell Bilder zusammen mit Text verarbeiten kann.
Multimodale Eingabe und Toolaufrufe
DeepSeek V4.1 Flash akzeptiert Text- und Bildeingaben und gibt Textausgaben zurück. Es unterstützt Funktionsaufrufe über Tools und tool_choice sowie strukturierte Ausgaben mithilfe von JSON Schema über response_format.
Dies macht es geeignet für Codierungsagenten, Terminalagenten, Browser- und Computeranwendungssysteme, strukturierte Datenextraktion, visuelle Dokumentenanalyse, automatisierte Forschung und mehrstufige Automatisierung von Geschäftsprozessen.
AIHubMix vs OpenRouter für DeepSeek V4.1 Flash
AIHubMix
AIHubMix bietet eine OpenAI-kompatible API, eine einheitliche Modell-ID, mehrere Anbieter-Routen, zeitbasierte Spitzen- und Nebenzeitenpreise, Anbieterüberwachung, automatisches Wiederholen und Fallback, Streaming, Toolaufrufe, strukturierte Ausgaben und multimodale Eingaben.
OpenRouter
OpenRouter bietet die Modell-ID deepseek/deepseek-v4.1-flash, Multi-Anbieter-Routing, Anbieterwahl und -ausschluss, automatisches Failover sowie öffentliche Anbieterpreise und Leistungsdaten.
OpenRouter listet derzeit mehrere Anbieter für das Modell, darunter Relace, Morph, DeepInfra, DeepSeek, Sail Research, Wafer, Fireworks und StreamLake.
So verwenden Sie DeepSeek V4.1 Flash über AIHubMix
AIHubMix bietet einen OpenAI-kompatiblen Endpunkt:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com/v1",
)
response = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[
{"role": "user", "content": "Analysiere diesen Code und identifiziere die wichtigsten Zuverlässigkeitsrisiken."}
],
max_tokens=1024,
stream=False,
)
print(response.choices[0].message.content)
Die Modell-ID von AIHubMix ist deepseek-v4.1-flash. Die Modell-ID von OpenRouter ist deepseek/deepseek-v4.1-flash.
Wofür ist DeepSeek V4.1 Flash am besten geeignet?
DeepSeek V4.1 Flash eignet sich für Codierungsassistenten, Repository-Level-Codeanalysen, Terminal- und Computeranwendungsagenten, Dokumenten- und Diagrammverständnis, bildbewussten Kundensupport, strukturierte Extraktion, Forschungsagenten, mehrstufige Automatisierung und langlaufende Workflows mit wiederholten Toolaufrufen.
Häufig gestellte Fragen
Ist DeepSeek V4.1 Flash kostenlos?
Nein. Es handelt sich um ein kostenpflichtiges API-Modell. Die AIHubMix-Aktion senkt den Preis für berechtigte Routen, macht das Modell jedoch nicht kostenlos.
Unterstützt es Bilder und Funktionsaufrufe?
Ja. Es akzeptiert Text- und Bildeingaben, unterstützt Tools und tool_choice und kann strukturierte JSON-Ausgaben zurückgeben.
Wann endet der AIHubMix-Rabatt?
Die Modellseite von AIHubMix gibt derzeit an, dass die 30%-Aktion am 27. September 2026 endet. Überprüfen Sie die Modellseite, bevor Sie sich für eine langlaufende Arbeitslast entscheiden.
Das praktische Fazit
DeepSeek V4.1 Flash kombiniert ein Kontextfenster von 1 Million Tokens, natives Bildverständnis, Toolaufrufe, strukturierte Ausgaben und agentenorientierte Fähigkeiten zu niedrigen Kosten pro Token.
Für AIHubMix-Nutzer verwenden Sie deepseek-v4.1-flash und überprüfen Sie den Zeitplan des Anbieters in GMT+9, bevor Sie die Kosten schätzen.



