O DeepSeek V4.1 Flash agora está disponível no AIHubMix e no OpenRouter. Ele suporta entradas de texto e imagem, uma janela de contexto de 1M tokens, chamadas de ferramentas, saídas estruturadas e fluxos de trabalho orientados a agentes.
Atualmente, o AIHubMix oferece um desconto de 30% por tempo limitado em rotas de provedores selecionados, válido até 27 de setembro de 2026. O OpenRouter lista o preço em $0,13 por milhão de tokens de entrada e $0,52 por milhão de tokens de saída, com leituras de cache a $0,0026 por milhão de tokens.
Preços da API Flash do DeepSeek V4.1 em um relance
| Plataforma / rota | Preço de entrada | Preço de saída | Leitura de cache |
|---|---|---|---|
| OpenRouter | $0.13 / 1M | $0.52 / 1M | $0.0026 / 1M |
| AIHubMix — Bytedance fora do pico | $0.0986 / 1M | $0.3942 / 1M | $0.002 / 1M |
O preço fora do pico do Bytedance no AIHubMix reflete o desconto atual de 30%, reduzido de $0.1408 para entrada e $0.5632 para saída por 1M de tokens. O horário fora do pico do Bytedance é das 13:00 às 15:00 e das 19:00 às 10:00 GMT+9.
Quanto o desconto de 30% economiza?
Para uma carga de trabalho usando 10 milhões de tokens de entrada e 2 milhões de tokens de saída, a rota com desconto fora do pico do Bytedance custa aproximadamente $1.7756. A rota correspondente durante o pico custa aproximadamente $3.548. Antes do desconto, o mesmo uso fora do pico custaria $2.9764.
O DeepSeek V4.1 Flash suporta longos contextos?
Sim. O DeepSeek V4.1 Flash suporta uma janela de contexto de aproximadamente 1.048.576 tokens. Isso é útil para grandes bases de código, longos documentos técnicos, pesquisas em várias etapas, conversas persistentes de agentes, fluxos de trabalho de navegador e grandes coleções de logs ou dados empresariais.
O que torna o DeepSeek V4.1 Flash diferente?
O DeepSeek V4.1 Flash é um modelo esparso de mistura de especialistas construído sobre a arquitetura Causal Encoder-Decoder do DeepSeek. O OpenRouter descreve uma estrutura de 552B parâmetros, com aproximadamente 8B de parâmetros ativados para processamento de entrada e 16B ativados para geração de saída.
O modelo também inclui compreensão visual nativa. Representações de texto e imagem são treinadas em conjunto, permitindo que o modelo processe imagens junto com texto.
Entrada multimodal e chamadas de ferramentas
O DeepSeek V4.1 Flash aceita entradas de texto e imagem e retorna saídas de texto. Ele suporta chamadas de função através de ferramentas e tool_choice, bem como saídas estruturadas usando JSON Schema através de response_format.
Isso o torna adequado para agentes de codificação, agentes de terminal, sistemas de uso de navegador e computador, extração de dados estruturados, análise visual de documentos, pesquisa automatizada e automação de processos empresariais em várias etapas.
AIHubMix vs OpenRouter para DeepSeek V4.1 Flash
AIHubMix
O AIHubMix fornece uma API compatível com OpenAI, um ID de modelo unificado, várias rotas de provedores, preços baseados em tempo para pico e fora do pico, monitoramento de provedores, tentativas automáticas e fallback, streaming, chamadas de ferramentas, saídas estruturadas e entrada multimodal.
OpenRouter
O OpenRouter fornece o ID do modelo deepseek/deepseek-v4.1-flash, roteamento multi-provedor, seleção e exclusão de provedores, failover automático e dados de preços e desempenho em nível de provedor público.
Atualmente, o OpenRouter lista vários provedores para o modelo, incluindo Relace, Morph, DeepInfra, DeepSeek, Sail Research, Wafer, Fireworks e StreamLake.
Como usar o DeepSeek V4.1 Flash através do AIHubMix
O AIHubMix fornece um endpoint compatível com OpenAI:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com/v1",
)
response = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[
{"role": "user", "content": "Analise esta base de código e identifique os riscos de confiabilidade de maior prioridade."}
],
max_tokens=1024,
stream=False,
)
print(response.choices[0].message.content)
O ID do modelo do AIHubMix é deepseek-v4.1-flash. O ID do modelo do OpenRouter é deepseek/deepseek-v4.1-flash.
Para que o DeepSeek V4.1 Flash é mais adequado?
O DeepSeek V4.1 Flash é adequado para assistentes de codificação, análise de código em nível de repositório, agentes de terminal e uso de computador, compreensão de documentos e gráficos, suporte ao cliente ciente de imagens, extração estruturada, agentes de pesquisa, automação em várias etapas e fluxos de trabalho de longa duração com chamadas de ferramentas repetidas.
Perguntas frequentes
O DeepSeek V4.1 Flash é gratuito?
Não. É um modelo de API paga. A promoção do AIHubMix reduz o preço em rotas elegíveis, mas não torna o modelo gratuito.
Ele suporta imagens e chamadas de função?
Sim. Aceita entradas de texto e imagem, suporta ferramentas e tool_choice, e pode retornar saídas JSON estruturadas.
Quando termina o desconto do AIHubMix?
A página do modelo do AIHubMix afirma atualmente que a promoção de 30% termina em 27 de setembro de 2026. Verifique a página do modelo antes de se comprometer com uma carga de trabalho de longa duração.
A conclusão prática
O DeepSeek V4.1 Flash combina uma janela de contexto de 1M tokens, compreensão nativa de imagens, chamadas de ferramentas, saídas estruturadas e capacidades orientadas a agentes a um baixo custo por token.
Para usuários do AIHubMix, use deepseek-v4.1-flash e verifique o horário GMT+9 do provedor antes de estimar custos.



