DeepSeek V4.1 Flash hiện đã có mặt trên AIHubMix và OpenRouter. Nó hỗ trợ đầu vào văn bản và hình ảnh, cửa sổ ngữ cảnh 1 triệu token, gọi công cụ, đầu ra có cấu trúc và quy trình làm việc theo hướng tác nhân.
AIHubMix hiện đang cung cấp giảm giá 30% trong thời gian có hạn cho các tuyến nhà cung cấp được chọn, có hiệu lực đến ngày 27 tháng 9 năm 2026. OpenRouter niêm yết giá là 0,13 USD cho mỗi triệu token đầu vào và 0,52 USD cho mỗi triệu token đầu ra, với việc đọc bộ nhớ cache là 0,0026 USD cho mỗi triệu token.
Giá API Flash DeepSeek V4.1 trong cái nhìn tổng quan
| Nền tảng / tuyến | Giá đầu vào | Giá đầu ra | Đọc bộ nhớ cache |
|---|---|---|---|
| OpenRouter | 0,13 USD / 1 triệu | 0,52 USD / 1 triệu | 0,0026 USD / 1 triệu |
| AIHubMix — Bytedance ngoài giờ cao điểm | 0,0986 USD / 1 triệu | 0,3942 USD / 1 triệu | 0,002 USD / 1 triệu |
Giá ngoài giờ cao điểm của AIHubMix cho Bytedance phản ánh giảm giá 30% hiện tại, giảm từ 0,1408 USD cho đầu vào và 0,5632 USD cho đầu ra mỗi triệu token. Lịch trình ngoài giờ cao điểm của Bytedance là từ 13:00–15:00 và 19:00–10:00 GMT+9.
Giảm giá 30% tiết kiệm được gì?
Đối với một khối lượng công việc sử dụng 10 triệu token đầu vào và 2 triệu token đầu ra, tuyến giảm giá ngoài giờ cao điểm của Bytedance có giá khoảng 1,7756 USD. Tuyến cao điểm tương ứng có giá khoảng 3,548 USD. Trước khi có giảm giá, việc sử dụng ngoài giờ cao điểm tương tự sẽ có giá 2,9764 USD.
DeepSeek V4.1 Flash có hỗ trợ ngữ cảnh dài không?
Có. DeepSeek V4.1 Flash hỗ trợ cửa sổ ngữ cảnh khoảng 1,048,576 token. Điều này hữu ích cho các mã nguồn lớn, tài liệu kỹ thuật dài, nghiên cứu nhiều bước, cuộc trò chuyện tác nhân liên tục, quy trình làm việc trên trình duyệt và các bộ sưu tập lớn về nhật ký hoặc dữ liệu kinh doanh.
Điều gì làm cho DeepSeek V4.1 Flash khác biệt?
DeepSeek V4.1 Flash là một mô hình hỗn hợp thưa của các chuyên gia được xây dựng trên kiến trúc Bộ mã hóa-Giải mã Causal của DeepSeek. OpenRouter mô tả một khung xương với 552B tham số, với khoảng 8B tham số được kích hoạt cho xử lý đầu vào và 16B được kích hoạt cho tạo đầu ra.
Mô hình cũng bao gồm khả năng hiểu hình ảnh bản địa. Các đại diện văn bản và hình ảnh được đào tạo đồng thời, cho phép mô hình xử lý hình ảnh cùng với văn bản.
Đầu vào đa phương thức và gọi công cụ
DeepSeek V4.1 Flash chấp nhận đầu vào văn bản và hình ảnh và trả về đầu ra văn bản. Nó hỗ trợ gọi hàm thông qua các công cụ và tool_choice, cũng như đầu ra có cấu trúc sử dụng JSON Schema thông qua response_format.
Điều này làm cho nó phù hợp cho các tác nhân lập trình, tác nhân terminal, hệ thống sử dụng trình duyệt và máy tính, trích xuất dữ liệu có cấu trúc, phân tích tài liệu hình ảnh, nghiên cứu tự động và tự động hóa quy trình kinh doanh nhiều bước.
AIHubMix so với OpenRouter cho DeepSeek V4.1 Flash
AIHubMix
AIHubMix cung cấp một API tương thích với OpenAI, một ID mô hình thống nhất, nhiều tuyến nhà cung cấp, giá cả theo thời gian cao điểm và ngoài giờ cao điểm, giám sát nhà cung cấp, tự động thử lại và dự phòng, phát trực tiếp, gọi công cụ, đầu ra có cấu trúc và đầu vào đa phương thức.
OpenRouter
OpenRouter cung cấp ID mô hình deepseek/deepseek-v4.1-flash, định tuyến đa nhà cung cấp, lựa chọn và loại trừ nhà cung cấp, tự động chuyển đổi, và dữ liệu giá cả và hiệu suất cấp nhà cung cấp công khai.
OpenRouter hiện đang liệt kê nhiều nhà cung cấp cho mô hình, bao gồm Relace, Morph, DeepInfra, DeepSeek, Sail Research, Wafer, Fireworks và StreamLake.
Cách sử dụng DeepSeek V4.1 Flash thông qua AIHubMix
AIHubMix cung cấp một điểm cuối tương thích với OpenAI:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com/v1",
)
response = client.chat.completions.create(
model="deepseek-v4.1-flash",
messages=[
{"role": "user", "content": "Phân tích mã nguồn này và xác định các rủi ro độ tin cậy ưu tiên cao nhất."}
],
max_tokens=1024,
stream=False,
)
print(response.choices[0].message.content)
ID mô hình AIHubMix là deepseek-v4.1-flash. ID mô hình OpenRouter là deepseek/deepseek-v4.1-flash.
DeepSeek V4.1 Flash thích hợp nhất cho việc gì?
DeepSeek V4.1 Flash phù hợp cho các trợ lý lập trình, phân tích mã cấp kho, tác nhân sử dụng terminal và máy tính, hiểu tài liệu và biểu đồ, hỗ trợ khách hàng nhận thức hình ảnh, trích xuất có cấu trúc, tác nhân nghiên cứu, tự động hóa nhiều bước và quy trình làm việc dài hạn với các cuộc gọi công cụ lặp lại.
Câu hỏi thường gặp
DeepSeek V4.1 Flash có miễn phí không?
Không. Đây là một mô hình API trả phí. Chương trình khuyến mãi của AIHubMix giảm giá cho các tuyến đủ điều kiện nhưng không làm cho mô hình miễn phí.
Nó có hỗ trợ hình ảnh và gọi hàm không?
Có. Nó chấp nhận đầu vào văn bản và hình ảnh, hỗ trợ các công cụ và tool_choice, và có thể trả về đầu ra JSON có cấu trúc.
Khi nào giảm giá AIHubMix kết thúc?
Trang mô hình AIHubMix hiện tại cho biết rằng chương trình khuyến mãi 30% kết thúc vào ngày 27 tháng 9 năm 2026. Xác minh trang mô hình trước khi cam kết cho một khối lượng công việc dài hạn.
Điểm rút ra thực tiễn
DeepSeek V4.1 Flash kết hợp cửa sổ ngữ cảnh 1 triệu token, khả năng hiểu hình ảnh bản địa, gọi công cụ, đầu ra có cấu trúc và khả năng theo hướng tác nhân với chi phí thấp cho mỗi token.
Đối với người dùng AIHubMix, hãy sử dụng deepseek-v4.1-flash và kiểm tra lịch trình GMT+9 của nhà cung cấp trước khi ước tính chi phí.



