Đấu trường · Đánh giá mô hình AI
DeepSeek-V4
bởi DeepSeek
MoE 1.6T open weights với ngữ cảnh 1M tokens và lập trình agentic gần đỉnh cao ở mức $0.87 mỗi 1M output tokens
$0.87/1M out
Bậc V4-Pro: $0.435/1M input ($0.003625 khi trúng cache), $0.87/1M output; bậc V4-Flash rẻ hơn ở mức $0.14/$0.28 ($0.0028 khi trúng cache); mức giảm 75% lúc ra mắt đã thành giá cố định từ 2026-05-22. Bản chính thức giữa tháng 7/2026 đưa vào giá cao điểm/thấp điểm, với mức niêm yết nhân đôi trong giờ cao điểm Bắc Kinh.
DeepSeek
1M tokens (384K max output)
$0.435/1M in (cache hit $0.003625)
$0.87/1M out
text only
Có
DeepSeek-V4 là gì?
Dòng MoE open weights chủ lực từ DeepSeek (V4-Pro 1.6T tham số/49B hoạt động, V4-Flash 284B/13B), phát hành dưới dạng preview ngày 24 tháng 4 năm 2026. Mang tới cửa sổ ngữ cảnh 1M tokens qua sparse attention, hai chế độ thinking và non-thinking, và weights giấy phép MIT trên Hugging Face. Được định vị là SOTA mã nguồn mở trên các benchmark lập trình agentic với một phần nhỏ giá API đỉnh cao.
Ưu và nhược điểm của DeepSeek-V4
Ưu điểm
- Cửa sổ ngữ cảnh 1M tokens (8x mức 128K của V3.2) với output tới 384K tokens, chuẩn trên API chính thức
- Giá cực gắt: $0.435/$0.87 mỗi 1M tokens (V4-Pro), rẻ hơn Claude Opus 4.8 khoảng 28.7x mỗi output token; input trúng cache giảm còn $0.003625/1M (giảm hơn 99%)
- Open weights giấy phép MIT cho cả V4-Pro và V4-Flash trên Hugging Face: cho phép dùng thương mại, fine-tuning và tái phân phối
- SOTA mã nguồn mở về lập trình agentic: 80.6 trên SWE-bench Verified (cấu hình Think Max), ngang Gemini 3.1 Pro, cộng rating Codeforces 3206 (~hạng 23 so với con người)
- Xếp #3 trên 93 trên Artificial Analysis Intelligence Index (điểm 44), cao hơn hẳn mức trung bình 25
- Bộ sparse attention cắt inference ngữ cảnh 1M xuống còn 27% FLOPs và 10% KV cache của V3.2
Nhược điểm
- Tool call sai định dạng ngắt quãng: function call đôi khi bị xuất thành văn bản thường trong content thay vì trường tool_calls (issue GitHub deepseek-ai #1244)
- Chế độ thinking làm gãy các chuỗi tool call đa lượt dài với lỗi 400 trong các framework agent (issue OpenClaw #72044, bản vá vẫn chưa hoàn chỉnh)
- Dev báo cáo nó bịa ra các API không tồn tại trong codebase tùy chỉnh và hành động dựa trên input người dùng do nó ảo giác ra trong vòng lặp agent
- Rất dài dòng (180M output tokens khi eval so với trung vị 95M) và tốc độ tầm trung 54.6 tok/s (#39/93), làm xói mòn lợi thế giá mỗi token trong thực tế
- Chỉ văn bản (không vision hay âm thanh) và vẫn là bản preview: bản chính thức dự kiến giữa tháng 7/2026 bổ sung giá giờ cao điểm nhân đôi mức API niêm yết trong giờ hành chính Bắc Kinh
Phán quyết của đấu trường
Chọn DeepSeek-V4 nếu bạn muốn suy luận và lập trình agentic gần đỉnh cao với giá thấp hơn Claude Opus hay GPT-5.5 từ 3x đến gần 30x, hoặc nếu weights giấy phép MIT để tự host và fine-tune là điều quan trọng với bạn. Đây là nâng cấp dứt khoát so với V3.2: ngữ cảnh dài hơn 8x, inference ngữ cảnh dài rẻ hơn hẳn và lập trình mạnh hơn, và đằng nào các endpoint cũ deepseek-chat/reasoner cũng bị ngừng vào ngày 24 tháng 7, 2026. Tránh nó cho các agent production phụ thuộc vào tool calling đa lượt tuyệt đối vững, nơi người dùng vẫn báo cáo tool call sai định dạng và API bị bịa ra, và cho mọi công việc vision hay âm thanh vì nó chỉ xử lý văn bản. Ứng dụng nhạy cảm độ trễ cũng nên test trước, vì độ dài dòng và tốc độ output tầm trung 54.6 tok/s bào bớt lợi thế chi phí, và hãy dự trù cho việc nhân đôi giá giờ cao điểm đến cùng bản phát hành chính thức giữa tháng 7.
Ngón cái lên hay ngón cái xuống
Đưa ra phán quyết của bạn
Bạn sẽ khuyên dùng DeepSeek-V4, hay cảnh báo đám đông tránh xa?
Những lựa chọn thay thế DeepSeek-V4 hàng đầu
Tất cả lựa chọn thay thếModel nhanh nhất của Anthropic: khoảng 90% năng lực lập trình của Sonnet 4.5 ở mức $1/$5 mỗi 1M tokens, ngữ cảnh 200K.
Chủ lực hạng Mythos tháng 6/2026 của Anthropic: 80.3% trên SWE-bench Pro, bỏ xa mọi model đỉnh cao khác 11 điểm
Opus tháng 4/2026 của Anthropic: 87.6% SWE-bench Verified, ngữ cảnh 1M, vision độ phân giải cao, nay xếp sau Opus 4.8
So sánh DeepSeek-V4 đối đầu trực tiếp
Đám đông nói gì
“Tool calling is flaky. Function calls sometimes land as plain text instead of the tool_calls field, and thinking mode 400s on long multi-turn chains. Not agent-ready yet.”
“MIT license on both Pro and Flash weights is the real story. Fine-tune, redistribute, ship commercially, no lawyer needed. Plus 384K output tokens for long-doc generation.”
“MIT weights, 1M context, and output tokens roughly 29x cheaper than Opus 4.8. Cache hits make input basically free. Moved my bulk pipelines over and the bill collapsed.”
DeepSeek-V4: câu hỏi thường gặp
DeepSeek-V4 giá bao nhiêu cho mỗi 1M tokens?
DeepSeek-V4 có giá $0.435/1M in (cache hit $0.003625) cho 1M input tokens và $0.87/1M out cho 1M output tokens. Bậc V4-Pro: $0.435/1M input ($0.003625 khi trúng cache), $0.87/1M output; bậc V4-Flash rẻ hơn ở mức $0.14/$0.28 ($0.0028 khi trúng cache); mức giảm 75% lúc ra mắt đã thành giá cố định từ 2026-05-22. Bản chính thức giữa tháng 7/2026 đưa vào giá cao điểm/thấp điểm, với mức niêm yết nhân đôi trong giờ cao điểm Bắc Kinh.