Đối đầu trực tiếp

Logo Claude Opus 5vsLogo DeepSeek-V4

Claude Opus 5 vs DeepSeek-V4: mô hình AI nào thắng trong năm 2026?

Claude Opus 5 ($25/1M out) và DeepSeek-V4 ($0.87/1M out) là hai trong số mô hình AI được dùng nhiều nhất năm 2026. Trên 7 phiếu của cộng đồng, Claude Opus 5 dẫn đầu với 63% ủng hộ.

Phán quyết nhanh

Về Suy luận, hãy chọn Claude Opus 5: đấu trường chấm 5/5 so với 4.5/5 của DeepSeek-V4. Về ngân sách, DeepSeek-V4 thắng: giá từ $0.87/1M out so với $25/1M out của Claude Opus 5.

So sánh từng dòng

Từ
$25/1M outGiá niêm yết chính thức trên API của Anthropic cho claude-opus-5: $5/1M input, $25/1M output, không đổi so với Opus 4.8, một mức giá duy nhất với ngữ cảnh 1M là mức mặc định và tối đa, đầu ra tối đa 128K, prompt caching áp dụng từ 512 token. Chế độ Fast ở giai đoạn research-preview với giá $10/$50 (nhanh hơn khoảng 2.5x) chỉ có trên Claude API. Đã xác minh theo platform.claude.com (What's new in Opus 5), tháng 7/2026.
$0.87/1M outBậc V4-Pro: $0.435/1M input ($0.003625 khi trúng cache), $0.87/1M output; bậc V4-Flash rẻ hơn ở mức $0.14/$0.28 ($0.0028 khi trúng cache); mức giảm 75% lúc ra mắt đã thành giá cố định từ 2026-05-22. Bản chính thức giữa tháng 7/2026 đưa vào giá cao điểm/thấp điểm, với mức niêm yết nhân đôi trong giờ cao điểm Bắc Kinh.
Nhà cung cấp
Anthropic
DeepSeek
Cửa sổ ngữ cảnh
1M tokens
1M tokens (384K max output)
Giá input
$5/1M in
$0.435/1M in (cache hit $0.003625)
Giá output
$25/1M out
$0.87/1M out
Phương thức
text, vision
text only
Open weights
Không
Điểm đám đông
63%(4)
57%(3)
Điểm đấu trường (1-5)
Suy luận
5.0
4.5
Lập trình
5.0
4.5
Viết lách
4.0
3.5
Tốc độ
2.0
3.0
Đáng tiền
4.0
5.0

Điểm mạnh và điểm yếu

Claude Opus 5

  • Xếp hạng #1 về trí tuệ tổng hợp trong số 190 mô hình trên Artificial Analysis khi ra mắt, đạt 43.3% trên Frontier-Bench v0.1, so với 34.4% của GPT-5.6 Sol và 33.7% của Claude Fable 5
  • Vượt trội gấp 3.9x so với GPT-5.6 Sol về khả năng suy luận mới trên ARC-AGI-3 (30.2% so với 7.8%), và đạt Elo 1861 trên GDPval-AA v2 về công việc tri thức kinh tế, vượt qua Fable 5 (1747)
  • Đạt 79.2% trên SWE-bench Pro, chỉ kém Fable 5 (80.0%) đúng một điểm và vượt Opus 4.8 (69.2%) tới 10 điểm, trong khi giá chỉ bằng một nửa Fable; đồng sáng lập Cursor nhận xét đây là 'trí tuệ gần bằng Fable 5 với tốc độ và chi phí như Opus'
  • Giữ nguyên mức giá $5/$25 như Opus 4.8 nhưng có cửa sổ lớn hơn: ngữ cảnh 1M nay trở thành mức mặc định và duy nhất, đầu ra tối đa 128K, prompt caching áp dụng từ 512 token
  • Bộ phân loại an toàn dual-use kích hoạt ít hơn 85% so với trên Fable 5, và chế độ dự phòng mặc định mới giúp tránh các lượt từ chối âm thầm giữa phiên làm việc từng gây khó chịu khi Fable ra mắt
  • Tự kiểm tra lại kết quả công việc mà không cần yêu cầu, xử lý thay đổi công cụ giữa cuộc hội thoại (bản beta) mà không làm hỏng prompt cache, và có mặt ngay từ ngày đầu trên Claude.ai, API, Bedrock, Vertex và Microsoft Foundry
  • Khá chậm và rất dài dòng: 52.6 output token/giây và mất 68 giây để có token đầu tiên trên Artificial Analysis, đồng thời tiêu tốn khoảng 100M output token trong quá trình đánh giá của họ, so với mức trung vị 63M
  • Tính dài dòng gây ra vấn đề chi phí thực tế: CodeRabbit đo được mô hình này đọc nhiều hơn khoảng 50% và viết nhiều hơn khoảng 65% so với các mô hình frontier tham chiếu cho mỗi lượt review code
  • Không thực sự giảm giá dù được quảng bá là 'tiết kiệm chi phí': giá giống hệt Opus 4.8 ($5/$25), gần bằng giá GPT-5.6 ($5/$30), và cao hơn hơn 2 lần các mức giá tương đương của Gemini hay Grok
  • Người đánh giá mô tả tính cách của mô hình là 'xuất sắc nhưng phiền toái': kiểm chứng quá mức, dè dặt thái quá, và đôi khi từ chối cả những tác vụ tầm thường như giải quyết xung đột merge (theo đánh giá thực tế trên Lenny's Newsletter)
  • Thay đổi API mang tính đột phá đối với người dùng chuyển từ Opus 4.8: chế độ thinking bật mặc định và không thể tắt ở mức nỗ lực xhigh hoặc max (trả về lỗi 400); chế độ Fast ($10/$50, nhanh hơn khoảng 2.5x) chỉ có trên API, không có trên Bedrock hay Vertex

DeepSeek-V4

  • Cửa sổ ngữ cảnh 1M tokens (8x mức 128K của V3.2) với output tới 384K tokens, chuẩn trên API chính thức
  • Giá cực gắt: $0.435/$0.87 mỗi 1M tokens (V4-Pro), rẻ hơn Claude Opus 4.8 khoảng 28.7x mỗi output token; input trúng cache giảm còn $0.003625/1M (giảm hơn 99%)
  • Open weights giấy phép MIT cho cả V4-Pro và V4-Flash trên Hugging Face: cho phép dùng thương mại, fine-tuning và tái phân phối
  • SOTA mã nguồn mở về lập trình agentic: 80.6 trên SWE-bench Verified (cấu hình Think Max), ngang Gemini 3.1 Pro, cộng rating Codeforces 3206 (~hạng 23 so với con người)
  • Xếp #3 trên 93 trên Artificial Analysis Intelligence Index (điểm 44), cao hơn hẳn mức trung bình 25
  • Bộ sparse attention cắt inference ngữ cảnh 1M xuống còn 27% FLOPs và 10% KV cache của V3.2
  • Tool call sai định dạng ngắt quãng: function call đôi khi bị xuất thành văn bản thường trong content thay vì trường tool_calls (issue GitHub deepseek-ai #1244)
  • Chế độ thinking làm gãy các chuỗi tool call đa lượt dài với lỗi 400 trong các framework agent (issue OpenClaw #72044, bản vá vẫn chưa hoàn chỉnh)
  • Dev báo cáo nó bịa ra các API không tồn tại trong codebase tùy chỉnh và hành động dựa trên input người dùng do nó ảo giác ra trong vòng lặp agent
  • Rất dài dòng (180M output tokens khi eval so với trung vị 95M) và tốc độ tầm trung 54.6 tok/s (#39/93), làm xói mòn lợi thế giá mỗi token trong thực tế
  • Chỉ văn bản (không vision hay âm thanh) và vẫn là bản preview: bản chính thức dự kiến giữa tháng 7/2026 bổ sung giá giờ cao điểm nhân đôi mức API niêm yết trong giờ hành chính Bắc Kinh

Đưa ra phán quyết của bạn

Mỗi đấu sĩ một đề xuất cho mỗi công cụ. Nó định hình lại điểm đám đông mà mọi người nhìn thấy.

Claude Opus 5$25/1M out
63%điểm đám đông · 4
DeepSeek-V4$0.87/1M out
57%điểm đám đông · 3

Phán quyết của đấu trường về Claude Opus 5

Claude Opus 5 là lựa chọn mặc định hợp lý nhất trong dòng Series 5: sở hữu phần lớn năng lực trí tuệ của Fable 5 (thậm chí vượt Fable trên Frontier-Bench và GDPval) với giá token chỉ bằng đúng một nửa, cùng bộ phân loại kích hoạt ít hơn 85%. Nếu khối lượng công việc đã chuyển sang Fable 5 vì năng lực nhưng gặp vấn đề về chi phí hoặc bị từ chối do báo sai, đây là lúc nên chuyển về Opus 5; nếu vẫn đang dùng Opus 4.8, việc nâng cấp mang lại thêm 10 điểm SWE-bench Pro mà không tốn thêm chi phí. Hai lý do chính đáng để cân nhắc lựa chọn khác là độ trễ và tính dài dòng. Với tốc độ 52.6 token/giây và 68 giây để có token đầu tiên, mô hình này không phù hợp cho trải nghiệm UX tương tác, và mức tiêu thụ token âm thầm đẩy chi phí thực tế lên cao hơn giá niêm yết, nên các pipeline khối lượng lớn nhạy cảm về ngân sách vẫn nên dùng Sonnet 5, Gemini hoặc DeepSeek. Chỉ nên giữ Fable 5 cho những tác vụ tự vận hành kéo dài nhất, nơi lợi thế nhỏ về SWE-bench Pro của nó phát huy tác dụng tích lũy.

Phán quyết của đấu trường về DeepSeek-V4

Chọn DeepSeek-V4 nếu bạn muốn suy luận và lập trình agentic gần đỉnh cao với giá thấp hơn Claude Opus hay GPT-5.5 từ 3x đến gần 30x, hoặc nếu weights giấy phép MIT để tự host và fine-tune là điều quan trọng với bạn. Đây là nâng cấp dứt khoát so với V3.2: ngữ cảnh dài hơn 8x, inference ngữ cảnh dài rẻ hơn hẳn và lập trình mạnh hơn, và đằng nào các endpoint cũ deepseek-chat/reasoner cũng bị ngừng vào ngày 24 tháng 7, 2026. Tránh nó cho các agent production phụ thuộc vào tool calling đa lượt tuyệt đối vững, nơi người dùng vẫn báo cáo tool call sai định dạng và API bị bịa ra, và cho mọi công việc vision hay âm thanh vì nó chỉ xử lý văn bản. Ứng dụng nhạy cảm độ trễ cũng nên test trước, vì độ dài dòng và tốc độ output tầm trung 54.6 tok/s bào bớt lợi thế chi phí, và hãy dự trù cho việc nhân đôi giá giờ cao điểm đến cùng bản phát hành chính thức giữa tháng 7.

Đám đông nói gì

Về Claude Opus 5

Ngón Cái Chúc Xuống

The sticker price is unchanged but my invoice is not: it writes essays where Opus 4.8 wrote answers. 68 seconds to first token killed it for our support chat, we went back to Sonnet 5.

Người Đánh Giá Công Tâm

Fed it a 40-tab financial model with cross-sheet formulas and asked for a scenario deck. It got the edge cases the analysts missed. For document-heavy enterprise work this is the best model I have used.

Hiệp Sĩ Ship Liên Tục

We moved off Fable 5 because the bio classifier kept flagging our genomics tooling. Opus 5 does the same work at half the price and I have not seen a single silent reroute since.

Vệ Thần Của Repo

Migrated our agents from Opus 4.8 the day it dropped. Same bill, and tasks that used to stall at the planning stage now just finish. The 10-point SWE-bench jump is not marketing, our merge queue feels it.

Về DeepSeek-V4

Ngón Cái Chúc Xuống

Tool calling is flaky. Function calls sometimes land as plain text instead of the tool_calls field, and thinking mode 400s on long multi-turn chains. Not agent-ready yet.

Người Đánh Giá Công Tâm

MIT license on both Pro and Flash weights is the real story. Fine-tune, redistribute, ship commercially, no lawyer needed. Plus 384K output tokens for long-doc generation.

Hiệp Sĩ Ship Liên Tục

MIT weights, 1M context, and output tokens roughly 29x cheaper than Opus 4.8. Cache hits make input basically free. Moved my bulk pipelines over and the bill collapsed.

Câu hỏi thường gặp

Claude Opus 5 có tốt hơn DeepSeek-V4 không?

Đám đông hiện đứng về phía Claude Opus 5: 63% khuyên dùng, so với 57% của DeepSeek-V4 (7 phiếu). Về Suy luận, Claude Opus 5 được chấm cao hơn (5/5 vs 4.5/5). Lựa chọn đúng tùy vào nhu cầu của bạn. Bảng so sánh từng dòng trên trang này mổ xẻ giá, thông số chính và điểm đấu trường.

Claude Opus 5 hay DeepSeek-V4 rẻ hơn?

DeepSeek-V4 rẻ hơn: giá từ $0.87/1M out, trong khi Claude Opus 5 bắt đầu từ $25/1M out.

Claude Opus 5 và DeepSeek-V4 giá bao nhiêu cho mỗi 1M tokens?

Claude Opus 5: $5/1M in cho 1M input tokens, $25/1M out cho 1M output tokens. DeepSeek-V4: $0.435/1M in (cache hit $0.003625) cho 1M input tokens, $0.87/1M out cho 1M output tokens.