Đấu trường · Đánh giá mô hình AI
Claude Sonnet 5
bởi Anthropic
Sonnet agentic nhất của Anthropic: chất lượng lập trình và agent gần Opus 4.8 ở mức $3/$15 với ngữ cảnh 1M
$15/1M out ($10 intro until 2026-08-31)
Một bậc duy nhất: $3/$15 mỗi 1M tokens giá chuẩn, $2/$10 giá khởi điểm đến hết 31 tháng 8, 2026; Batch API giảm 50%; tokenizer mới sinh ra nhiều hơn khoảng 30% token mỗi văn bản (1.0-1.35x theo Anthropic), làm tăng chi phí thực.
Anthropic
1M tokens (128K max output)
$3/1M in ($2 intro until 2026-08-31)
$15/1M out ($10 intro until 2026-08-31)
text, vision (image input, text output)
Không
Claude Sonnet 5 là gì?
Model tầm trung của Anthropic ra mắt ngày 30 tháng 6 năm 2026, kế nhiệm Sonnet 4.6. Cho hiệu năng sát Opus 4.8 về lập trình agentic, sử dụng công cụ và công việc tri thức ở mức giá Sonnet. Ngữ cảnh 1M tokens, output tối đa 128K, adaptive thinking bật mặc định.
Ưu và nhược điểm của Claude Sonnet 5
Ưu điểm
- Bước tiến agentic lớn so với Sonnet 4.6: Terminal-Bench 2.1 đạt 80.4% so với 67.0%, OSWorld-Verified 81.2% so với 78.5%, SWE-bench Pro 63.2% so với 58.1%
- Ngang Opus 4.8 về công việc tri thức (GDPval-AA v2: 1,618 so với 1,615) và gần như hòa trên Humanity's Last Exam có công cụ (57.4% so với 57.9%) ở mức giá bằng 60% của Opus 4.8 (40% trong giai đoạn khởi điểm)
- Cửa sổ ngữ cảnh 1M tokens và output tối đa 128K; giá khởi điểm $2/$10 mỗi 1M tokens đến hết 31 tháng 8, 2026
- Hành vi agent tự kiểm chứng bền bỉ: các đánh giá thực tế ghi nhận nó tự test code của mình và lặp lại trên bài toán khó cho đến khi giải xong, khác hẳn Sonnet 4.6
- Sonnet đầu tiên có mức effort xhigh và vision độ phân giải cao (ảnh 2576px); adaptive thinking bật mặc định
- Độ chính xác code review cao hơn Sonnet 4.6 (38-40% so với 29%), ít phát hiện dương tính giả hơn
Nhược điểm
- Tokenizer mới làm số token phình ra khoảng 30% cho cùng văn bản (1.0-1.35x theo Anthropic; ~1.4x tiếng Anh, ~1.28x Python do Simon Willison đo), khiến chi phí thực tăng dù giá niêm yết không đổi
- Dài dòng và ngốn token: ~$2.29 mỗi tác vụ so với ~$1.20 của Sonnet 4.6 trong test độc lập (xếp hạng 101 trên 161 về hiệu quả chi phí); ở effort cao, chi phí mỗi tác vụ có thể vượt cả Opus 4.8
- Chậm hơn Sonnet 4.6 một cách đo lường được trên các chỉnh sửa nhỏ thường ngày và có xu hướng over-engineering các tác vụ đơn giản (đánh giá thực tế của CodeRabbit)
- Tham số sampling (temperature, top_p, top_k) bị loại bỏ; giá trị khác mặc định trả về lỗi 400, làm gãy các pipeline hiện có
- Cảm nhận lúc ra mắt trên HN/Reddit lẫn lộn: nhãn '5' bị coi là hứa hẹn quá đà, và cơ chế an toàn an ninh mạng nghiêm hơn có thể từ chối cả công việc liên quan bảo mật vô hại
Phán quyết của đấu trường
Chọn Sonnet 5 nếu bạn chạy agent lập trình, terminal hoặc computer-use và muốn chất lượng gần Opus 4.8 ở giá Sonnet, nhất là trong giai đoạn giá khởi điểm $2/$10; nó là nâng cấp tuyệt đối so với Sonnet 4.6 ở effort thấp và trung bình. Hãy dự trù cho tokenizer mới và độ dài dòng của nó: chi phí thực mỗi tác vụ cao hơn hẳn Sonnet 4.6, và ở các mức effort cao nhất, Opus 4.8 có thể là món hời hơn tính trên mỗi tác vụ giải xong. Tránh nó với các chỉnh sửa nhỏ nhạy cảm độ trễ hoặc pipeline phụ thuộc temperature và top_p, những thứ nay báo lỗi. Sonnet 4.6 vẫn là lựa chọn thực dụng cho workload khối lượng lớn với các diff tí hon.
Ngón cái lên hay ngón cái xuống
Đưa ra phán quyết của bạn
Bạn sẽ khuyên dùng Claude Sonnet 5, hay cảnh báo đám đông tránh xa?
Những lựa chọn thay thế Claude Sonnet 5 hàng đầu
Tất cả lựa chọn thay thếModel nhanh nhất của Anthropic: khoảng 90% năng lực lập trình của Sonnet 4.5 ở mức $1/$5 mỗi 1M tokens, ngữ cảnh 200K.
Chủ lực hạng Mythos tháng 6/2026 của Anthropic: 80.3% trên SWE-bench Pro, bỏ xa mọi model đỉnh cao khác 11 điểm
Opus tháng 4/2026 của Anthropic: 87.6% SWE-bench Verified, ngữ cảnh 1M, vision độ phân giải cao, nay xếp sau Opus 4.8
So sánh Claude Sonnet 5 đối đầu trực tiếp
Đám đông nói gì
“Cheap per token, pricey per task. Independent tests had it near $2.29 a task vs $1.20 on 4.6, and at high effort it can out-cost Opus 4.8. It will not stop talking.”
“Terminal-Bench going 67 to 80 over Sonnet 4.6 matches what I see. My CI-fix agent went from constant babysitting to mostly hands-off overnight.”
“Matches Opus 4.8 on knowledge work at 60% of the price, and the intro $2/$10 window makes it silly value. My research agent runs on Sonnet 5 now, zero regrets.”
Claude Sonnet 5: câu hỏi thường gặp
Claude Sonnet 5 giá bao nhiêu cho mỗi 1M tokens?
Claude Sonnet 5 có giá $3/1M in ($2 intro until 2026-08-31) cho 1M input tokens và $15/1M out ($10 intro until 2026-08-31) cho 1M output tokens. Một bậc duy nhất: $3/$15 mỗi 1M tokens giá chuẩn, $2/$10 giá khởi điểm đến hết 31 tháng 8, 2026; Batch API giảm 50%; tokenizer mới sinh ra nhiều hơn khoảng 30% token mỗi văn bản (1.0-1.35x theo Anthropic), làm tăng chi phí thực.