Đấu trường · Đánh giá mô hình AI
Claude Haiku 4.5
bởi Anthropic
Model nhanh nhất của Anthropic: khoảng 90% năng lực lập trình của Sonnet 4.5 ở mức $1/$5 mỗi 1M tokens, ngữ cảnh 200K.
$5/1M out
Một bậc duy nhất: $1/1M input, $5/1M output; đọc prompt cache $0.10/1M (ghi 5 phút $1.25/1M) và Batch API giảm 50% ($0.50/$2.50); không phụ thu ngữ cảnh dài (tối đa 200K).
Anthropic
200K tokens
$1/1M in
$5/1M out
text, vision (input); text output
Không
Claude Haiku 4.5 là gì?
Model Claude nhỏ, chú trọng tốc độ, ra mắt ngày 15 tháng 10 năm 2025. Đạt 73.3% trên SWE-bench Verified, tương đương khoảng 90% hiệu năng lập trình agentic của Sonnet 4.5 với một phần ba chi phí. Hỗ trợ input hình ảnh và extended thinking, với cửa sổ ngữ cảnh 200K và output tối đa 64K.
Ưu và nhược điểm của Claude Haiku 4.5
Ưu điểm
- 73.3% trên SWE-bench Verified, khoảng 90% năng lực lập trình agentic của Sonnet 4.5 với một phần ba giá
- Nhanh: hơn 2x tốc độ Sonnet 4 theo Anthropic, khách hàng lúc ra mắt báo cáo nhanh hơn Sonnet 4.5 tới 4-5x; ~92-110 output tok/s do Artificial Analysis đo
- Dev báo cáo các chỉnh sửa code chính xác, khoanh vùng tốt, tránh động vào code không liên quan, tốt hơn hạng GPT-5 mini trong thử nghiệm ban đầu
- Hỗ trợ cả input hình ảnh lẫn extended thinking, hiếm có ở bậc giá này lúc ra mắt
- Rất hợp làm model thợ trong các hệ đa agent (Sonnet/Opus lên kế hoạch, các sub-agent Haiku thực thi song song)
- Đọc prompt cache ở mức $0.10/1M và giảm 50% qua Batch API giúp hạ chi phí thực thêm nữa
Nhược điểm
- $5/1M output là đắt cho một model nhỏ: các bậc Gemini Flash và GPT mini rẻ hơn vài lần trên các tác vụ nặng output
- Ngữ cảnh 200K (so với 1M của Sonnet 5/các anh em Opus) và output tối đa 64K giới hạn công việc trên codebase lớn và output dài
- Suy luận liên lĩnh vực làng nhàng: người dùng báo cáo kết quả yếu trên các bài kiến thức kiểu GPQA, MedQA, MMMU
- Thông lượng dao động mạnh trong thực tế (báo cáo từ 82-208 tok/s) và chất lượng giảm trong các phiên agentic dài 7-8+ phút
- Mốc cắt kiến thức (đáng tin đến tháng 2/2025) đã lạc hậu so với chuẩn giữa 2026
Phán quyết của đấu trường
Chọn Haiku 4.5 nếu bạn đang ở trong hệ sinh thái Anthropic và cần chất lượng lập trình gần Sonnet với độ trễ thấp và một phần ba giá: đây là bước tiến vượt bậc so với Haiku 3.5 và tỏa sáng trong vai trò model thợ của các pipeline đa agent. Tính đến tháng 7/2026 nó vẫn là model nhỏ hiện hành của Anthropic, nên là bậc giá rẻ mặc định cho các sản phẩm dựa trên Claude. Tránh nó cho suy luận liên lĩnh vực sâu, codebase rất lớn (trần ngữ cảnh 200K), hoặc khi chỉ săn giá mỗi token, nơi các bậc Gemini Flash và GPT mini nay đã rẻ hơn, và nâng lên Sonnet 5 khi chất lượng quan trọng hơn tốc độ.
Ngón cái lên hay ngón cái xuống
Đưa ra phán quyết của bạn
Bạn sẽ khuyên dùng Claude Haiku 4.5, hay cảnh báo đám đông tránh xa?
Những lựa chọn thay thế Claude Haiku 4.5 hàng đầu
Tất cả lựa chọn thay thếChủ lực hạng Mythos tháng 6/2026 của Anthropic: 80.3% trên SWE-bench Pro, bỏ xa mọi model đỉnh cao khác 11 điểm
Opus tháng 4/2026 của Anthropic: 87.6% SWE-bench Verified, ngữ cảnh 1M, vision độ phân giải cao, nay xếp sau Opus 4.8
Sonnet agentic nhất của Anthropic: chất lượng lập trình và agent gần Opus 4.8 ở mức $3/$15 với ngữ cảnh 1M
So sánh Claude Haiku 4.5 đối đầu trực tiếp
Đám đông nói gì
“The precise localized edits are the underrated feature. It fixes the line that needs fixing and leaves the rest alone. GPT mini class models keep rewriting half my file.”
“Haiku 4.5 gives me about 90% of Sonnet agentic coding at a third of the price, and it is fast enough that edit loops feel instant. My default for quick fixes now.”
Claude Haiku 4.5: câu hỏi thường gặp
Claude Haiku 4.5 giá bao nhiêu cho mỗi 1M tokens?
Claude Haiku 4.5 có giá $1/1M in cho 1M input tokens và $5/1M out cho 1M output tokens. Một bậc duy nhất: $1/1M input, $5/1M output; đọc prompt cache $0.10/1M (ghi 5 phút $1.25/1M) và Batch API giảm 50% ($0.50/$2.50); không phụ thu ngữ cảnh dài (tối đa 200K).