Hall of Fame · Đám đông xếp hạng trực tiếp
Bảng xếp hạng Mô hình LLM
Mọi ứng viên trong đấu trường này, xếp hạng trực tiếp bằng phán quyết thật từ đám đông: nên dùng hoặc nên tránh, mỗi người một phán quyết. Thứ hạng dịch chuyển theo từng phiếu bầu.
Cập nhật 21 tháng 7, 2026
- Claude Haiku 4.5Truy cập
Model nhanh nhất của Anthropic: khoảng 90% năng lực lập trình của Sonnet 4.5 ở mức $1/$5 mỗi 1M tokens, ngữ cảnh 200K.
Suy luận3.0Lập trình3.5Viết lách3.0Tốc độ4.5Đáng tiền4.0Giá$5/1M out - 2Claude Fable 5Truy cập
Chủ lực hạng Mythos tháng 6/2026 của Anthropic: 80.3% trên SWE-bench Pro, bỏ xa mọi model đỉnh cao khác 11 điểm
Suy luận5.0Lập trình5.0Viết lách4.5Tốc độ2.0Đáng tiền3.0Giá$50/1M out - 3Claude Opus 4.7Truy cập
Opus tháng 4/2026 của Anthropic: 87.6% SWE-bench Verified, ngữ cảnh 1M, vision độ phân giải cao, nay xếp sau Opus 4.8
Suy luận4.5Lập trình4.5Viết lách4.5Tốc độ2.5Đáng tiền3.0Giá$25/1M out - 4Claude Sonnet 5Truy cập
Sonnet agentic nhất của Anthropic: chất lượng lập trình và agent gần Opus 4.8 ở mức $3/$15 với ngữ cảnh 1M
Suy luận4.5Lập trình4.5Viết lách4.5Tốc độ4.0Đáng tiền4.5Giá$15/1M out ($10 intro until 2026-08-31) - 5Gemini 3 ProTruy cập
Model đỉnh cao tháng 11/2025 của Google: ngữ cảnh 1M, đầu tiên vượt 1500 Elo trên LMArena, đã bị Gemini 3.1 Pro thay thế.
Suy luận4.5Lập trình4.5Viết lách3.5Tốc độ3.5Đáng tiền4.0Giá$12/1M out (prompts ≤200K) - 6DeepSeek-V4Truy cập
MoE 1.6T open weights với ngữ cảnh 1M tokens và lập trình agentic gần đỉnh cao ở mức $0.87 mỗi 1M output tokens
Suy luận4.5Lập trình4.5Viết lách3.5Tốc độ3.0Đáng tiền5.0Giá$0.87/1M out - 7Claude Opus 4.8Truy cập
Model hạng Opus chủ lực của Anthropic cho lập trình agentic dài hơi; ngữ cảnh 1M ở mức $5/$25 mỗi 1M tokens.
Suy luận4.5Lập trình5.0Viết lách5.0Tốc độ3.0Đáng tiền3.5Giá$25/1M out - 8GPT-5.5Truy cập
Model chủ lực agentic của OpenAI: ngữ cảnh 1M, SOTA trên ARC-AGI-2 và Terminal-Bench 2.0, $5/$30 mỗi 1M tokens.
Suy luận5.0Lập trình4.5Viết lách4.0Tốc độ3.5Đáng tiền3.0Giá$30/1M out - 9Claude Opus 4.5Truy cập
Model lập trình đỉnh cao tháng 11/2025 của Anthropic: đầu tiên vượt 80% trên SWE-bench Verified, giá rẻ hơn Opus 4.1 tới 66%
Suy luận3.5Lập trình3.5Viết lách3.5Tốc độ2.5Đáng tiền2.5Giá$25/1M out - 10GPT-5.2Truy cập
Model đỉnh cao tháng 12/2025 của OpenAI: ngữ cảnh 400K, 80% SWE-bench Verified, suy luận mạnh nhưng output chậm.
Suy luận4.0Lập trình4.0Viết lách3.5Tốc độ2.5Đáng tiền3.5Giá$14/1M out - 11Grok 4.3Truy cập
Model đỉnh cao ngữ cảnh 1M của xAI ở mức $1.25/$2.50 mỗi 1M tokens, tinh chỉnh cho sử dụng công cụ agentic.
Suy luận4.0Lập trình3.5Viết lách4.5Tốc độ3.5Đáng tiền4.5Giá$2.50/1M out - 12Claude Opus 4.6Truy cập
Opus tháng 2/2026 của Anthropic: ngữ cảnh 1M, adaptive thinking, 80.8% SWE-bench, nay đã bị Opus 4.8 thay thế.
Suy luận4.0Lập trình4.0Viết lách4.0Tốc độ2.5Đáng tiền3.0Giá$25/1M out - 13Gemini 3.5 FlashTruy cập
Chủ lực bậc tốc độ của Google: thắng Gemini 3.1 Pro về lập trình agentic ở mức $1.50/$9, đắt gấp 3x so với 3 Flash
Suy luận3.5Lập trình4.0Viết lách3.0Tốc độ5.0Đáng tiền4.5Giá$9.00/1M out - 14Llama 4 (Scout / Maverick)Truy cập
Bộ đôi MoE open weights của Meta: 17B tham số hoạt động, input hình ảnh nguyên bản, ngữ cảnh 10M tokens trên lý thuyết
Suy luận2.5Lập trình2.0Viết lách2.5Tốc độ4.5Đáng tiền3.5Giá$0.60/1M out (Maverick, hosted) - 15Mistral Large 3Truy cập
Chủ lực MoE 675B open weights (41B hoạt động) với ngữ cảnh 256K, input hình ảnh, và giá $0.50/$1.50 mỗi 1M.
Suy luận3.0Lập trình3.0Viết lách4.0Tốc độ3.5Đáng tiền4.0Giá$1.50/1M out
Những trận đấu đỉnh cao
So sánh đối đầu giữa những cái tên trên bục vinh quang.