Hall of Fame · จัดอันดับสดโดยฝูงชน
ตารางอันดับ โมเดล LLM
ผู้เข้าแข่งขันทุกรายในสังเวียนนี้ จัดอันดับสดด้วยคำตัดสินจริงจากฝูงชน: แนะนำหรือควรเลี่ยง หนึ่งคนหนึ่งคำตัดสิน อันดับขยับทุกครั้งที่มีโหวต
อัปเดตเมื่อ 21 กรกฎาคม 2569
- Claude Haiku 4.5เยี่ยมชม
โมเดลที่เร็วที่สุดของ Anthropic: ฝีมือโค้ดราว 90% ของ Sonnet 4.5 ที่ $1/$5 ต่อ 1M โทเค็น context 200K
การใช้เหตุผล3.0การเขียนโค้ด3.5งานเขียน3.0ความเร็ว4.5ความคุ้มค่า4.0ราคา$5/1M out - 2Claude Fable 5เยี่ยมชม
เรือธงคลาส Mythos ของ Anthropic เดือน มิ.ย. 2026: 80.3% บน SWE-bench Pro นำโมเดล frontier ทุกตัวอยู่ 11 แต้ม
การใช้เหตุผล5.0การเขียนโค้ด5.0งานเขียน4.5ความเร็ว2.0ความคุ้มค่า3.0ราคา$50/1M out - 3Claude Opus 4.7เยี่ยมชม
Opus ของ Anthropic เดือน เม.ย. 2026: SWE-bench Verified 87.6%, context 1M, วิชันความละเอียดสูง ปัจจุบันตามหลัง Opus 4.8
การใช้เหตุผล4.5การเขียนโค้ด4.5งานเขียน4.5ความเร็ว2.5ความคุ้มค่า3.0ราคา$25/1M out - 4Claude Sonnet 5เยี่ยมชม
Sonnet ที่ agentic ที่สุดของ Anthropic: คุณภาพใกล้ Opus 4.8 ในงานโค้ดและ agent ที่ $3/$15 พร้อม context 1M
การใช้เหตุผล4.5การเขียนโค้ด4.5งานเขียน4.5ความเร็ว4.0ความคุ้มค่า4.5ราคา$15/1M out ($10 intro until 2026-08-31) - 5Gemini 3 Proเยี่ยมชม
โมเดล frontier ของ Google เดือน พ.ย. 2025: context 1M, ตัวแรกที่ทะลุ 1500 Elo บน LMArena ถูกแทนที่ด้วย Gemini 3.1 Pro
การใช้เหตุผล4.5การเขียนโค้ด4.5งานเขียน3.5ความเร็ว3.5ความคุ้มค่า4.0ราคา$12/1M out (prompts ≤200K) - 6DeepSeek-V4เยี่ยมชม
MoE 1.6T แบบ open weights พร้อม context 1M โทเค็นและ agentic coding ใกล้ระดับ frontier ที่ $0.87 ต่อ 1M โทเค็น output
การใช้เหตุผล4.5การเขียนโค้ด4.5งานเขียน3.5ความเร็ว3.0ความคุ้มค่า5.0ราคา$0.87/1M out - 7Claude Opus 4.8เยี่ยมชม
โมเดลเรือธงระดับ Opus ของ Anthropic สำหรับ agentic coding ระยะยาว context 1M ที่ $5/$25 ต่อ 1M โทเค็น
การใช้เหตุผล4.5การเขียนโค้ด5.0งานเขียน5.0ความเร็ว3.0ความคุ้มค่า3.5ราคา$25/1M out - 8GPT-5.5เยี่ยมชม
เรือธงสาย agentic ของ OpenAI: context 1M, SOTA บน ARC-AGI-2 และ Terminal-Bench 2.0 ที่ $5/$30 ต่อ 1M โทเค็น
การใช้เหตุผล5.0การเขียนโค้ด4.5งานเขียน4.0ความเร็ว3.5ความคุ้มค่า3.0ราคา$30/1M out - 9Claude Opus 4.5เยี่ยมชม
โมเดลโค้ดระดับ frontier ของ Anthropic เดือน พ.ย. 2025: ตัวแรกที่ทะลุ 80% บน SWE-bench Verified ในราคาถูกกว่า Opus 4.1 ถึง 66%
การใช้เหตุผล3.5การเขียนโค้ด3.5งานเขียน3.5ความเร็ว2.5ความคุ้มค่า2.5ราคา$25/1M out - 10GPT-5.2เยี่ยมชม
โมเดล frontier ของ OpenAI เดือน ธ.ค. 2025: context 400K, SWE-bench Verified 80%, การใช้เหตุผลแข็งแรงแต่ output ช้า
การใช้เหตุผล4.0การเขียนโค้ด4.0งานเขียน3.5ความเร็ว2.5ความคุ้มค่า3.5ราคา$14/1M out - 11Grok 4.3เยี่ยมชม
โมเดล frontier ของ xAI ที่ context 1M ราคา $1.25/$2.50 ต่อ 1M โทเค็น จูนมาเพื่อการใช้เครื่องมือแบบ agentic
การใช้เหตุผล4.0การเขียนโค้ด3.5งานเขียน4.5ความเร็ว3.5ความคุ้มค่า4.5ราคา$2.50/1M out - 12Claude Opus 4.6เยี่ยมชม
Opus ของ Anthropic เดือน ก.พ. 2026: context 1M, adaptive thinking, SWE-bench 80.8% ปัจจุบันถูกแทนที่ด้วย Opus 4.8
การใช้เหตุผล4.0การเขียนโค้ด4.0งานเขียน4.0ความเร็ว2.5ความคุ้มค่า3.0ราคา$25/1M out - 13Gemini 3.5 Flashเยี่ยมชม
เรือธงสายความเร็วของ Google: ชนะ Gemini 3.1 Pro ในงานโค้ดแบบ agentic ที่ $1.50/$9 แต่แพงกว่า 3 Flash ถึง 3 เท่า
การใช้เหตุผล3.5การเขียนโค้ด4.0งานเขียน3.0ความเร็ว5.0ความคุ้มค่า4.5ราคา$9.00/1M out - 14Llama 4 (Scout / Maverick)เยี่ยมชม
คู่หู MoE แบบ open weights ของ Meta: พารามิเตอร์ active 17B, รับ input ภาพแบบ native, context 10M โทเค็นบนกระดาษ
การใช้เหตุผล2.5การเขียนโค้ด2.0งานเขียน2.5ความเร็ว4.5ความคุ้มค่า3.5ราคา$0.60/1M out (Maverick, hosted) - 15Mistral Large 3เยี่ยมชม
เรือธง MoE 675B แบบ open weights (active 41B) พร้อม context 256K, input ภาพ และราคา $0.50/$1.50 ต่อ 1M
การใช้เหตุผล3.0การเขียนโค้ด3.0งานเขียน4.0ความเร็ว3.5ความคุ้มค่า4.0ราคา$1.50/1M out
ศึกใหญ่
การเปรียบเทียบตัวต่อตัวระหว่างผู้ครองโพเดียม