Hall of Fame · จัดอันดับสดโดยฝูงชน

ตารางอันดับ โมเดล LLM

ผู้เข้าแข่งขันทุกรายในสังเวียนนี้ จัดอันดับสดด้วยคำตัดสินจริงจากฝูงชน: แนะนำหรือควรเลี่ยง หนึ่งคนหนึ่งคำตัดสิน อันดับขยับทุกครั้งที่มีโหวต

อัปเดตเมื่อ 21 กรกฎาคม 2569

อยากได้รายชื่อคัดสรรมาให้แล้วมากกว่า?สุดยอดโมเดล LLM
  1. Claude Haiku 4.5

    โมเดลที่เร็วที่สุดของ Anthropic: ฝีมือโค้ดราว 90% ของ Sonnet 4.5 ที่ $1/$5 ต่อ 1M โทเค็น context 200K

    การใช้เหตุผล3.0
    การเขียนโค้ด3.5
    งานเขียน3.0
    ความเร็ว4.5
    ความคุ้มค่า4.0
    ราคา$5/1M out
  2. 2
    Claude Fable 5

    เรือธงคลาส Mythos ของ Anthropic เดือน มิ.ย. 2026: 80.3% บน SWE-bench Pro นำโมเดล frontier ทุกตัวอยู่ 11 แต้ม

    การใช้เหตุผล5.0
    การเขียนโค้ด5.0
    งานเขียน4.5
    ความเร็ว2.0
    ความคุ้มค่า3.0
    ราคา$50/1M out
  3. 3
    Claude Opus 4.7

    Opus ของ Anthropic เดือน เม.ย. 2026: SWE-bench Verified 87.6%, context 1M, วิชันความละเอียดสูง ปัจจุบันตามหลัง Opus 4.8

    การใช้เหตุผล4.5
    การเขียนโค้ด4.5
    งานเขียน4.5
    ความเร็ว2.5
    ความคุ้มค่า3.0
    ราคา$25/1M out
  4. 4
    Claude Sonnet 5

    Sonnet ที่ agentic ที่สุดของ Anthropic: คุณภาพใกล้ Opus 4.8 ในงานโค้ดและ agent ที่ $3/$15 พร้อม context 1M

    การใช้เหตุผล4.5
    การเขียนโค้ด4.5
    งานเขียน4.5
    ความเร็ว4.0
    ความคุ้มค่า4.5
    ราคา$15/1M out ($10 intro until 2026-08-31)
  5. 5
    Gemini 3 Pro

    โมเดล frontier ของ Google เดือน พ.ย. 2025: context 1M, ตัวแรกที่ทะลุ 1500 Elo บน LMArena ถูกแทนที่ด้วย Gemini 3.1 Pro

    การใช้เหตุผล4.5
    การเขียนโค้ด4.5
    งานเขียน3.5
    ความเร็ว3.5
    ความคุ้มค่า4.0
    ราคา$12/1M out (prompts ≤200K)
  6. 6
    DeepSeek-V4

    MoE 1.6T แบบ open weights พร้อม context 1M โทเค็นและ agentic coding ใกล้ระดับ frontier ที่ $0.87 ต่อ 1M โทเค็น output

    การใช้เหตุผล4.5
    การเขียนโค้ด4.5
    งานเขียน3.5
    ความเร็ว3.0
    ความคุ้มค่า5.0
    ราคา$0.87/1M out
  7. 7
    Claude Opus 4.8

    โมเดลเรือธงระดับ Opus ของ Anthropic สำหรับ agentic coding ระยะยาว context 1M ที่ $5/$25 ต่อ 1M โทเค็น

    การใช้เหตุผล4.5
    การเขียนโค้ด5.0
    งานเขียน5.0
    ความเร็ว3.0
    ความคุ้มค่า3.5
    ราคา$25/1M out
  8. 8
    GPT-5.5

    เรือธงสาย agentic ของ OpenAI: context 1M, SOTA บน ARC-AGI-2 และ Terminal-Bench 2.0 ที่ $5/$30 ต่อ 1M โทเค็น

    การใช้เหตุผล5.0
    การเขียนโค้ด4.5
    งานเขียน4.0
    ความเร็ว3.5
    ความคุ้มค่า3.0
    ราคา$30/1M out
  9. 9
    Claude Opus 4.5

    โมเดลโค้ดระดับ frontier ของ Anthropic เดือน พ.ย. 2025: ตัวแรกที่ทะลุ 80% บน SWE-bench Verified ในราคาถูกกว่า Opus 4.1 ถึง 66%

    การใช้เหตุผล3.5
    การเขียนโค้ด3.5
    งานเขียน3.5
    ความเร็ว2.5
    ความคุ้มค่า2.5
    ราคา$25/1M out
  10. 10
    GPT-5.2

    โมเดล frontier ของ OpenAI เดือน ธ.ค. 2025: context 400K, SWE-bench Verified 80%, การใช้เหตุผลแข็งแรงแต่ output ช้า

    การใช้เหตุผล4.0
    การเขียนโค้ด4.0
    งานเขียน3.5
    ความเร็ว2.5
    ความคุ้มค่า3.5
    ราคา$14/1M out
  11. 11
    Grok 4.3

    โมเดล frontier ของ xAI ที่ context 1M ราคา $1.25/$2.50 ต่อ 1M โทเค็น จูนมาเพื่อการใช้เครื่องมือแบบ agentic

    การใช้เหตุผล4.0
    การเขียนโค้ด3.5
    งานเขียน4.5
    ความเร็ว3.5
    ความคุ้มค่า4.5
    ราคา$2.50/1M out
  12. 12
    Claude Opus 4.6

    Opus ของ Anthropic เดือน ก.พ. 2026: context 1M, adaptive thinking, SWE-bench 80.8% ปัจจุบันถูกแทนที่ด้วย Opus 4.8

    การใช้เหตุผล4.0
    การเขียนโค้ด4.0
    งานเขียน4.0
    ความเร็ว2.5
    ความคุ้มค่า3.0
    ราคา$25/1M out
  13. 13
    Gemini 3.5 Flash

    เรือธงสายความเร็วของ Google: ชนะ Gemini 3.1 Pro ในงานโค้ดแบบ agentic ที่ $1.50/$9 แต่แพงกว่า 3 Flash ถึง 3 เท่า

    การใช้เหตุผล3.5
    การเขียนโค้ด4.0
    งานเขียน3.0
    ความเร็ว5.0
    ความคุ้มค่า4.5
    ราคา$9.00/1M out
  14. 14
    Llama 4 (Scout / Maverick)

    คู่หู MoE แบบ open weights ของ Meta: พารามิเตอร์ active 17B, รับ input ภาพแบบ native, context 10M โทเค็นบนกระดาษ

    การใช้เหตุผล2.5
    การเขียนโค้ด2.0
    งานเขียน2.5
    ความเร็ว4.5
    ความคุ้มค่า3.5
    ราคา$0.60/1M out (Maverick, hosted)
  15. 15
    Mistral Large 3

    เรือธง MoE 675B แบบ open weights (active 41B) พร้อม context 256K, input ภาพ และราคา $0.50/$1.50 ต่อ 1M

    การใช้เหตุผล3.0
    การเขียนโค้ด3.0
    งานเขียน4.0
    ความเร็ว3.5
    ความคุ้มค่า4.0
    ราคา$1.50/1M out

ศึกใหญ่

การเปรียบเทียบตัวต่อตัวระหว่างผู้ครองโพเดียม