Hall of Fame · Peringkat langsung dari penonton

Papan peringkat Model LLM

Setiap kontestan di arena ini, diperingkat langsung oleh vonis asli penonton: rekomendasikan atau hindari, satu vonis per orang. Urutannya bergerak di setiap suara.

Diperbarui 21 Juli 2026

Lebih suka daftar pilihan terkurasi?Model LLM terbaik
  1. Claude Haiku 4.5

    Model tercepat Anthropic: sekitar 90% kemampuan coding Sonnet 4.5 seharga $1/$5 per 1M tokens, context 200K.

    Penalaran3.0
    Coding3.5
    Menulis3.0
    Kecepatan4.5
    Nilai4.0
    Harga$5/1M out
  2. 2
    Claude Fable 5

    Flagship kelas Mythos dari Anthropic edisi Juni 2026: 80.3% di SWE-bench Pro, unggul 11 poin dari semua model frontier lainnya

    Penalaran5.0
    Coding5.0
    Menulis4.5
    Kecepatan2.0
    Nilai3.0
    Harga$50/1M out
  3. 3
    Claude Opus 4.7

    Opus Anthropic edisi April 2026: 87.6% SWE-bench Verified, context 1M, vision resolusi tinggi, kini tertinggal dari Opus 4.8

    Penalaran4.5
    Coding4.5
    Menulis4.5
    Kecepatan2.5
    Nilai3.0
    Harga$25/1M out
  4. 4
    Claude Sonnet 5

    Sonnet paling agentik dari Anthropic: kualitas mendekati Opus 4.8 untuk coding dan agen seharga $3/$15 dengan context 1M

    Penalaran4.5
    Coding4.5
    Menulis4.5
    Kecepatan4.0
    Nilai4.5
    Harga$15/1M out ($10 intro until 2026-08-31)
  5. 5
    Gemini 3 Pro

    Model frontier Google edisi Nov 2025: context 1M, yang pertama melewati 1500 Elo di LMArena, digantikan oleh Gemini 3.1 Pro.

    Penalaran4.5
    Coding4.5
    Menulis3.5
    Kecepatan3.5
    Nilai4.0
    Harga$12/1M out (prompts ≤200K)
  6. 6
    DeepSeek-V4

    MoE open weights 1.6T dengan context 1M token dan coding agentik mendekati frontier seharga $0.87 per 1M output tokens

    Penalaran4.5
    Coding4.5
    Menulis3.5
    Kecepatan3.0
    Nilai5.0
    Harga$0.87/1M out
  7. 7
    Claude Opus 4.8

    Model flagship kelas Opus dari Anthropic untuk coding agentik jangka panjang; context 1M seharga $5/$25 per 1M tokens.

    Penalaran4.5
    Coding5.0
    Menulis5.0
    Kecepatan3.0
    Nilai3.5
    Harga$25/1M out
  8. 8
    GPT-5.5

    Flagship agentik OpenAI: context 1M, SOTA di ARC-AGI-2 dan Terminal-Bench 2.0, $5/$30 per 1M tokens.

    Penalaran5.0
    Coding4.5
    Menulis4.0
    Kecepatan3.5
    Nilai3.0
    Harga$30/1M out
  9. 9
    Claude Opus 4.5

    Coder frontier Anthropic edisi Nov 2025: yang pertama menembus 80% di SWE-bench Verified, dengan harga 66% di bawah Opus 4.1

    Penalaran3.5
    Coding3.5
    Menulis3.5
    Kecepatan2.5
    Nilai2.5
    Harga$25/1M out
  10. 10
    GPT-5.2

    Model frontier OpenAI edisi Des 2025: context 400K, 80% SWE-bench Verified, penalaran kuat tetapi output lambat.

    Penalaran4.0
    Coding4.0
    Menulis3.5
    Kecepatan2.5
    Nilai3.5
    Harga$14/1M out
  11. 11
    Grok 4.3

    Model frontier xAI dengan context 1M seharga $1.25/$2.50 per 1M tokens, dituning untuk penggunaan tool agentik.

    Penalaran4.0
    Coding3.5
    Menulis4.5
    Kecepatan3.5
    Nilai4.5
    Harga$2.50/1M out
  12. 12
    Claude Opus 4.6

    Opus Anthropic edisi Feb 2026: context 1M, adaptive thinking, 80.8% SWE-bench, kini digantikan oleh Opus 4.8.

    Penalaran4.0
    Coding4.0
    Menulis4.0
    Kecepatan2.5
    Nilai3.0
    Harga$25/1M out
  13. 13
    Gemini 3.5 Flash

    Flagship kelas cepat Google: mengalahkan Gemini 3.1 Pro pada coding agentik seharga $1.50/$9, 3x lebih mahal dari 3 Flash

    Penalaran3.5
    Coding4.0
    Menulis3.0
    Kecepatan5.0
    Nilai4.5
    Harga$9.00/1M out
  14. 14
    Llama 4 (Scout / Maverick)

    Duo MoE open weights dari Meta: 17B parameter aktif, input gambar natif, context 10M token di atas kertas

    Penalaran2.5
    Coding2.0
    Menulis2.5
    Kecepatan4.5
    Nilai3.5
    Harga$0.60/1M out (Maverick, hosted)
  15. 15
    Mistral Large 3

    Flagship MoE open weights 675B (41B aktif) dengan context 256K, input vision, dan harga $0.50/$1.50 per 1M.

    Penalaran3.0
    Coding3.0
    Menulis4.0
    Kecepatan3.5
    Nilai4.0
    Harga$1.50/1M out