Hall of Fame · Peringkat langsung dari penonton
Papan peringkat Model LLM
Setiap kontestan di arena ini, diperingkat langsung oleh vonis asli penonton: rekomendasikan atau hindari, satu vonis per orang. Urutannya bergerak di setiap suara.
Diperbarui 21 Juli 2026
- Claude Haiku 4.5Kunjungi
Model tercepat Anthropic: sekitar 90% kemampuan coding Sonnet 4.5 seharga $1/$5 per 1M tokens, context 200K.
Penalaran3.0Coding3.5Menulis3.0Kecepatan4.5Nilai4.0Harga$5/1M out - 2Claude Fable 5Kunjungi
Flagship kelas Mythos dari Anthropic edisi Juni 2026: 80.3% di SWE-bench Pro, unggul 11 poin dari semua model frontier lainnya
Penalaran5.0Coding5.0Menulis4.5Kecepatan2.0Nilai3.0Harga$50/1M out - 3Claude Opus 4.7Kunjungi
Opus Anthropic edisi April 2026: 87.6% SWE-bench Verified, context 1M, vision resolusi tinggi, kini tertinggal dari Opus 4.8
Penalaran4.5Coding4.5Menulis4.5Kecepatan2.5Nilai3.0Harga$25/1M out - 4Claude Sonnet 5Kunjungi
Sonnet paling agentik dari Anthropic: kualitas mendekati Opus 4.8 untuk coding dan agen seharga $3/$15 dengan context 1M
Penalaran4.5Coding4.5Menulis4.5Kecepatan4.0Nilai4.5Harga$15/1M out ($10 intro until 2026-08-31) - 5Gemini 3 ProKunjungi
Model frontier Google edisi Nov 2025: context 1M, yang pertama melewati 1500 Elo di LMArena, digantikan oleh Gemini 3.1 Pro.
Penalaran4.5Coding4.5Menulis3.5Kecepatan3.5Nilai4.0Harga$12/1M out (prompts ≤200K) - 6DeepSeek-V4Kunjungi
MoE open weights 1.6T dengan context 1M token dan coding agentik mendekati frontier seharga $0.87 per 1M output tokens
Penalaran4.5Coding4.5Menulis3.5Kecepatan3.0Nilai5.0Harga$0.87/1M out - 7Claude Opus 4.8Kunjungi
Model flagship kelas Opus dari Anthropic untuk coding agentik jangka panjang; context 1M seharga $5/$25 per 1M tokens.
Penalaran4.5Coding5.0Menulis5.0Kecepatan3.0Nilai3.5Harga$25/1M out - 8GPT-5.5Kunjungi
Flagship agentik OpenAI: context 1M, SOTA di ARC-AGI-2 dan Terminal-Bench 2.0, $5/$30 per 1M tokens.
Penalaran5.0Coding4.5Menulis4.0Kecepatan3.5Nilai3.0Harga$30/1M out - 9Claude Opus 4.5Kunjungi
Coder frontier Anthropic edisi Nov 2025: yang pertama menembus 80% di SWE-bench Verified, dengan harga 66% di bawah Opus 4.1
Penalaran3.5Coding3.5Menulis3.5Kecepatan2.5Nilai2.5Harga$25/1M out - 10GPT-5.2Kunjungi
Model frontier OpenAI edisi Des 2025: context 400K, 80% SWE-bench Verified, penalaran kuat tetapi output lambat.
Penalaran4.0Coding4.0Menulis3.5Kecepatan2.5Nilai3.5Harga$14/1M out - 11Grok 4.3Kunjungi
Model frontier xAI dengan context 1M seharga $1.25/$2.50 per 1M tokens, dituning untuk penggunaan tool agentik.
Penalaran4.0Coding3.5Menulis4.5Kecepatan3.5Nilai4.5Harga$2.50/1M out - 12Claude Opus 4.6Kunjungi
Opus Anthropic edisi Feb 2026: context 1M, adaptive thinking, 80.8% SWE-bench, kini digantikan oleh Opus 4.8.
Penalaran4.0Coding4.0Menulis4.0Kecepatan2.5Nilai3.0Harga$25/1M out - 13Gemini 3.5 FlashKunjungi
Flagship kelas cepat Google: mengalahkan Gemini 3.1 Pro pada coding agentik seharga $1.50/$9, 3x lebih mahal dari 3 Flash
Penalaran3.5Coding4.0Menulis3.0Kecepatan5.0Nilai4.5Harga$9.00/1M out - 14Llama 4 (Scout / Maverick)Kunjungi
Duo MoE open weights dari Meta: 17B parameter aktif, input gambar natif, context 10M token di atas kertas
Penalaran2.5Coding2.0Menulis2.5Kecepatan4.5Nilai3.5Harga$0.60/1M out (Maverick, hosted) - 15Mistral Large 3Kunjungi
Flagship MoE open weights 675B (41B aktif) dengan context 256K, input vision, dan harga $0.50/$1.50 per 1M.
Penalaran3.0Coding3.0Menulis4.0Kecepatan3.5Nilai4.0Harga$1.50/1M out
Duel teratas
Perbandingan head-to-head antar penghuni podium.