Hall of Fame · Canlı kalabalık sıralaması
LLM Modelleri sıralaması
Bu arenadaki her yarışmacı, gerçek kalabalık hükümleriyle canlı sıralanıyor: tavsiye et veya uzak dur, kişi başına bir hüküm. Sıralama her oyla değişiyor.
21 Temmuz 2026 tarihinde güncellendi
- Claude Haiku 4.5Ziyaret et
Anthropic'in en hızlı modeli: Sonnet 4.5'in kodlama becerisinin yaklaşık %90'ı, 1M token başına $1/$5, 200K bağlam.
Akıl yürütme3.0Kodlama3.5Yazarlık3.0Hız4.5Fiyat/performans4.0Fiyat$5/1M out - 2Claude Fable 5Ziyaret et
Anthropic'in Haziran 2026 Mythos sınıfı amiral gemisi: SWE-bench Pro'da 80.3%, diğer tüm sınır modellerden 11 puan önde
Akıl yürütme5.0Kodlama5.0Yazarlık4.5Hız2.0Fiyat/performans3.0Fiyat$50/1M out - 3Claude Opus 4.7Ziyaret et
Anthropic'in Nisan 2026 Opus modeli: 87.6% SWE-bench Verified, 1M bağlam, yüksek çözünürlüklü görü, artık Opus 4.8'in gerisinde
Akıl yürütme4.5Kodlama4.5Yazarlık4.5Hız2.5Fiyat/performans3.0Fiyat$25/1M out - 4Claude Sonnet 5Ziyaret et
Anthropic'in en ajan odaklı Sonnet'i: kodlama ve ajanlarda Opus 4.8'e yakın kalite, $3/$15 fiyat ve 1M bağlam
Akıl yürütme4.5Kodlama4.5Yazarlık4.5Hız4.0Fiyat/performans4.5Fiyat$15/1M out ($10 intro until 2026-08-31) - 5Gemini 3 ProZiyaret et
Google'ın Kasım 2025 sınır modeli: 1M bağlam, LMArena'da 1500 Elo'yu aşan ilk model, yerini Gemini 3.1 Pro aldı.
Akıl yürütme4.5Kodlama4.5Yazarlık3.5Hız3.5Fiyat/performans4.0Fiyat$12/1M out (prompts ≤200K) - 6DeepSeek-V4Ziyaret et
1M token bağlamlı, sınıra yakın ajan kodlamalı, çıktı 1M token başına $0.87'lik open weights 1.6T MoE
Akıl yürütme4.5Kodlama4.5Yazarlık3.5Hız3.0Fiyat/performans5.0Fiyat$0.87/1M out - 7Claude Opus 4.8Ziyaret et
Anthropic'in uzun soluklu ajan kodlama için amiral gemisi Opus modeli; 1M token başına $5/$25 fiyatla 1M bağlam.
Akıl yürütme4.5Kodlama5.0Yazarlık5.0Hız3.0Fiyat/performans3.5Fiyat$25/1M out - 8GPT-5.5Ziyaret et
OpenAI'ın ajan odaklı amiral gemisi: 1M bağlam, ARC-AGI-2 ve Terminal-Bench 2.0'da SOTA, 1M token başına $5/$30.
Akıl yürütme5.0Kodlama4.5Yazarlık4.0Hız3.5Fiyat/performans3.0Fiyat$30/1M out - 9Claude Opus 4.5Ziyaret et
Anthropic'in Kasım 2025 sınır kodlayıcısı: SWE-bench Verified'da %80'i aşan ilk model, Opus 4.1'den %66 daha ucuz
Akıl yürütme3.5Kodlama3.5Yazarlık3.5Hız2.5Fiyat/performans2.5Fiyat$25/1M out - 10GPT-5.2Ziyaret et
OpenAI'ın Aralık 2025 sınır modeli: 400K bağlam, 80% SWE-bench Verified, güçlü akıl yürütme ama yavaş çıktı.
Akıl yürütme4.0Kodlama4.0Yazarlık3.5Hız2.5Fiyat/performans3.5Fiyat$14/1M out - 11Grok 4.3Ziyaret et
xAI'ın 1M bağlamlı, 1M token başına $1.25/$2.50 fiyatlı, ajan tabanlı araç kullanımına ayarlı sınır modeli.
Akıl yürütme4.0Kodlama3.5Yazarlık4.5Hız3.5Fiyat/performans4.5Fiyat$2.50/1M out - 12Claude Opus 4.6Ziyaret et
Anthropic'in Şubat 2026 Opus modeli: 1M bağlam, uyarlanabilir düşünme, 80.8% SWE-bench, artık Opus 4.8'in gerisinde.
Akıl yürütme4.0Kodlama4.0Yazarlık4.0Hız2.5Fiyat/performans3.0Fiyat$25/1M out - 13Gemini 3.5 FlashZiyaret et
Google'ın hız katmanı amiral gemisi: ajan kodlamada Gemini 3.1 Pro'yu $1.50/$9 fiyatla geçiyor, 3 Flash'tan 3 kat pahalı
Akıl yürütme3.5Kodlama4.0Yazarlık3.0Hız5.0Fiyat/performans4.5Fiyat$9.00/1M out - 14Llama 4 (Scout / Maverick)Ziyaret et
Meta'nın open weights MoE ikilisi: 17B aktif parametre, yerleşik görsel girdi, kağıt üzerinde 10M token bağlam
Akıl yürütme2.5Kodlama2.0Yazarlık2.5Hız4.5Fiyat/performans3.5Fiyat$0.60/1M out (Maverick, hosted) - 15Mistral Large 3Ziyaret et
256K bağlam, görsel girdi ve 1M başına $0.50/$1.50 fiyatlı open weights 675B MoE amiral gemisi (41B aktif).
Akıl yürütme3.0Kodlama3.0Yazarlık4.0Hız3.5Fiyat/performans4.0Fiyat$1.50/1M out
Öne çıkan düellolar
Podyumdakiler arasındaki birebir karşılaştırmalar.