Hall of Fame · Canlı kalabalık sıralaması

LLM Modelleri sıralaması

Bu arenadaki her yarışmacı, gerçek kalabalık hükümleriyle canlı sıralanıyor: tavsiye et veya uzak dur, kişi başına bir hüküm. Sıralama her oyla değişiyor.

21 Temmuz 2026 tarihinde güncellendi

Derlenmiş bir kısa liste mi tercih edersiniz?En iyi LLM modelleri
  1. Claude Haiku 4.5

    Anthropic'in en hızlı modeli: Sonnet 4.5'in kodlama becerisinin yaklaşık %90'ı, 1M token başına $1/$5, 200K bağlam.

    Akıl yürütme3.0
    Kodlama3.5
    Yazarlık3.0
    Hız4.5
    Fiyat/performans4.0
    Fiyat$5/1M out
  2. 2
    Claude Fable 5

    Anthropic'in Haziran 2026 Mythos sınıfı amiral gemisi: SWE-bench Pro'da 80.3%, diğer tüm sınır modellerden 11 puan önde

    Akıl yürütme5.0
    Kodlama5.0
    Yazarlık4.5
    Hız2.0
    Fiyat/performans3.0
    Fiyat$50/1M out
  3. 3
    Claude Opus 4.7

    Anthropic'in Nisan 2026 Opus modeli: 87.6% SWE-bench Verified, 1M bağlam, yüksek çözünürlüklü görü, artık Opus 4.8'in gerisinde

    Akıl yürütme4.5
    Kodlama4.5
    Yazarlık4.5
    Hız2.5
    Fiyat/performans3.0
    Fiyat$25/1M out
  4. 4
    Claude Sonnet 5

    Anthropic'in en ajan odaklı Sonnet'i: kodlama ve ajanlarda Opus 4.8'e yakın kalite, $3/$15 fiyat ve 1M bağlam

    Akıl yürütme4.5
    Kodlama4.5
    Yazarlık4.5
    Hız4.0
    Fiyat/performans4.5
    Fiyat$15/1M out ($10 intro until 2026-08-31)
  5. 5
    Gemini 3 Pro

    Google'ın Kasım 2025 sınır modeli: 1M bağlam, LMArena'da 1500 Elo'yu aşan ilk model, yerini Gemini 3.1 Pro aldı.

    Akıl yürütme4.5
    Kodlama4.5
    Yazarlık3.5
    Hız3.5
    Fiyat/performans4.0
    Fiyat$12/1M out (prompts ≤200K)
  6. 6
    DeepSeek-V4

    1M token bağlamlı, sınıra yakın ajan kodlamalı, çıktı 1M token başına $0.87'lik open weights 1.6T MoE

    Akıl yürütme4.5
    Kodlama4.5
    Yazarlık3.5
    Hız3.0
    Fiyat/performans5.0
    Fiyat$0.87/1M out
  7. 7
    Claude Opus 4.8

    Anthropic'in uzun soluklu ajan kodlama için amiral gemisi Opus modeli; 1M token başına $5/$25 fiyatla 1M bağlam.

    Akıl yürütme4.5
    Kodlama5.0
    Yazarlık5.0
    Hız3.0
    Fiyat/performans3.5
    Fiyat$25/1M out
  8. 8
    GPT-5.5

    OpenAI'ın ajan odaklı amiral gemisi: 1M bağlam, ARC-AGI-2 ve Terminal-Bench 2.0'da SOTA, 1M token başına $5/$30.

    Akıl yürütme5.0
    Kodlama4.5
    Yazarlık4.0
    Hız3.5
    Fiyat/performans3.0
    Fiyat$30/1M out
  9. 9
    Claude Opus 4.5

    Anthropic'in Kasım 2025 sınır kodlayıcısı: SWE-bench Verified'da %80'i aşan ilk model, Opus 4.1'den %66 daha ucuz

    Akıl yürütme3.5
    Kodlama3.5
    Yazarlık3.5
    Hız2.5
    Fiyat/performans2.5
    Fiyat$25/1M out
  10. 10
    GPT-5.2

    OpenAI'ın Aralık 2025 sınır modeli: 400K bağlam, 80% SWE-bench Verified, güçlü akıl yürütme ama yavaş çıktı.

    Akıl yürütme4.0
    Kodlama4.0
    Yazarlık3.5
    Hız2.5
    Fiyat/performans3.5
    Fiyat$14/1M out
  11. 11
    Grok 4.3

    xAI'ın 1M bağlamlı, 1M token başına $1.25/$2.50 fiyatlı, ajan tabanlı araç kullanımına ayarlı sınır modeli.

    Akıl yürütme4.0
    Kodlama3.5
    Yazarlık4.5
    Hız3.5
    Fiyat/performans4.5
    Fiyat$2.50/1M out
  12. 12
    Claude Opus 4.6

    Anthropic'in Şubat 2026 Opus modeli: 1M bağlam, uyarlanabilir düşünme, 80.8% SWE-bench, artık Opus 4.8'in gerisinde.

    Akıl yürütme4.0
    Kodlama4.0
    Yazarlık4.0
    Hız2.5
    Fiyat/performans3.0
    Fiyat$25/1M out
  13. 13
    Gemini 3.5 Flash

    Google'ın hız katmanı amiral gemisi: ajan kodlamada Gemini 3.1 Pro'yu $1.50/$9 fiyatla geçiyor, 3 Flash'tan 3 kat pahalı

    Akıl yürütme3.5
    Kodlama4.0
    Yazarlık3.0
    Hız5.0
    Fiyat/performans4.5
    Fiyat$9.00/1M out
  14. 14
    Llama 4 (Scout / Maverick)

    Meta'nın open weights MoE ikilisi: 17B aktif parametre, yerleşik görsel girdi, kağıt üzerinde 10M token bağlam

    Akıl yürütme2.5
    Kodlama2.0
    Yazarlık2.5
    Hız4.5
    Fiyat/performans3.5
    Fiyat$0.60/1M out (Maverick, hosted)
  15. 15
    Mistral Large 3

    256K bağlam, görsel girdi ve 1M başına $0.50/$1.50 fiyatlı open weights 675B MoE amiral gemisi (41B aktif).

    Akıl yürütme3.0
    Kodlama3.0
    Yazarlık4.0
    Hız3.5
    Fiyat/performans4.0
    Fiyat$1.50/1M out

Öne çıkan düellolar

Podyumdakiler arasındaki birebir karşılaştırmalar.