Birebir düello

Grok 4.3 logosuvsClaude Sonnet 5 logosu

Grok 4.3 vs Claude Sonnet 5: 2026'da hangi yapay zeka modeli kazanıyor?

Grok 4.3 ($2.50/1M out) ve Claude Sonnet 5 ($15/1M out ($10 intro until 2026-08-31)), 2026'nın en çok kullanılan yapay zeka modelleri arasında. 3 topluluk oyunda Claude Sonnet 5, %57 onayla önde.

Hızlı hüküm

Akıl yürütme tarafında Claude Sonnet 5 seçin: arena onu Grok 4.3 için 4/5 puana karşı 4.5/5 olarak değerlendiriyor. Bütçe tarafında Grok 4.3 kazanıyor: Claude Sonnet 5 için $15/1M out ($10 intro until 2026-08-31) yerine $2.50/1M out seviyesinden başlıyor.

Satır satır karşılaştırma

Başlangıç
$2.50/1M outTüm akıl yürütme effort katmanlarında sabit $1.25 girdi / $2.50 çıktı; önbellekli girdi $0.20/1M. xAI'ın kendi fiyat sayfası uzun bağlam ek ücreti göstermiyor, ancak OpenRouter 200K toplam token üzerinde kademeli daha yüksek tarifeler listeliyor.
$15/1M out ($10 intro until 2026-08-31)Tek katman: standart 1M token başına $3/$15, 31 Ağustos 2026'ya kadar tanıtım fiyatı $2/$10; Batch API -%50; yeni tokenizer metin başına yaklaşık %30 daha fazla token üretiyor (Anthropic'e göre 1.0-1.35x), efektif maliyeti artırıyor.
Sağlayıcı
xAI
Anthropic
Bağlam penceresi
1M tokens
1M tokens (128K max output)
Girdi fiyatı
$1.25/1M in
$3/1M in ($2 intro until 2026-08-31)
Çıktı fiyatı
$2.50/1M out
$15/1M out ($10 intro until 2026-08-31)
Modaliteler
text, vision (text output only)
text, vision (image input, text output)
Open weights
Hayır
Hayır
Kalabalık puanı
50%(0)
57%(3)
Arena puanları (1-5)
Akıl yürütme
4.0
4.5
Kodlama
3.5
4.5
Yazarlık
4.5
4.5
Hız
3.5
4.0
Fiyat/performans
4.5
4.5

Güçlü ve zayıf yönler

Grok 4.3

  • Agresif fiyatlandırma: 1M token başına $1.25/$2.50, Grok 4'ten girdide %58, çıktıda %83 ucuz; GPT-5.5 ve Gemini 3.1 Pro'nun altında
  • Büyük ajan sıçraması: Grok 4.20'ye göre GDPval-AA'da +321 Elo, güçlü araç çağırma ve talimat takibiyle
  • Önbellekli girdi $0.20/1M (%84 indirim), tekrarlı ajan döngüleri için büyük tasarruf
  • Tek modelde, tek fiyata yapılandırılabilir akıl yürütme effort'u (none/low/medium/high); hızlı ve derin varyantlar arasında yönlendirme yok
  • HN'de doğal, özlü tonu ve gerçek dünya maliyetlerini düşüren token yoğun çıktıları övülüyor
  • Saniyede yaklaşık 130 çıktı tokeni ile sağlam iş hacmi (Artificial Analysis)
  • Kodlama akıl yürütmesi HN geliştiricilerince 'büyük Nisan sürümleriyle rekabetçi değil' diye değerlendirildi; zeka sınırı Grok 4'ten beri neredeyse yerinde saydı
  • AA-Omniscience'ta halüsinasyonsuzluk skoru Grok 4.20'ye göre 8 puan düştü; hassasiyet kritik alanlarda 4.20 xAI'ın daha güvenli seçimi olmaya devam ediyor
  • Yüksek ilk token süresi (Artificial Analysis'e göre yüksek akıl yürütme effort'unda ~13 sn), etkileşimli uygulamalar için can sıkıcı
  • Bağlam penceresi Grok 4.20'nin 2M'sinden 1M'ye küçüldü
  • Yinelenen güven ve güvenlik şikayetleri (zararlı içerik raporları, tutarsız davranış) ve tüketici uygulamasında MCP/bağlı uygulama desteği yok

Claude Sonnet 5

  • Sonnet 4.6'ya göre büyük ajan kazanımları: Terminal-Bench 2.1'de 80.4% vs 67.0%, OSWorld-Verified'da 81.2% vs 78.5%, SWE-bench Pro'da 63.2% vs 58.1%
  • Bilgi işinde Opus 4.8 ile başa baş (GDPval-AA v2: 1,618 vs 1,615) ve araçlı Humanity's Last Exam'de neredeyse eşit (57.4% vs 57.9%), Opus 4.8 fiyatının %60'ına (tanıtım döneminde %40'ına)
  • 1M token bağlam penceresi ve 128K maks. çıktı; 31 Ağustos 2026'ya kadar 1M token başına $2/$10 tanıtım fiyatı
  • Kalıcı, kendini doğrulayan ajan davranışı: saha incelemeleri, Sonnet 4.6'nın aksine kendi kodunu test ettiğini ve zor problemlerde çözene kadar yinelediğini not ediyor
  • xhigh effort seviyesine ve yüksek çözünürlüklü görüye (2576px görseller) sahip ilk Sonnet; uyarlanabilir düşünme varsayılan olarak etkin
  • Sonnet 4.6'dan daha yüksek kod incelemesi isabeti (38-40% vs 29%), daha az yanlış pozitif bulgu üretiyor
  • Yeni tokenizer, aynı metin için token sayısını yaklaşık %30 şişiriyor (Anthropic'e göre 1.0-1.35x; Simon Willison'ın ölçümüyle İngilizcede ~1.4x, Python'da ~1.28x); etiket fiyatı değişmese de efektif maliyet artıyor
  • Uzun yazıyor ve token yiyor: bağımsız testlerde görev başına ~$2.29, Sonnet 4.6'da ~$1.20 (maliyet verimliliğinde 161 model içinde 101. sıra); yüksek effort'ta görev başına maliyet Opus 4.8'i aşabiliyor
  • Küçük rutin düzenlemelerde Sonnet 4.6'dan ölçülebilir şekilde daha yavaş ve basit görevleri aşırı mühendisliğe boğmaya eğilimli (CodeRabbit saha incelemesi)
  • Örnekleme parametreleri (temperature, top_p, top_k) kaldırıldı; varsayılan dışı değerler 400 hatası döndürüyor ve mevcut hatları bozuyor
  • HN/Reddit'teki çıkış tepkileri karışıktı: '5' etiketi abartılı bulundu, daha katı siber güvenlik korumaları zararsız güvenlik yakını işleri reddedebiliyor

Hükmünüzü verin

Gladyatör başına, araç başına bir tavsiye. Herkesin gördüğü kalabalık puanını yeniden şekillendirir.

Grok 4.3$2.50/1M out
50%kalabalık puanı · 0
Claude Sonnet 5$15/1M out ($10 intro until 2026-08-31)
57%kalabalık puanı · 3

Arenanın Grok 4.3 hakkındaki hükmü

Çağrı başına maliyetin belirleyici olduğu ajan veya yüksek hacimli hatlar çalıştırıyorsanız Grok 4.3'ü seçin: GPT-5.5 veya Gemini 3.1 Pro fiyatının küçük bir bölümüne, sınıra yakın akıl yürütme ve Grok 4.20'ye göre büyük bir araç çağırma sıçraması sunuyor. Kodlama hassasiyeti önceliğinizse atlayın; geliştiriciler Claude'u ve büyük Nisan sürümlerini hala önde sıralıyor. Hukuk, tıp veya uyumluluk işleri için 2M bağlamına ya da daha iyi halüsinasyonsuzluk skoruna ihtiyacınız varsa Grok 4.20'de kalın. Gecikmeye duyarlı uygulamalar karar vermeden önce ~13 saniyelik ilk token süresini test etmeli.

Arenanın Claude Sonnet 5 hakkındaki hükmü

Kodlama, terminal veya bilgisayar kullanımı ajanları çalıştırıyor ve Sonnet fiyatına Opus 4.8'e yakın kalite istiyorsanız Sonnet 5'i seçin, özellikle $2/$10 tanıtım döneminde; düşük ve orta effort'ta Sonnet 4.6'ya göre kesin bir yükseltme. Yeni tokenizer'a ve uzun yazma eğilimine bütçe ayırın: görev başına gerçek maliyetler Sonnet 4.6'nın epey üzerinde ve en yüksek effort seviyelerinde çözülen görev başına Opus 4.8 daha iyi bir anlaşma olabilir. Gecikmeye duyarlı küçük düzenlemeler ya da artık hata veren temperature ve top_p'ye bağımlı hatlar için uzak durun. Yüksek hacimli, küçük diff'li iş yükleri için pragmatik seçim hala Sonnet 4.6.

Kalabalık ne diyor

Grok 4.3 hakkında

Henüz hüküm yok. İlk konuşan siz olun.

Claude Sonnet 5 hakkında

Kaptan Churn

Cheap per token, pricey per task. Independent tests had it near $2.29 a task vs $1.20 on 4.6, and at high effort it can out-cost Opus 4.8. It will not stop talking.

Altın Başparmakus

Terminal-Bench going 67 to 80 over Sonnet 4.6 matches what I see. My CI-fix agent went from constant babysitting to mostly hands-off overnight.

Aziz Deployus

Matches Opus 4.8 on knowledge work at 60% of the price, and the intro $2/$10 window makes it silly value. My research agent runs on Sonnet 5 now, zero regrets.

Sık sorulan sorular

Grok 4.3, Claude Sonnet 5 aracından daha mı iyi?

Kalabalık şu anda Claude Sonnet 5 tarafında: %57 tavsiye ediyor, Grok 4.3 için bu oran %50 (3 oy). Akıl yürütme tarafında Claude Sonnet 5 daha yüksek puan alıyor (4.5/5 vs 4/5). Doğru seçim kullanım amacınıza bağlı. Bu sayfadaki satır satır karşılaştırma; fiyatlandırmayı, temel özellikleri ve arena puanlarını ayrıntılarıyla ele alıyor.

Hangisi daha ucuz, Grok 4.3 mı Claude Sonnet 5 mi?

Grok 4.3 daha ucuz: $2.50/1M out seviyesinden başlıyor, Claude Sonnet 5 ise $15/1M out ($10 intro until 2026-08-31) seviyesinden başlıyor.

Grok 4.3 ve Claude Sonnet 5 1M token başına ne kadar tutuyor?

Grok 4.3: 1M girdi tokeni başına $1.25/1M in, 1M çıktı tokeni başına $2.50/1M out. Claude Sonnet 5: 1M girdi tokeni başına $3/1M in ($2 intro until 2026-08-31), 1M çıktı tokeni başına $15/1M out ($10 intro until 2026-08-31).