Birebir düello

Claude Sonnet 5 logosuvsGemini 3 Pro logosu

Claude Sonnet 5 vs Gemini 3 Pro: 2026'da hangi yapay zeka modeli kazanıyor?

Claude Sonnet 5 ($15/1M out ($10 intro until 2026-08-31)) ve Gemini 3 Pro ($12/1M out (prompts ≤200K)), 2026'nın en çok kullanılan yapay zeka modelleri arasında. 6 topluluk oyunda Claude Sonnet 5, %57 onayla önde.

Hızlı hüküm

Akıl yürütme tarafında Claude Sonnet 5 ve Gemini 3 Pro, 4.5/5 ile berabere. Bütçe tarafında Gemini 3 Pro kazanıyor: Claude Sonnet 5 için $15/1M out ($10 intro until 2026-08-31) yerine $12/1M out (prompts ≤200K) seviyesinden başlıyor.

Satır satır karşılaştırma

Başlangıç
$15/1M out ($10 intro until 2026-08-31)Tek katman: standart 1M token başına $3/$15, 31 Ağustos 2026'ya kadar tanıtım fiyatı $2/$10; Batch API -%50; yeni tokenizer metin başına yaklaşık %30 daha fazla token üretiyor (Anthropic'e göre 1.0-1.35x), efektif maliyeti artırıyor.
$12/1M out (prompts ≤200K)Standart katman: ≤200K prompt'lar için 1M token başına $2/$12, 200K üzeri $4/$18; batch %50 indirimli. 9 Mart 2026'da emekliye ayrıldı, halefi Gemini 3.1 Pro aynı fiyatı koruyor.
Sağlayıcı
Anthropic
Google (DeepMind)
Bağlam penceresi
1M tokens (128K max output)
1M tokens (64K output)
Girdi fiyatı
$3/1M in ($2 intro until 2026-08-31)
$2/1M in (prompts ≤200K)
Çıktı fiyatı
$15/1M out ($10 intro until 2026-08-31)
$12/1M out (prompts ≤200K)
Modaliteler
text, vision (image input, text output)
text, image, audio, video in; text out
Open weights
Hayır
Hayır
Kalabalık puanı
57%(3)
57%(3)
Arena puanları (1-5)
Akıl yürütme
4.5
4.5
Kodlama
4.5
4.5
Yazarlık
4.5
3.5
Hız
4.0
3.5
Fiyat/performans
4.5
4.0

Güçlü ve zayıf yönler

Claude Sonnet 5

  • Sonnet 4.6'ya göre büyük ajan kazanımları: Terminal-Bench 2.1'de 80.4% vs 67.0%, OSWorld-Verified'da 81.2% vs 78.5%, SWE-bench Pro'da 63.2% vs 58.1%
  • Bilgi işinde Opus 4.8 ile başa baş (GDPval-AA v2: 1,618 vs 1,615) ve araçlı Humanity's Last Exam'de neredeyse eşit (57.4% vs 57.9%), Opus 4.8 fiyatının %60'ına (tanıtım döneminde %40'ına)
  • 1M token bağlam penceresi ve 128K maks. çıktı; 31 Ağustos 2026'ya kadar 1M token başına $2/$10 tanıtım fiyatı
  • Kalıcı, kendini doğrulayan ajan davranışı: saha incelemeleri, Sonnet 4.6'nın aksine kendi kodunu test ettiğini ve zor problemlerde çözene kadar yinelediğini not ediyor
  • xhigh effort seviyesine ve yüksek çözünürlüklü görüye (2576px görseller) sahip ilk Sonnet; uyarlanabilir düşünme varsayılan olarak etkin
  • Sonnet 4.6'dan daha yüksek kod incelemesi isabeti (38-40% vs 29%), daha az yanlış pozitif bulgu üretiyor
  • Yeni tokenizer, aynı metin için token sayısını yaklaşık %30 şişiriyor (Anthropic'e göre 1.0-1.35x; Simon Willison'ın ölçümüyle İngilizcede ~1.4x, Python'da ~1.28x); etiket fiyatı değişmese de efektif maliyet artıyor
  • Uzun yazıyor ve token yiyor: bağımsız testlerde görev başına ~$2.29, Sonnet 4.6'da ~$1.20 (maliyet verimliliğinde 161 model içinde 101. sıra); yüksek effort'ta görev başına maliyet Opus 4.8'i aşabiliyor
  • Küçük rutin düzenlemelerde Sonnet 4.6'dan ölçülebilir şekilde daha yavaş ve basit görevleri aşırı mühendisliğe boğmaya eğilimli (CodeRabbit saha incelemesi)
  • Örnekleme parametreleri (temperature, top_p, top_k) kaldırıldı; varsayılan dışı değerler 400 hatası döndürüyor ve mevcut hatları bozuyor
  • HN/Reddit'teki çıkış tepkileri karışıktı: '5' etiketi abartılı bulundu, daha katı siber güvenlik korumaları zararsız güvenlik yakını işleri reddedebiliyor

Gemini 3 Pro

  • Çıkışta rekor 1501 Elo ile LMArena'nın zirvesine oturdu ve GPQA Diamond'da 91.9% aldı, yayımlandığında son teknoloji
  • ARC-AGI-2'de 31.1%, Gemini 2.5 Pro'nun (4.9%) kabaca 6 katı ve dönemin GPT-5.1'inin (17.6%) neredeyse iki katı
  • Sınıfının en iyisi çok modlu anlama: 81% MMMU-Pro, 87.6% Video-MMMU, 1M token bağlam penceresiyle
  • Güçlü ajan kodlama: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, WebDev Arena'da 1487 Elo
  • 1M token başına $2/$12 ile rakiplerin altında fiyatlandı, Claude Sonnet sınıfı fiyatların ($3/$15) altında
  • Yapılandırılabilir thinking_level (low/medium/high), geliştiricilerin akıl yürütme derinliğini gecikme ve maliyetle takas etmesini sağlıyor
  • Aşırı özgüvenli halüsinasyonlar: AA-Omniscience'ta cevap vermeyi reddetmek yerine %88 oranında yanlış yanıt verdi, Claude Sonnet 4.5'te bu oran %48 (the-decoder)
  • Değerlendiriciler yaygın yağcılık bildiriyor (Zvi Mowshowitz: 'omurgasız uçsuz bucaksız zeka'); sıkı sistem prompt'ları gerektiriyor
  • Ajan yığınlarında araç çağırma güvenilirliği sorunları: geliştiriciler araç çıktılarının sohbet dizisine döküldüğünü ve OpenAI/Anthropic modellerinden daha fazla iskele gerektiğini bildirdi
  • Yüksek düşünme seviyesinde yavaş: AI Studio'da ilk token süresi ~130 token/sn çıktı hızına rağmen 30-60 sn civarında ölçüldü
  • Emekli: 9 Mart 2026'da Gemini API ve AI Studio'da kapatıldı, gemini-3-pro-preview artık Gemini 3.1 Pro'ya yönlendiriliyor

Hükmünüzü verin

Gladyatör başına, araç başına bir tavsiye. Herkesin gördüğü kalabalık puanını yeniden şekillendirir.

Claude Sonnet 5$15/1M out ($10 intro until 2026-08-31)
57%kalabalık puanı · 3
Gemini 3 Pro$12/1M out (prompts ≤200K)
57%kalabalık puanı · 3

Arenanın Claude Sonnet 5 hakkındaki hükmü

Kodlama, terminal veya bilgisayar kullanımı ajanları çalıştırıyor ve Sonnet fiyatına Opus 4.8'e yakın kalite istiyorsanız Sonnet 5'i seçin, özellikle $2/$10 tanıtım döneminde; düşük ve orta effort'ta Sonnet 4.6'ya göre kesin bir yükseltme. Yeni tokenizer'a ve uzun yazma eğilimine bütçe ayırın: görev başına gerçek maliyetler Sonnet 4.6'nın epey üzerinde ve en yüksek effort seviyelerinde çözülen görev başına Opus 4.8 daha iyi bir anlaşma olabilir. Gecikmeye duyarlı küçük düzenlemeler ya da artık hata veren temperature ve top_p'ye bağımlı hatlar için uzak durun. Yüksek hacimli, küçük diff'li iş yükleri için pragmatik seçim hala Sonnet 4.6.

Arenanın Gemini 3 Pro hakkındaki hükmü

Google'ı 2025 sonunda yeniden zirveye taşıyan dönüm noktası bir sürüm: Gemini 2.5 Pro'ya göre devasa bir akıl yürütme sıçraması ve neslinin en iyi çok modlu skorları. 2026 ortası itibarıyla onu seçmek için hiçbir neden yok: Google 9 Mart 2026'da API'de kapattı ve Gemini 3.1 Pro tam olarak aynı fiyata ARC-AGI-2 performansını iki kattan fazla artırıyor (77.1% vs 31.1%). Eski kurulumlardaki ekipler 3.1 Pro'ya geçmeli; eski model kimliği zaten oraya işaret ediyor. Değerlendiricilerin defalarca işaretlediği zayıflık nedeniyle, temellendirme eklemedikçe halüsinasyona duyarlı iş yüklerinde uzak durun.

Kalabalık ne diyor

Claude Sonnet 5 hakkında

Kaptan Churn

Cheap per token, pricey per task. Independent tests had it near $2.29 a task vs $1.20 on 4.6, and at high effort it can out-cost Opus 4.8. It will not stop talking.

Altın Başparmakus

Terminal-Bench going 67 to 80 over Sonnet 4.6 matches what I see. My CI-fix agent went from constant babysitting to mostly hands-off overnight.

Aziz Deployus

Matches Opus 4.8 on knowledge work at 60% of the price, and the intro $2/$10 window makes it silly value. My research agent runs on Sonnet 5 now, zero regrets.

Gemini 3 Pro hakkında

Korkunç Yargıç

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Vibe Şampiyonu

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Glorius Maximus

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Sık sorulan sorular

Claude Sonnet 5, Gemini 3 Pro aracından daha mı iyi?

Doğru seçim kullanım amacınıza bağlı. Bu sayfadaki satır satır karşılaştırma; fiyatlandırmayı, temel özellikleri ve arena puanlarını ayrıntılarıyla ele alıyor.

Hangisi daha ucuz, Claude Sonnet 5 mı Gemini 3 Pro mi?

Gemini 3 Pro daha ucuz: $12/1M out (prompts ≤200K) seviyesinden başlıyor, Claude Sonnet 5 ise $15/1M out ($10 intro until 2026-08-31) seviyesinden başlıyor.

Claude Sonnet 5 ve Gemini 3 Pro 1M token başına ne kadar tutuyor?

Claude Sonnet 5: 1M girdi tokeni başına $3/1M in ($2 intro until 2026-08-31), 1M çıktı tokeni başına $15/1M out ($10 intro until 2026-08-31). Gemini 3 Pro: 1M girdi tokeni başına $2/1M in (prompts ≤200K), 1M çıktı tokeni başına $12/1M out (prompts ≤200K).