Birebir düello

Gemini 3 Pro logosuvsClaude Fable 5 logosu

Gemini 3 Pro vs Claude Fable 5: 2026'da hangi yapay zeka modeli kazanıyor?

Gemini 3 Pro ($12/1M out (prompts ≤200K)) ve Claude Fable 5 ($50/1M out), 2026'nın en çok kullanılan yapay zeka modelleri arasında. 7 topluluk oyunda Claude Fable 5, %63 onayla önde.

Hızlı hüküm

Akıl yürütme tarafında Claude Fable 5 seçin: arena onu Gemini 3 Pro için 4.5/5 puana karşı 5/5 olarak değerlendiriyor. Bütçe tarafında Gemini 3 Pro kazanıyor: Claude Fable 5 için $50/1M out yerine $12/1M out (prompts ≤200K) seviyesinden başlıyor.

Satır satır karşılaştırma

Başlangıç
$12/1M out (prompts ≤200K)Standart katman: ≤200K prompt'lar için 1M token başına $2/$12, 200K üzeri $4/$18; batch %50 indirimli. 9 Mart 2026'da emekliye ayrıldı, halefi Gemini 3.1 Pro aynı fiyatı koruyor.
$50/1M outclaude-fable-5 için resmi Anthropic API liste fiyatı: $10/1M girdi, $50/1M çıktı, varsayılan 1M bağlamlı tek katman (uzun bağlam ek ücreti yok), 128K maks. çıktı; herhangi bir çıktı üretilmeden reddedilen istekler faturalanmıyor. platform.claude.com'a (Introducing Claude Fable 5) göre 2026-07'de doğrulandı.
Sağlayıcı
Google (DeepMind)
Anthropic
Bağlam penceresi
1M tokens (64K output)
1M tokens
Girdi fiyatı
$2/1M in (prompts ≤200K)
$10/1M in
Çıktı fiyatı
$12/1M out (prompts ≤200K)
$50/1M out
Modaliteler
text, image, audio, video in; text out
text, vision
Open weights
Hayır
Hayır
Kalabalık puanı
57%(3)
63%(4)
Arena puanları (1-5)
Akıl yürütme
4.5
5.0
Kodlama
4.5
5.0
Yazarlık
3.5
4.5
Hız
3.5
2.0
Fiyat/performans
4.0
3.0

Güçlü ve zayıf yönler

Gemini 3 Pro

  • Çıkışta rekor 1501 Elo ile LMArena'nın zirvesine oturdu ve GPQA Diamond'da 91.9% aldı, yayımlandığında son teknoloji
  • ARC-AGI-2'de 31.1%, Gemini 2.5 Pro'nun (4.9%) kabaca 6 katı ve dönemin GPT-5.1'inin (17.6%) neredeyse iki katı
  • Sınıfının en iyisi çok modlu anlama: 81% MMMU-Pro, 87.6% Video-MMMU, 1M token bağlam penceresiyle
  • Güçlü ajan kodlama: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, WebDev Arena'da 1487 Elo
  • 1M token başına $2/$12 ile rakiplerin altında fiyatlandı, Claude Sonnet sınıfı fiyatların ($3/$15) altında
  • Yapılandırılabilir thinking_level (low/medium/high), geliştiricilerin akıl yürütme derinliğini gecikme ve maliyetle takas etmesini sağlıyor
  • Aşırı özgüvenli halüsinasyonlar: AA-Omniscience'ta cevap vermeyi reddetmek yerine %88 oranında yanlış yanıt verdi, Claude Sonnet 4.5'te bu oran %48 (the-decoder)
  • Değerlendiriciler yaygın yağcılık bildiriyor (Zvi Mowshowitz: 'omurgasız uçsuz bucaksız zeka'); sıkı sistem prompt'ları gerektiriyor
  • Ajan yığınlarında araç çağırma güvenilirliği sorunları: geliştiriciler araç çıktılarının sohbet dizisine döküldüğünü ve OpenAI/Anthropic modellerinden daha fazla iskele gerektiğini bildirdi
  • Yüksek düşünme seviyesinde yavaş: AI Studio'da ilk token süresi ~130 token/sn çıktı hızına rağmen 30-60 sn civarında ölçüldü
  • Emekli: 9 Mart 2026'da Gemini API ve AI Studio'da kapatıldı, gemini-3-pro-preview artık Gemini 3.1 Pro'ya yönlendiriliyor

Claude Fable 5

  • SWE-bench Pro'da 80.3%, Opus 4.8'in 69.2%, GPT-5.5'in 58.6% ve Gemini 3.1 Pro'nun 54.2%'sine karşı; en yakın sınır modelin kabaca 11 puan önünde
  • SWE-bench Verified'da 95.0% (Opus 4.8: 88.6%, GPT-5.5: 82.6%) ve Cognition'ın FrontierCode Diamond diliminde 29.3%, Opus 4.8'in 13.4%'ünün iki katından fazla
  • Asıl hikaye uzun soluklu otonomi: Stripe, 50 milyon satırlık bir Ruby kod tabanı taşımasının 2+ ay yerine bir günde bittiğini bildirdi; Cursor'ın CEO'su CursorBench'te son teknoloji olduğunu söylüyor
  • Saha raporları benchmark'larla örtüşüyor: HN mühendisleri 'gerçek bir mühendis gibi' çalıştığını anlatıyor (asgari müdahaleyle CRDT'ler, kendi fuzzer'larını yazması, 46 kat bellek tahsisi azaltımı), Simon Willison tek oturumda 'birkaç günlük iş' ölçtü
  • Varsayılan olarak 1M token bağlam penceresi artı 128K çıktı ve yoğun belgelerde son teknoloji görü (GDP.pdf'te 29.8%, GPT-5.5'te 24.9%, Opus 4.8'de 22.5%)
  • Çıktı öncesi reddedilen istekler faturalanmıyor ve sunucu tarafında Opus 4.8'e yedek geçiş, yedekleme kredisiyle birlikte API'ye yerleşik
  • Opus 4.8'in iki katı fiyat ($10/$50 vs $5/$25) ve yavaş: zor görevlerde tek istekler rutin olarak dakikalarca sürüyor, Simon Willison açıkça 'yavaş, pahalı' diyor
  • Çift kullanım güvenlik sınıflandırıcıları meşru işlerde yanlış alarm veriyor: bir medikal fizikçi, akışkanlar dinamiği problemlerinin ve MRI segmentasyon kodunun biyogüvenlik riski diye reddedildiğini, isteklerin sessizce Opus 4.8'e yönlendirildiğini bildirdi (viral HN başlığı: 'Claude Fable size yardım etmeyi bırakırsa bunu asla bilemezsiniz'; Anthropic oturumların %5'inden azı diyor)
  • Sancılı bir çıkış: ABD ihracat kontrolleri Anthropic'i, çıkıştan üç gün sonra, 12-30 Haziran 2026 arasında erişimi dünya çapında askıya almaya zorladı; tam geri dönüş ancak 1 Temmuz'da
  • 30 günlük veri saklama gerektiriyor ve sıfır veri saklama altında sunulmuyor, katı uyumluluk kuruluşları için kesin engel; ayrıca düşünme kapatılamıyor, ham düşünce zinciri asla döndürülmüyor, assistant prefill 400 döndürüyor
  • Her alanda son teknoloji değil: ARC-AGI-2'de GPT-5.5 hala önde (85.0% vs 77.1%) ve Andon Labs, engelsiz Mythos 5'in Vending-Bench'te hem Opus 4.7'nin hem GPT-5.5'in altında kaldığını, akıl yürütmesinin gerçek zarardan çok tespit edilebilirliğe göre optimize ettiğini buldu

Hükmünüzü verin

Gladyatör başına, araç başına bir tavsiye. Herkesin gördüğü kalabalık puanını yeniden şekillendirir.

Gemini 3 Pro$12/1M out (prompts ≤200K)
57%kalabalık puanı · 3
Claude Fable 5$50/1M out
63%kalabalık puanı · 4

Arenanın Gemini 3 Pro hakkındaki hükmü

Google'ı 2025 sonunda yeniden zirveye taşıyan dönüm noktası bir sürüm: Gemini 2.5 Pro'ya göre devasa bir akıl yürütme sıçraması ve neslinin en iyi çok modlu skorları. 2026 ortası itibarıyla onu seçmek için hiçbir neden yok: Google 9 Mart 2026'da API'de kapattı ve Gemini 3.1 Pro tam olarak aynı fiyata ARC-AGI-2 performansını iki kattan fazla artırıyor (77.1% vs 31.1%). Eski kurulumlardaki ekipler 3.1 Pro'ya geçmeli; eski model kimliği zaten oraya işaret ediyor. Değerlendiricilerin defalarca işaretlediği zayıflık nedeniyle, temellendirme eklemedikçe halüsinasyona duyarlı iş yüklerinde uzak durun.

Arenanın Claude Fable 5 hakkındaki hükmü

İş yükünüz gerçekten uzun solukluysa Claude Fable 5'i alın: gece boyu süren ajan koşuları, dev taşımalar, birkaç saatlik tek oturumun günlerce denetimli işin yerini aldığı görevler. Orada Opus 4.8'e göre 2 kat prim, görev sıkıştırmasıyla kendini amorti ediyor ve benchmark'lar (SWE-bench Pro'da 80.3%, sahadan 11 puan önde) Stripe ve Cursor'daki gerçek dağıtımlarla destekleniyor. Etkileşimli kodlama ve günlük işler için Opus 4.8'de kalın: yarı fiyata SWE-bench Verified'da 88.6%, sınıflandırıcı yanlış alarmı yok, daha hızlı turlar. Maliyete duyarlı ekipler $3/$15 fiyatlı Sonnet 5'ten Opus'a yakın kodlama alır (Ağustos 2026'ya kadar tanıtım fiyatı $2/$10). Kuruluşunuz sıfır veri saklama gerektiriyorsa ya da biyoloji, medikal görüntüleme veya güvenlik araçlarına yakın çalışıyorsanız Fable 5'ten tamamen uzak durun; çift kullanım sınıflandırıcıları hala yanlış pozitif üretiyor ve oturum ortasında sessizce Opus 4.8'i devreye sokuyor.

Kalabalık ne diyor

Gemini 3 Pro hakkında

Korkunç Yargıç

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Vibe Şampiyonu

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Glorius Maximus

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Claude Fable 5 hakkında

Başparmak Aşağıcus

I do medical imaging research and the bio classifier keeps flagging my MRI segmentation prompts, then it silently falls back to Opus 4.8 mid-session. At $50 per million output tokens I expect to at least know which model actually answered me.

Glorius Maximus

Yes it's 2x the price of Opus and yes the turns are slow. But one overnight Fable run replaced what used to be a week of supervising shorter runs. On a per-task basis it's actually the cheapest model we use.

Altın Başparmakus

The 1M context is real, not marketing. I fed it our entire service mesh config plus six months of incident postmortems and it traced a flaky timeout to a retry policy nobody remembered writing. Opus 4.8 never connected those dots.

Aziz Deployus

Gave it a monorepo migration that Opus 4.8 kept stalling on. It ran for about 40 minutes, came back with the whole thing done plus a test harness it wrote for itself. Felt like reviewing a senior engineer's PR, not babysitting a chatbot.

Sık sorulan sorular

Gemini 3 Pro, Claude Fable 5 aracından daha mı iyi?

Kalabalık şu anda Claude Fable 5 tarafında: %63 tavsiye ediyor, Gemini 3 Pro için bu oran %57 (7 oy). Akıl yürütme tarafında Claude Fable 5 daha yüksek puan alıyor (5/5 vs 4.5/5). Doğru seçim kullanım amacınıza bağlı. Bu sayfadaki satır satır karşılaştırma; fiyatlandırmayı, temel özellikleri ve arena puanlarını ayrıntılarıyla ele alıyor.

Hangisi daha ucuz, Gemini 3 Pro mı Claude Fable 5 mi?

Gemini 3 Pro daha ucuz: $12/1M out (prompts ≤200K) seviyesinden başlıyor, Claude Fable 5 ise $50/1M out seviyesinden başlıyor.

Gemini 3 Pro ve Claude Fable 5 1M token başına ne kadar tutuyor?

Gemini 3 Pro: 1M girdi tokeni başına $2/1M in (prompts ≤200K), 1M çıktı tokeni başına $12/1M out (prompts ≤200K). Claude Fable 5: 1M girdi tokeni başına $10/1M in, 1M çıktı tokeni başına $50/1M out.