Arena · yapay zeka modeli incelemesi

Gemini 3 Pro

Google tarafından

Google'ın Kasım 2025 sınır modeli: 1M bağlam, LMArena'da 1500 Elo'yu aşan ilk model, yerini Gemini 3.1 Pro aldı.

Arena puanı 4/5%57 tavsiye · 3 oy
Akıl yürütme4.5
Kodlama4.5
Yazarlık3.5
Hız3.5
Fiyat/performans4.0
Gemini 3 Pro sitesini ziyaret etçok modlu analiz (video/ses/görsel)uzun bağlamlı akıl yürütmeajan tabanlı kodlamamatematik ve bilim akıl yürütmesi
Fiyat

$12/1M out (prompts ≤200K)

Standart katman: ≤200K prompt'lar için 1M token başına $2/$12, 200K üzeri $4/$18; batch %50 indirimli. 9 Mart 2026'da emekliye ayrıldı, halefi Gemini 3.1 Pro aynı fiyatı koruyor.

Sağlayıcı

Google (DeepMind)

Bağlam penceresi

1M tokens (64K output)

Girdi fiyatı

$2/1M in (prompts ≤200K)

Çıktı fiyatı

$12/1M out (prompts ≤200K)

Modaliteler

text, image, audio, video in; text out

Open weights

Hayır

Gemini 3 Pro nedir?

Google DeepMind'ın 18 Kasım 2025'te yayımladığı sınır akıl yürütme modeli. LMArena'da 1500 Elo'yu aşan ilk model; 1M token bağlam penceresi ve yerleşik metin, görsel, ses ve video anlama. 9 Mart 2026'da aynı fiyattaki Gemini 3.1 Pro lehine emekliye ayrıldı.

Gemini 3 Pro artıları ve eksileri

Artılar

  • Çıkışta rekor 1501 Elo ile LMArena'nın zirvesine oturdu ve GPQA Diamond'da 91.9% aldı, yayımlandığında son teknoloji
  • ARC-AGI-2'de 31.1%, Gemini 2.5 Pro'nun (4.9%) kabaca 6 katı ve dönemin GPT-5.1'inin (17.6%) neredeyse iki katı
  • Sınıfının en iyisi çok modlu anlama: 81% MMMU-Pro, 87.6% Video-MMMU, 1M token bağlam penceresiyle
  • Güçlü ajan kodlama: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, WebDev Arena'da 1487 Elo
  • 1M token başına $2/$12 ile rakiplerin altında fiyatlandı, Claude Sonnet sınıfı fiyatların ($3/$15) altında
  • Yapılandırılabilir thinking_level (low/medium/high), geliştiricilerin akıl yürütme derinliğini gecikme ve maliyetle takas etmesini sağlıyor

Eksiler

  • Aşırı özgüvenli halüsinasyonlar: AA-Omniscience'ta cevap vermeyi reddetmek yerine %88 oranında yanlış yanıt verdi, Claude Sonnet 4.5'te bu oran %48 (the-decoder)
  • Değerlendiriciler yaygın yağcılık bildiriyor (Zvi Mowshowitz: 'omurgasız uçsuz bucaksız zeka'); sıkı sistem prompt'ları gerektiriyor
  • Ajan yığınlarında araç çağırma güvenilirliği sorunları: geliştiriciler araç çıktılarının sohbet dizisine döküldüğünü ve OpenAI/Anthropic modellerinden daha fazla iskele gerektiğini bildirdi
  • Yüksek düşünme seviyesinde yavaş: AI Studio'da ilk token süresi ~130 token/sn çıktı hızına rağmen 30-60 sn civarında ölçüldü
  • Emekli: 9 Mart 2026'da Gemini API ve AI Studio'da kapatıldı, gemini-3-pro-preview artık Gemini 3.1 Pro'ya yönlendiriliyor

Arenanın hükmü

Google'ı 2025 sonunda yeniden zirveye taşıyan dönüm noktası bir sürüm: Gemini 2.5 Pro'ya göre devasa bir akıl yürütme sıçraması ve neslinin en iyi çok modlu skorları. 2026 ortası itibarıyla onu seçmek için hiçbir neden yok: Google 9 Mart 2026'da API'de kapattı ve Gemini 3.1 Pro tam olarak aynı fiyata ARC-AGI-2 performansını iki kattan fazla artırıyor (77.1% vs 31.1%). Eski kurulumlardaki ekipler 3.1 Pro'ya geçmeli; eski model kimliği zaten oraya işaret ediyor. Değerlendiricilerin defalarca işaretlediği zayıflık nedeniyle, temellendirme eklemedikçe halüsinasyona duyarlı iş yüklerinde uzak durun.

Başparmak yukarı ya da aşağı

Hükmünüzü verin

Gemini 3 Pro aracını tavsiye eder misiniz, yoksa kalabalığı uyarır mısınız?

57%kalabalık puanı · 3

En iyi Gemini 3 Pro alternatifleri

Tüm alternatifler
1
Claude Haiku 4.5

Anthropic'in en hızlı modeli: Sonnet 4.5'in kodlama becerisinin yaklaşık %90'ı, 1M token başına $1/$5, 200K bağlam.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropic'in Haziran 2026 Mythos sınıfı amiral gemisi: SWE-bench Pro'da 80.3%, diğer tüm sınır modellerden 11 puan önde

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropic'in Nisan 2026 Opus modeli: 87.6% SWE-bench Verified, 1M bağlam, yüksek çözünürlüklü görü, artık Opus 4.8'in gerisinde

$25/1M out57%(3)
Visit

Gemini 3 Pro birebir karşılaştırmaları

Kalabalık ne diyor

Korkunç Yargıç

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Vibe Şampiyonu

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Glorius Maximus

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Gemini 3 Pro: sık sorulan sorular

Gemini 3 Pro 1M token başına ne kadar tutuyor?

Gemini 3 Pro, 1M girdi tokeni başına $2/1M in (prompts ≤200K) ve 1M çıktı tokeni başına $12/1M out (prompts ≤200K) tutuyor. Standart katman: ≤200K prompt'lar için 1M token başına $2/$12, 200K üzeri $4/$18; batch %50 indirimli. 9 Mart 2026'da emekliye ayrıldı, halefi Gemini 3.1 Pro aynı fiyatı koruyor.