Arena · yapay zeka modeli incelemesi
Gemini 3 Pro
Google tarafından
Google'ın Kasım 2025 sınır modeli: 1M bağlam, LMArena'da 1500 Elo'yu aşan ilk model, yerini Gemini 3.1 Pro aldı.
$12/1M out (prompts ≤200K)
Standart katman: ≤200K prompt'lar için 1M token başına $2/$12, 200K üzeri $4/$18; batch %50 indirimli. 9 Mart 2026'da emekliye ayrıldı, halefi Gemini 3.1 Pro aynı fiyatı koruyor.
Google (DeepMind)
1M tokens (64K output)
$2/1M in (prompts ≤200K)
$12/1M out (prompts ≤200K)
text, image, audio, video in; text out
Hayır
Gemini 3 Pro nedir?
Google DeepMind'ın 18 Kasım 2025'te yayımladığı sınır akıl yürütme modeli. LMArena'da 1500 Elo'yu aşan ilk model; 1M token bağlam penceresi ve yerleşik metin, görsel, ses ve video anlama. 9 Mart 2026'da aynı fiyattaki Gemini 3.1 Pro lehine emekliye ayrıldı.
Gemini 3 Pro artıları ve eksileri
Artılar
- Çıkışta rekor 1501 Elo ile LMArena'nın zirvesine oturdu ve GPQA Diamond'da 91.9% aldı, yayımlandığında son teknoloji
- ARC-AGI-2'de 31.1%, Gemini 2.5 Pro'nun (4.9%) kabaca 6 katı ve dönemin GPT-5.1'inin (17.6%) neredeyse iki katı
- Sınıfının en iyisi çok modlu anlama: 81% MMMU-Pro, 87.6% Video-MMMU, 1M token bağlam penceresiyle
- Güçlü ajan kodlama: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, WebDev Arena'da 1487 Elo
- 1M token başına $2/$12 ile rakiplerin altında fiyatlandı, Claude Sonnet sınıfı fiyatların ($3/$15) altında
- Yapılandırılabilir thinking_level (low/medium/high), geliştiricilerin akıl yürütme derinliğini gecikme ve maliyetle takas etmesini sağlıyor
Eksiler
- Aşırı özgüvenli halüsinasyonlar: AA-Omniscience'ta cevap vermeyi reddetmek yerine %88 oranında yanlış yanıt verdi, Claude Sonnet 4.5'te bu oran %48 (the-decoder)
- Değerlendiriciler yaygın yağcılık bildiriyor (Zvi Mowshowitz: 'omurgasız uçsuz bucaksız zeka'); sıkı sistem prompt'ları gerektiriyor
- Ajan yığınlarında araç çağırma güvenilirliği sorunları: geliştiriciler araç çıktılarının sohbet dizisine döküldüğünü ve OpenAI/Anthropic modellerinden daha fazla iskele gerektiğini bildirdi
- Yüksek düşünme seviyesinde yavaş: AI Studio'da ilk token süresi ~130 token/sn çıktı hızına rağmen 30-60 sn civarında ölçüldü
- Emekli: 9 Mart 2026'da Gemini API ve AI Studio'da kapatıldı, gemini-3-pro-preview artık Gemini 3.1 Pro'ya yönlendiriliyor
Arenanın hükmü
Google'ı 2025 sonunda yeniden zirveye taşıyan dönüm noktası bir sürüm: Gemini 2.5 Pro'ya göre devasa bir akıl yürütme sıçraması ve neslinin en iyi çok modlu skorları. 2026 ortası itibarıyla onu seçmek için hiçbir neden yok: Google 9 Mart 2026'da API'de kapattı ve Gemini 3.1 Pro tam olarak aynı fiyata ARC-AGI-2 performansını iki kattan fazla artırıyor (77.1% vs 31.1%). Eski kurulumlardaki ekipler 3.1 Pro'ya geçmeli; eski model kimliği zaten oraya işaret ediyor. Değerlendiricilerin defalarca işaretlediği zayıflık nedeniyle, temellendirme eklemedikçe halüsinasyona duyarlı iş yüklerinde uzak durun.
Başparmak yukarı ya da aşağı
Hükmünüzü verin
Gemini 3 Pro aracını tavsiye eder misiniz, yoksa kalabalığı uyarır mısınız?
En iyi Gemini 3 Pro alternatifleri
Tüm alternatiflerAnthropic'in en hızlı modeli: Sonnet 4.5'in kodlama becerisinin yaklaşık %90'ı, 1M token başına $1/$5, 200K bağlam.
Anthropic'in Haziran 2026 Mythos sınıfı amiral gemisi: SWE-bench Pro'da 80.3%, diğer tüm sınır modellerden 11 puan önde
Anthropic'in Nisan 2026 Opus modeli: 87.6% SWE-bench Verified, 1M bağlam, yüksek çözünürlüklü görü, artık Opus 4.8'in gerisinde
Gemini 3 Pro birebir karşılaştırmaları
Kalabalık ne diyor
“Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.”
“ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.”
“1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.”
Gemini 3 Pro: sık sorulan sorular
Gemini 3 Pro 1M token başına ne kadar tutuyor?
Gemini 3 Pro, 1M girdi tokeni başına $2/1M in (prompts ≤200K) ve 1M çıktı tokeni başına $12/1M out (prompts ≤200K) tutuyor. Standart katman: ≤200K prompt'lar için 1M token başına $2/$12, 200K üzeri $4/$18; batch %50 indirimli. 9 Mart 2026'da emekliye ayrıldı, halefi Gemini 3.1 Pro aynı fiyatı koruyor.