Birebir düello
Grok 4.3 vs Gemini 3 Pro: 2026'da hangi yapay zeka modeli kazanıyor?
Grok 4.3 ($2.50/1M out) ve Gemini 3 Pro ($12/1M out (prompts ≤200K)), 2026'nın en çok kullanılan yapay zeka modelleri arasında. 3 topluluk oyunda Gemini 3 Pro, %57 onayla önde.
Hızlı hüküm
Akıl yürütme tarafında Gemini 3 Pro seçin: arena onu Grok 4.3 için 4/5 puana karşı 4.5/5 olarak değerlendiriyor. Bütçe tarafında Grok 4.3 kazanıyor: Gemini 3 Pro için $12/1M out (prompts ≤200K) yerine $2.50/1M out seviyesinden başlıyor.
Satır satır karşılaştırma
Güçlü ve zayıf yönler
Grok 4.3
- Agresif fiyatlandırma: 1M token başına $1.25/$2.50, Grok 4'ten girdide %58, çıktıda %83 ucuz; GPT-5.5 ve Gemini 3.1 Pro'nun altında
- Büyük ajan sıçraması: Grok 4.20'ye göre GDPval-AA'da +321 Elo, güçlü araç çağırma ve talimat takibiyle
- Önbellekli girdi $0.20/1M (%84 indirim), tekrarlı ajan döngüleri için büyük tasarruf
- Tek modelde, tek fiyata yapılandırılabilir akıl yürütme effort'u (none/low/medium/high); hızlı ve derin varyantlar arasında yönlendirme yok
- HN'de doğal, özlü tonu ve gerçek dünya maliyetlerini düşüren token yoğun çıktıları övülüyor
- Saniyede yaklaşık 130 çıktı tokeni ile sağlam iş hacmi (Artificial Analysis)
- Kodlama akıl yürütmesi HN geliştiricilerince 'büyük Nisan sürümleriyle rekabetçi değil' diye değerlendirildi; zeka sınırı Grok 4'ten beri neredeyse yerinde saydı
- AA-Omniscience'ta halüsinasyonsuzluk skoru Grok 4.20'ye göre 8 puan düştü; hassasiyet kritik alanlarda 4.20 xAI'ın daha güvenli seçimi olmaya devam ediyor
- Yüksek ilk token süresi (Artificial Analysis'e göre yüksek akıl yürütme effort'unda ~13 sn), etkileşimli uygulamalar için can sıkıcı
- Bağlam penceresi Grok 4.20'nin 2M'sinden 1M'ye küçüldü
- Yinelenen güven ve güvenlik şikayetleri (zararlı içerik raporları, tutarsız davranış) ve tüketici uygulamasında MCP/bağlı uygulama desteği yok
Gemini 3 Pro
- Çıkışta rekor 1501 Elo ile LMArena'nın zirvesine oturdu ve GPQA Diamond'da 91.9% aldı, yayımlandığında son teknoloji
- ARC-AGI-2'de 31.1%, Gemini 2.5 Pro'nun (4.9%) kabaca 6 katı ve dönemin GPT-5.1'inin (17.6%) neredeyse iki katı
- Sınıfının en iyisi çok modlu anlama: 81% MMMU-Pro, 87.6% Video-MMMU, 1M token bağlam penceresiyle
- Güçlü ajan kodlama: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, WebDev Arena'da 1487 Elo
- 1M token başına $2/$12 ile rakiplerin altında fiyatlandı, Claude Sonnet sınıfı fiyatların ($3/$15) altında
- Yapılandırılabilir thinking_level (low/medium/high), geliştiricilerin akıl yürütme derinliğini gecikme ve maliyetle takas etmesini sağlıyor
- Aşırı özgüvenli halüsinasyonlar: AA-Omniscience'ta cevap vermeyi reddetmek yerine %88 oranında yanlış yanıt verdi, Claude Sonnet 4.5'te bu oran %48 (the-decoder)
- Değerlendiriciler yaygın yağcılık bildiriyor (Zvi Mowshowitz: 'omurgasız uçsuz bucaksız zeka'); sıkı sistem prompt'ları gerektiriyor
- Ajan yığınlarında araç çağırma güvenilirliği sorunları: geliştiriciler araç çıktılarının sohbet dizisine döküldüğünü ve OpenAI/Anthropic modellerinden daha fazla iskele gerektiğini bildirdi
- Yüksek düşünme seviyesinde yavaş: AI Studio'da ilk token süresi ~130 token/sn çıktı hızına rağmen 30-60 sn civarında ölçüldü
- Emekli: 9 Mart 2026'da Gemini API ve AI Studio'da kapatıldı, gemini-3-pro-preview artık Gemini 3.1 Pro'ya yönlendiriliyor
Hükmünüzü verin
Gladyatör başına, araç başına bir tavsiye. Herkesin gördüğü kalabalık puanını yeniden şekillendirir.
Arenanın Grok 4.3 hakkındaki hükmü
Çağrı başına maliyetin belirleyici olduğu ajan veya yüksek hacimli hatlar çalıştırıyorsanız Grok 4.3'ü seçin: GPT-5.5 veya Gemini 3.1 Pro fiyatının küçük bir bölümüne, sınıra yakın akıl yürütme ve Grok 4.20'ye göre büyük bir araç çağırma sıçraması sunuyor. Kodlama hassasiyeti önceliğinizse atlayın; geliştiriciler Claude'u ve büyük Nisan sürümlerini hala önde sıralıyor. Hukuk, tıp veya uyumluluk işleri için 2M bağlamına ya da daha iyi halüsinasyonsuzluk skoruna ihtiyacınız varsa Grok 4.20'de kalın. Gecikmeye duyarlı uygulamalar karar vermeden önce ~13 saniyelik ilk token süresini test etmeli.
Arenanın Gemini 3 Pro hakkındaki hükmü
Google'ı 2025 sonunda yeniden zirveye taşıyan dönüm noktası bir sürüm: Gemini 2.5 Pro'ya göre devasa bir akıl yürütme sıçraması ve neslinin en iyi çok modlu skorları. 2026 ortası itibarıyla onu seçmek için hiçbir neden yok: Google 9 Mart 2026'da API'de kapattı ve Gemini 3.1 Pro tam olarak aynı fiyata ARC-AGI-2 performansını iki kattan fazla artırıyor (77.1% vs 31.1%). Eski kurulumlardaki ekipler 3.1 Pro'ya geçmeli; eski model kimliği zaten oraya işaret ediyor. Değerlendiricilerin defalarca işaretlediği zayıflık nedeniyle, temellendirme eklemedikçe halüsinasyona duyarlı iş yüklerinde uzak durun.
Kalabalık ne diyor
Grok 4.3 hakkında
Henüz hüküm yok. İlk konuşan siz olun.
Gemini 3 Pro hakkında
“Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.”
“ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.”
“1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.”
Karşılaştırmaya devam edin
Sık sorulan sorular
Grok 4.3, Gemini 3 Pro aracından daha mı iyi?
Kalabalık şu anda Gemini 3 Pro tarafında: %57 tavsiye ediyor, Grok 4.3 için bu oran %50 (3 oy). Akıl yürütme tarafında Gemini 3 Pro daha yüksek puan alıyor (4.5/5 vs 4/5). Doğru seçim kullanım amacınıza bağlı. Bu sayfadaki satır satır karşılaştırma; fiyatlandırmayı, temel özellikleri ve arena puanlarını ayrıntılarıyla ele alıyor.
Hangisi daha ucuz, Grok 4.3 mı Gemini 3 Pro mi?
Grok 4.3 daha ucuz: $2.50/1M out seviyesinden başlıyor, Gemini 3 Pro ise $12/1M out (prompts ≤200K) seviyesinden başlıyor.
Grok 4.3 ve Gemini 3 Pro 1M token başına ne kadar tutuyor?
Grok 4.3: 1M girdi tokeni başına $1.25/1M in, 1M çıktı tokeni başına $2.50/1M out. Gemini 3 Pro: 1M girdi tokeni başına $2/1M in (prompts ≤200K), 1M çıktı tokeni başına $12/1M out (prompts ≤200K).