Birebir düello

Grok 4.3 logosuvsGemini 3 Pro logosu

Grok 4.3 vs Gemini 3 Pro: 2026'da hangi yapay zeka modeli kazanıyor?

Grok 4.3 ($2.50/1M out) ve Gemini 3 Pro ($12/1M out (prompts ≤200K)), 2026'nın en çok kullanılan yapay zeka modelleri arasında. 3 topluluk oyunda Gemini 3 Pro, %57 onayla önde.

Hızlı hüküm

Akıl yürütme tarafında Gemini 3 Pro seçin: arena onu Grok 4.3 için 4/5 puana karşı 4.5/5 olarak değerlendiriyor. Bütçe tarafında Grok 4.3 kazanıyor: Gemini 3 Pro için $12/1M out (prompts ≤200K) yerine $2.50/1M out seviyesinden başlıyor.

Satır satır karşılaştırma

Başlangıç
$2.50/1M outTüm akıl yürütme effort katmanlarında sabit $1.25 girdi / $2.50 çıktı; önbellekli girdi $0.20/1M. xAI'ın kendi fiyat sayfası uzun bağlam ek ücreti göstermiyor, ancak OpenRouter 200K toplam token üzerinde kademeli daha yüksek tarifeler listeliyor.
$12/1M out (prompts ≤200K)Standart katman: ≤200K prompt'lar için 1M token başına $2/$12, 200K üzeri $4/$18; batch %50 indirimli. 9 Mart 2026'da emekliye ayrıldı, halefi Gemini 3.1 Pro aynı fiyatı koruyor.
Sağlayıcı
xAI
Google (DeepMind)
Bağlam penceresi
1M tokens
1M tokens (64K output)
Girdi fiyatı
$1.25/1M in
$2/1M in (prompts ≤200K)
Çıktı fiyatı
$2.50/1M out
$12/1M out (prompts ≤200K)
Modaliteler
text, vision (text output only)
text, image, audio, video in; text out
Open weights
Hayır
Hayır
Kalabalık puanı
50%(0)
57%(3)
Arena puanları (1-5)
Akıl yürütme
4.0
4.5
Kodlama
3.5
4.5
Yazarlık
4.5
3.5
Hız
3.5
3.5
Fiyat/performans
4.5
4.0

Güçlü ve zayıf yönler

Grok 4.3

  • Agresif fiyatlandırma: 1M token başına $1.25/$2.50, Grok 4'ten girdide %58, çıktıda %83 ucuz; GPT-5.5 ve Gemini 3.1 Pro'nun altında
  • Büyük ajan sıçraması: Grok 4.20'ye göre GDPval-AA'da +321 Elo, güçlü araç çağırma ve talimat takibiyle
  • Önbellekli girdi $0.20/1M (%84 indirim), tekrarlı ajan döngüleri için büyük tasarruf
  • Tek modelde, tek fiyata yapılandırılabilir akıl yürütme effort'u (none/low/medium/high); hızlı ve derin varyantlar arasında yönlendirme yok
  • HN'de doğal, özlü tonu ve gerçek dünya maliyetlerini düşüren token yoğun çıktıları övülüyor
  • Saniyede yaklaşık 130 çıktı tokeni ile sağlam iş hacmi (Artificial Analysis)
  • Kodlama akıl yürütmesi HN geliştiricilerince 'büyük Nisan sürümleriyle rekabetçi değil' diye değerlendirildi; zeka sınırı Grok 4'ten beri neredeyse yerinde saydı
  • AA-Omniscience'ta halüsinasyonsuzluk skoru Grok 4.20'ye göre 8 puan düştü; hassasiyet kritik alanlarda 4.20 xAI'ın daha güvenli seçimi olmaya devam ediyor
  • Yüksek ilk token süresi (Artificial Analysis'e göre yüksek akıl yürütme effort'unda ~13 sn), etkileşimli uygulamalar için can sıkıcı
  • Bağlam penceresi Grok 4.20'nin 2M'sinden 1M'ye küçüldü
  • Yinelenen güven ve güvenlik şikayetleri (zararlı içerik raporları, tutarsız davranış) ve tüketici uygulamasında MCP/bağlı uygulama desteği yok

Gemini 3 Pro

  • Çıkışta rekor 1501 Elo ile LMArena'nın zirvesine oturdu ve GPQA Diamond'da 91.9% aldı, yayımlandığında son teknoloji
  • ARC-AGI-2'de 31.1%, Gemini 2.5 Pro'nun (4.9%) kabaca 6 katı ve dönemin GPT-5.1'inin (17.6%) neredeyse iki katı
  • Sınıfının en iyisi çok modlu anlama: 81% MMMU-Pro, 87.6% Video-MMMU, 1M token bağlam penceresiyle
  • Güçlü ajan kodlama: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, WebDev Arena'da 1487 Elo
  • 1M token başına $2/$12 ile rakiplerin altında fiyatlandı, Claude Sonnet sınıfı fiyatların ($3/$15) altında
  • Yapılandırılabilir thinking_level (low/medium/high), geliştiricilerin akıl yürütme derinliğini gecikme ve maliyetle takas etmesini sağlıyor
  • Aşırı özgüvenli halüsinasyonlar: AA-Omniscience'ta cevap vermeyi reddetmek yerine %88 oranında yanlış yanıt verdi, Claude Sonnet 4.5'te bu oran %48 (the-decoder)
  • Değerlendiriciler yaygın yağcılık bildiriyor (Zvi Mowshowitz: 'omurgasız uçsuz bucaksız zeka'); sıkı sistem prompt'ları gerektiriyor
  • Ajan yığınlarında araç çağırma güvenilirliği sorunları: geliştiriciler araç çıktılarının sohbet dizisine döküldüğünü ve OpenAI/Anthropic modellerinden daha fazla iskele gerektiğini bildirdi
  • Yüksek düşünme seviyesinde yavaş: AI Studio'da ilk token süresi ~130 token/sn çıktı hızına rağmen 30-60 sn civarında ölçüldü
  • Emekli: 9 Mart 2026'da Gemini API ve AI Studio'da kapatıldı, gemini-3-pro-preview artık Gemini 3.1 Pro'ya yönlendiriliyor

Hükmünüzü verin

Gladyatör başına, araç başına bir tavsiye. Herkesin gördüğü kalabalık puanını yeniden şekillendirir.

Grok 4.3$2.50/1M out
50%kalabalık puanı · 0
Gemini 3 Pro$12/1M out (prompts ≤200K)
57%kalabalık puanı · 3

Arenanın Grok 4.3 hakkındaki hükmü

Çağrı başına maliyetin belirleyici olduğu ajan veya yüksek hacimli hatlar çalıştırıyorsanız Grok 4.3'ü seçin: GPT-5.5 veya Gemini 3.1 Pro fiyatının küçük bir bölümüne, sınıra yakın akıl yürütme ve Grok 4.20'ye göre büyük bir araç çağırma sıçraması sunuyor. Kodlama hassasiyeti önceliğinizse atlayın; geliştiriciler Claude'u ve büyük Nisan sürümlerini hala önde sıralıyor. Hukuk, tıp veya uyumluluk işleri için 2M bağlamına ya da daha iyi halüsinasyonsuzluk skoruna ihtiyacınız varsa Grok 4.20'de kalın. Gecikmeye duyarlı uygulamalar karar vermeden önce ~13 saniyelik ilk token süresini test etmeli.

Arenanın Gemini 3 Pro hakkındaki hükmü

Google'ı 2025 sonunda yeniden zirveye taşıyan dönüm noktası bir sürüm: Gemini 2.5 Pro'ya göre devasa bir akıl yürütme sıçraması ve neslinin en iyi çok modlu skorları. 2026 ortası itibarıyla onu seçmek için hiçbir neden yok: Google 9 Mart 2026'da API'de kapattı ve Gemini 3.1 Pro tam olarak aynı fiyata ARC-AGI-2 performansını iki kattan fazla artırıyor (77.1% vs 31.1%). Eski kurulumlardaki ekipler 3.1 Pro'ya geçmeli; eski model kimliği zaten oraya işaret ediyor. Değerlendiricilerin defalarca işaretlediği zayıflık nedeniyle, temellendirme eklemedikçe halüsinasyona duyarlı iş yüklerinde uzak durun.

Kalabalık ne diyor

Grok 4.3 hakkında

Henüz hüküm yok. İlk konuşan siz olun.

Gemini 3 Pro hakkında

Korkunç Yargıç

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Vibe Şampiyonu

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Glorius Maximus

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Sık sorulan sorular

Grok 4.3, Gemini 3 Pro aracından daha mı iyi?

Kalabalık şu anda Gemini 3 Pro tarafında: %57 tavsiye ediyor, Grok 4.3 için bu oran %50 (3 oy). Akıl yürütme tarafında Gemini 3 Pro daha yüksek puan alıyor (4.5/5 vs 4/5). Doğru seçim kullanım amacınıza bağlı. Bu sayfadaki satır satır karşılaştırma; fiyatlandırmayı, temel özellikleri ve arena puanlarını ayrıntılarıyla ele alıyor.

Hangisi daha ucuz, Grok 4.3 mı Gemini 3 Pro mi?

Grok 4.3 daha ucuz: $2.50/1M out seviyesinden başlıyor, Gemini 3 Pro ise $12/1M out (prompts ≤200K) seviyesinden başlıyor.

Grok 4.3 ve Gemini 3 Pro 1M token başına ne kadar tutuyor?

Grok 4.3: 1M girdi tokeni başına $1.25/1M in, 1M çıktı tokeni başına $2.50/1M out. Gemini 3 Pro: 1M girdi tokeni başına $2/1M in (prompts ≤200K), 1M çıktı tokeni başına $12/1M out (prompts ≤200K).