Arena · Review model AI

Gemini 3 Pro

oleh Google

Model frontier Google edisi Nov 2025: context 1M, yang pertama melewati 1500 Elo di LMArena, digantikan oleh Gemini 3.1 Pro.

Skor arena 4/557% merekomendasikan · 3 suara
Penalaran4.5
Coding4.5
Menulis3.5
Kecepatan3.5
Nilai4.0
Kunjungi Gemini 3 Proanalisis multimodal (video/audio/gambar)penalaran long-contextcoding agentikpenalaran matematika dan sains
Harga

$12/1M out (prompts ≤200K)

Tarif standar: $2/$12 per 1M tokens untuk prompt ≤200K, $4/$18 di atas 200K; batch diskon 50%. Dipensiunkan 9 Maret 2026, penerusnya Gemini 3.1 Pro mempertahankan harga identik.

Penyedia

Google (DeepMind)

Context window

1M tokens (64K output)

Harga input

$2/1M in (prompts ≤200K)

Harga output

$12/1M out (prompts ≤200K)

Modalitas

text, image, audio, video in; text out

Open weights

Tidak

Apa itu Gemini 3 Pro?

Model reasoning frontier dari Google DeepMind, dirilis 18 November 2025. Model pertama yang menembus 1500 Elo di LMArena, dengan context window 1M token dan pemahaman natif teks, gambar, audio, dan video. Dipensiunkan 9 Maret 2026 demi Gemini 3.1 Pro dengan harga yang sama.

Kelebihan & kekurangan Gemini 3 Pro

Kelebihan

  • Memuncaki LMArena saat peluncuran dengan rekor 1501 Elo dan mencetak 91.9% di GPQA Diamond, state of the art saat rilis
  • ARC-AGI-2 di 31.1%, kira-kira 6x Gemini 2.5 Pro (4.9%) dan hampir dua kali lipat GPT-5.1 (17.6%) pada masanya
  • Pemahaman multimodal terbaik di kelasnya: 81% MMMU-Pro, 87.6% Video-MMMU, dengan context window 1M token
  • Coding agentik kuat: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, 1487 Elo di WebDev Arena
  • Memotong harga pesaing di $2/$12 per 1M tokens, di bawah harga kelas Claude Sonnet ($3/$15)
  • thinking_level yang bisa dikonfigurasi (low/medium/high) memungkinkan developer menukar kedalaman penalaran dengan latensi dan biaya

Kekurangan

  • Halusinasi yang terlalu percaya diri: di AA-Omniscience ia memberi jawaban salah 88% dari waktu alih-alih menolak menjawab, vs 48% untuk Claude Sonnet 4.5 (the-decoder)
  • Sifat menjilat yang banyak dilaporkan reviewer (Zvi Mowshowitz: 'kecerdasan luas tanpa tulang punggung'); butuh system prompt yang ketat
  • Masalah keandalan tool-calling di stack agen: developer melaporkan output tool tumpah ke utas chat dan butuh lebih banyak scaffolding dibanding model OpenAI/Anthropic
  • Lambat pada thinking level tinggi: time to first token terukur sekitar 30-60s di AI Studio meski kecepatan output sekitar 130 tok/s
  • Sudah dipensiunkan: dimatikan di Gemini API dan AI Studio pada 9 Maret 2026, dengan gemini-3-pro-preview kini dialiaskan ke Gemini 3.1 Pro

Vonis arena

Rilis bersejarah yang mengembalikan Google ke puncak pada akhir 2025, dengan lompatan penalaran besar dari Gemini 2.5 Pro dan skor multimodal terbaik di generasinya. Per pertengahan 2026 tidak ada alasan memilihnya: Google mematikannya di API pada 9 Maret 2026, dan Gemini 3.1 Pro berharga persis sama sambil melipatgandakan lebih dari dua kali performa ARC-AGI-2 (77.1% vs 31.1%). Tim dengan deployment legacy sebaiknya bermigrasi ke 3.1 Pro, yang toh kini menjadi tujuan alias ID model lamanya. Hindari untuk beban kerja yang sensitif halusinasi kecuali Anda menambahkan grounding, kelemahan yang berulang kali ditandai reviewer.

Jempol ke atas atau ke bawah

Jatuhkan vonis Anda

Apakah Anda akan merekomendasikan Gemini 3 Pro, atau memperingatkan penonton agar menjauh?

57%skor penonton · 3

Alternatif Gemini 3 Pro terbaik

Semua alternatif
1
Claude Haiku 4.5

Model tercepat Anthropic: sekitar 90% kemampuan coding Sonnet 4.5 seharga $1/$5 per 1M tokens, context 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Flagship kelas Mythos dari Anthropic edisi Juni 2026: 80.3% di SWE-bench Pro, unggul 11 poin dari semua model frontier lainnya

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Opus Anthropic edisi April 2026: 87.6% SWE-bench Verified, context 1M, vision resolusi tinggi, kini tertinggal dari Opus 4.8

$25/1M out57%(3)
Visit

Bandingkan Gemini 3 Pro head-to-head

Kata penonton

Hakim Bengis

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Juara Vibes

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Glorius Maximus

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Gemini 3 Pro: pertanyaan yang sering diajukan

Berapa biaya Gemini 3 Pro per 1M token?

Gemini 3 Pro berbiaya $2/1M in (prompts ≤200K) per 1M token input dan $12/1M out (prompts ≤200K) per 1M token output. Tarif standar: $2/$12 per 1M tokens untuk prompt ≤200K, $4/$18 di atas 200K; batch diskon 50%. Dipensiunkan 9 Maret 2026, penerusnya Gemini 3.1 Pro mempertahankan harga identik.