L'arena · recensione di modello IA

Gemini 3 Pro

di Google

Il modello di frontiera di Google di nov 2025: contesto 1M, primo oltre i 1500 Elo su LMArena, sostituito da Gemini 3.1 Pro.

Punteggio dell'arena 4/557% lo consiglia · 3 voti
Ragionamento4.5
Coding4.5
Scrittura3.5
Velocità3.5
Rapporto qualità-prezzo4.0
Visita Gemini 3 Proanalisi multimodale (video/audio/immagini)ragionamento long-contextcoding agenticoragionamento matematico e scientifico
Prezzo

$12/1M out (prompts ≤200K)

Tier standard: $2/$12 per 1M di tokens per i prompt ≤200K, $4/$18 oltre i 200K; batch a metà prezzo. Ritirato il 9 marzo 2026, il successore Gemini 3.1 Pro mantiene prezzi identici.

Fornitore

Google (DeepMind)

Finestra di contesto

1M tokens (64K output)

Prezzo in input

$2/1M in (prompts ≤200K)

Prezzo in output

$12/1M out (prompts ≤200K)

Modalità

text, image, audio, video in; text out

Open weights

No

Che cos'è Gemini 3 Pro?

Modello di ragionamento di frontiera di Google DeepMind, uscito il 18 novembre 2025. Primo modello a sfondare i 1500 Elo su LMArena, con finestra di contesto da 1M di tokens e comprensione nativa di testo, immagini, audio e video. Ritirato il 9 marzo 2026 in favore di Gemini 3.1 Pro allo stesso prezzo.

Gemini 3 Pro: pro e contro

Pro

  • In vetta a LMArena al lancio con un record di 1501 Elo e 91.9% su GPQA Diamond, stato dell'arte alla release
  • ARC-AGI-2 al 31.1%, circa 6x Gemini 2.5 Pro (4.9%) e quasi il doppio di GPT-5.1 (17.6%) all'epoca
  • Comprensione multimodale al top della categoria: 81% su MMMU-Pro, 87.6% su Video-MMMU, con finestra di contesto da 1M di tokens
  • Coding agentico solido: 76.2% su SWE-bench Verified, 54.2% su Terminal-Bench 2.0, 1487 Elo su WebDev Arena
  • Prezzi sotto i rivali a $2/$12 per 1M di tokens, meno della fascia Claude Sonnet ($3/$15)
  • Il thinking_level configurabile (low/medium/high) permette agli sviluppatori di bilanciare profondità di ragionamento, latenza e costo

Contro

  • Allucinazioni con eccesso di sicurezza: su AA-Omniscience ha dato una risposta sbagliata l'88% delle volte invece di astenersi, contro il 48% di Claude Sonnet 4.5 (the-decoder)
  • Piaggeria ampiamente segnalata dai recensori (Zvi Mowshowitz: 'vasta intelligenza senza spina dorsale'); richiede system prompt rigidi
  • Problemi di affidabilità nel tool calling negli stack agentici: gli sviluppatori riportavano output dei tool scaricati nel thread della chat e più scaffolding necessario rispetto ai modelli OpenAI/Anthropic
  • Lento a thinking level alto: time to first token misurato intorno ai 30-60s su AI Studio nonostante ~130 tok/s di velocità di output
  • Ritirato: spento su Gemini API e AI Studio il 9 marzo 2026, con gemini-3-pro-preview ora puntato su Gemini 3.1 Pro

Il verdetto dell'arena

Una release storica che ha riportato Google in vetta a fine 2025, con un enorme salto di ragionamento rispetto a Gemini 2.5 Pro e i migliori punteggi multimodali della sua generazione. A metà 2026 non c'è motivo di sceglierlo: Google lo ha spento sull'API il 9 marzo 2026, e Gemini 3.1 Pro costa esattamente lo stesso più che raddoppiando le prestazioni su ARC-AGI-2 (77.1% contro 31.1%). I team con deployment legacy dovrebbero migrare al 3.1 Pro, verso cui il vecchio ID modello ormai punta comunque. Evitalo per i carichi sensibili alle allucinazioni senza aggiungere grounding, una debolezza che i recensori hanno segnalato più volte.

Pollice su o pollice verso

Emetti il tuo verdetto

Consiglieresti Gemini 3 Pro, o metteresti in guardia la folla?

57%punteggio della folla · 3

Migliori alternative a Gemini 3 Pro

Tutte le alternative
1
Claude Haiku 4.5

Il modello più veloce di Anthropic: circa il 90% delle capacità di coding di Sonnet 4.5 a $1/$5 per 1M di tokens, contesto 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Il flagship di classe Mythos di Anthropic di giugno 2026: 80.3% su SWE-bench Pro, 11 punti sopra ogni altro modello di frontiera

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

L'Opus di Anthropic di aprile 2026: 87.6% su SWE-bench Verified, contesto 1M, visione ad alta risoluzione, ormai dietro a Opus 4.8

$25/1M out57%(3)
Visit

Confronta Gemini 3 Pro testa a testa

Cosa dice la folla

Giudice Tremendus

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Campione delle Vibes

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Glorius Maximus

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Gemini 3 Pro: domande frequenti

Quanto costa Gemini 3 Pro per 1M di token?

Gemini 3 Pro costa $2/1M in (prompts ≤200K) per 1M di token in input e $12/1M out (prompts ≤200K) per 1M di token in output. Tier standard: $2/$12 per 1M di tokens per i prompt ≤200K, $4/$18 oltre i 200K; batch a metà prezzo. Ritirato il 9 marzo 2026, il successore Gemini 3.1 Pro mantiene prezzi identici.