A arena · análise de modelo de IA

Gemini 3 Pro

por Google

O modelo de fronteira do Google de nov 2025: contexto de 1M, primeiro a passar de 1500 de Elo no LMArena, substituído pelo Gemini 3.1 Pro.

Pontuação da arena 4/557% recomendam · 3 votos
Raciocínio4.5
Programação4.5
Escrita3.5
Velocidade3.5
Custo-benefício4.0
Visitar Gemini 3 Proanálise multimodal (vídeo/áudio/imagem)raciocínio de contexto longocódigo agênticoraciocínio em matemática e ciência
Preço

$12/1M out (prompts ≤200K)

Nível padrão: $2/$12 por 1M de tokens para prompts ≤200K, $4/$18 acima de 200K; batch com 50% de desconto. Aposentado em 9 de março de 2026, o sucessor Gemini 3.1 Pro mantém preço idêntico.

Provedor

Google (DeepMind)

Janela de contexto

1M tokens (64K output)

Preço de entrada

$2/1M in (prompts ≤200K)

Preço de saída

$12/1M out (prompts ≤200K)

Modalidades

text, image, audio, video in; text out

Open weights

Não

O que é o Gemini 3 Pro?

Modelo de raciocínio de fronteira do Google DeepMind, lançado em 18 de novembro de 2025. Primeiro modelo a romper os 1500 de Elo no LMArena, com janela de contexto de 1M de tokens e compreensão nativa de texto, imagem, áudio e vídeo. Aposentado em 9 de março de 2026 em favor do Gemini 3.1 Pro pelo mesmo preço.

Gemini 3 Pro: prós e contras

Prós

  • Liderou o LMArena no lançamento com um recorde de 1501 de Elo e marcou 91.9% no GPQA Diamond, estado da arte na época
  • ARC-AGI-2 de 31.1%, cerca de 6x o Gemini 2.5 Pro (4.9%) e quase o dobro do GPT-5.1 (17.6%) na época
  • Compreensão multimodal de primeira classe: 81% no MMMU-Pro, 87.6% no Video-MMMU, com janela de contexto de 1M de tokens
  • Código agêntico forte: 76.2% no SWE-bench Verified, 54.2% no Terminal-Bench 2.0, 1487 de Elo no WebDev Arena
  • Ficou abaixo dos rivais em preço a $2/$12 por 1M de tokens, abaixo do preço da classe Claude Sonnet ($3/$15)
  • O thinking_level configurável (low/medium/high) permite aos desenvolvedores trocar profundidade de raciocínio por latência e custo

Contras

  • Alucinações confiantes demais: no AA-Omniscience ele deu uma resposta errada 88% das vezes em vez de se abster, contra 48% do Claude Sonnet 4.5 (the-decoder)
  • Bajulação amplamente relatada por avaliadores (Zvi Mowshowitz: 'inteligência vasta sem espinha dorsal'); exige system prompts rígidos
  • Problemas de confiabilidade no tool calling em stacks de agentes: devs relataram saídas de ferramentas despejadas na thread do chat e mais scaffolding necessário que nos modelos da OpenAI/Anthropic
  • Lento em thinking level alto: tempo até o primeiro token medido em torno de 30-60s no AI Studio, apesar de ~130 tok/s de velocidade de saída
  • Aposentado: desligado na Gemini API e no AI Studio em 9 de março de 2026, com o gemini-3-pro-preview agora apontando para o Gemini 3.1 Pro

O veredicto da arena

Um lançamento histórico que recolocou o Google no topo no fim de 2025, com um salto enorme de raciocínio sobre o Gemini 2.5 Pro e as melhores notas multimodais da geração. Em meados de 2026 não há razão para escolhê-lo: o Google o desligou na API em 9 de março de 2026, e o Gemini 3.1 Pro custa exatamente o mesmo enquanto mais que dobra o desempenho no ARC-AGI-2 (77.1% vs 31.1%). Equipes em deploys legados devem migrar para o 3.1 Pro, para onde o ID do modelo antigo já aponta de qualquer forma. Evite-o para cargas sensíveis a alucinação sem adicionar grounding, uma fraqueza que os avaliadores apontaram repetidamente.

Polegar para cima ou para baixo

Dê seu veredicto

Você recomendaria o Gemini 3 Pro ou avisaria a multidão para ficar longe?

57%pontuação da multidão · 3

Melhores alternativas ao Gemini 3 Pro

Todas as alternativas
1
Claude Haiku 4.5

O modelo mais rápido da Anthropic: cerca de 90% da habilidade de código do Sonnet 4.5 a $1/$5 por 1M de tokens, contexto de 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

O carro-chefe da classe Mythos da Anthropic de junho de 2026: 80.3% no SWE-bench Pro, 11 pontos à frente de todos os outros modelos de fronteira

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

O Opus da Anthropic de abril de 2026: 87.6% no SWE-bench Verified, contexto de 1M, visão de alta resolução, hoje atrás do Opus 4.8

$25/1M out57%(3)
Visit

Compare o Gemini 3 Pro frente a frente

O que a multidão diz

Juiz Implacável

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Campeão das Vibes

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Glorius Maximus

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Gemini 3 Pro: perguntas frequentes

Quanto custa o Gemini 3 Pro por 1M de tokens?

O Gemini 3 Pro custa $2/1M in (prompts ≤200K) por 1M de tokens de entrada e $12/1M out (prompts ≤200K) por 1M de tokens de saída. Nível padrão: $2/$12 por 1M de tokens para prompts ≤200K, $4/$18 acima de 200K; batch com 50% de desconto. Aposentado em 9 de março de 2026, o sucessor Gemini 3.1 Pro mantém preço idêntico.