A arena · análise de modelo de IA

GPT-5.5

por OpenAI

O carro-chefe agêntico da OpenAI: contexto de 1M, SOTA no ARC-AGI-2 e no Terminal-Bench 2.0, $5/$30 por 1M de tokens.

Pontuação da arena 4/557% recomendam · 3 votos
Raciocínio5.0
Programação4.5
Escrita4.0
Velocidade3.5
Custo-benefício3.0
Visitar GPT-5.5código agênticoanálise de contexto longoagentes de computer-useautomação de terminal e CLI
Preço

$30/1M out

Nível padrão a $5/$30 por 1M de tokens (entrada cacheada a $0.50), o dobro dos $2.50/$15 do GPT-5.4; Batch/Flex a $2.50/$15; Priority a $12.50/$75; GPT-5.5 Pro a $30/$180; prompts acima de 272K tokens de entrada são cobrados a 2x na entrada / 1.5x na saída.

Provedor

OpenAI

Janela de contexto

1M tokens (1,050,000)

Preço de entrada

$5/1M in

Preço de saída

$30/1M out

Modalidades

text, vision (image input, text output)

Open weights

Não

O que é o GPT-5.5?

Modelo de raciocínio carro-chefe da OpenAI, lançado em 23 de abril de 2026. Construído para código agêntico, computer use e trabalho de conhecimento de longo horizonte, com janela de contexto de 1,050,000 tokens e saída máxima de 128K. Aceita entrada de texto e imagem, gera texto, com function calling, structured outputs e ferramentas de agente hospedadas via Responses API.

GPT-5.5: prós e contras

Prós

  • Janela de contexto de 1M de tokens (1,050,000) com saída máxima de 128K e effort de raciocínio ajustável de none a xhigh
  • Estado da arte no ARC-AGI-2 com 85.0% (contra 73.3% do GPT-5.4) e no Terminal-Bench 2.0 com 82.7%
  • Forte autonomia em código agêntico: devs relatam que ele resolve de primeira tarefas que exigiam vários turnos do GPT-5.4 e corrige os próprios erros; +50 pontos no Code Arena contra o GPT-5.4
  • Descontos agressivos: 90% de desconto em entrada cacheada ($0.50/1M) e 50% via Batch ou Flex ($2.50/$15)
  • Rápido para um reasoner de fronteira: devs dizem que é o primeiro modelo GPT confortável de rodar em effort de thinking médio ou baixo

Contras

  • O preço de tabela dobrou em relação ao GPT-5.4 ($5/$30 vs $2.50/$15) para a mesma janela de contexto de 1M de tokens
  • Seguimento de instruções literal demais: devs relatam que ele falha em inferir a intenção em situações óbvias onde o Claude acerta
  • Fica atrás do Claude Opus 4.8 no SWE-bench Pro (58.6% vs 69.2%); devs do HN ainda preferem o Claude em cerca de 2:1 para código
  • Às vezes conservador demais nas mudanças de código, ou pula completamente o raciocínio profundo, respondendo de imediato a prompts complexos
  • Sobretaxa de contexto longo: prompts acima de 272K tokens de entrada são cobrados a 2x na entrada e 1.5x na saída para a sessão inteira

O veredicto da arena

Escolha o GPT-5.5 em vez do GPT-5.4 se você precisa de mais autonomia agêntica, fluxos pesados em terminal ou raciocínio abstrato SOTA, mas saiba que o preço de tabela dobrou dos $2.50/$15 do GPT-5.4 para $5/$30 enquanto o contexto de 1M ficou o mesmo. Equipes fazendo refatoração multi-arquivo de alto risco podem ainda preferir o Claude Opus, que lidera o SWE-bench Pro (69.2% vs 58.6%) e infere melhor a intenção a partir de prompts soltos. Usuários sensíveis a orçamento devem ficar atentos à sobretaxa de 272K tokens e aos relatos de limites que se esgotam mais rápido, e apoiar-se em caching, Batch ou Flex para cortar os custos pela metade.

Polegar para cima ou para baixo

Dê seu veredicto

Você recomendaria o GPT-5.5 ou avisaria a multidão para ficar longe?

57%pontuação da multidão · 3

Melhores alternativas ao GPT-5.5

Todas as alternativas
1
Claude Haiku 4.5

O modelo mais rápido da Anthropic: cerca de 90% da habilidade de código do Sonnet 4.5 a $1/$5 por 1M de tokens, contexto de 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

O carro-chefe da classe Mythos da Anthropic de junho de 2026: 80.3% no SWE-bench Pro, 11 pontos à frente de todos os outros modelos de fronteira

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

O Opus da Anthropic de abril de 2026: 87.6% no SWE-bench Verified, contexto de 1M, visão de alta resolução, hoje atrás do Opus 4.8

$25/1M out57%(3)
Visit

Compare o GPT-5.5 frente a frente

O que a multidão diz

Polegar Abaixus

It is painfully literal. Where Claude infers intent in obvious places, 5.5 wants everything spelled out. And the price doubled vs 5.4 for the same 1M context.

O Avaliador Justo

85 on ARC-AGI-2 and you can feel it. Stuff that used to stall my agent just resolves now. 1M context with 128K output covers every workflow I have.

Sir Entrega Muito

5.5 one-shots tasks that took 5.4 three turns, and it fixes its own mistakes mid-run instead of doubling down. The reasoning effort dial from none to xhigh is genuinely useful.

GPT-5.5: perguntas frequentes

Quanto custa o GPT-5.5 por 1M de tokens?

O GPT-5.5 custa $5/1M in por 1M de tokens de entrada e $30/1M out por 1M de tokens de saída. Nível padrão a $5/$30 por 1M de tokens (entrada cacheada a $0.50), o dobro dos $2.50/$15 do GPT-5.4; Batch/Flex a $2.50/$15; Priority a $12.50/$75; GPT-5.5 Pro a $30/$180; prompts acima de 272K tokens de entrada são cobrados a 2x na entrada / 1.5x na saída.