A arena · análise de modelo de IA
GPT-5.5
por OpenAI
O carro-chefe agêntico da OpenAI: contexto de 1M, SOTA no ARC-AGI-2 e no Terminal-Bench 2.0, $5/$30 por 1M de tokens.
$30/1M out
Nível padrão a $5/$30 por 1M de tokens (entrada cacheada a $0.50), o dobro dos $2.50/$15 do GPT-5.4; Batch/Flex a $2.50/$15; Priority a $12.50/$75; GPT-5.5 Pro a $30/$180; prompts acima de 272K tokens de entrada são cobrados a 2x na entrada / 1.5x na saída.
OpenAI
1M tokens (1,050,000)
$5/1M in
$30/1M out
text, vision (image input, text output)
Não
O que é o GPT-5.5?
Modelo de raciocínio carro-chefe da OpenAI, lançado em 23 de abril de 2026. Construído para código agêntico, computer use e trabalho de conhecimento de longo horizonte, com janela de contexto de 1,050,000 tokens e saída máxima de 128K. Aceita entrada de texto e imagem, gera texto, com function calling, structured outputs e ferramentas de agente hospedadas via Responses API.
GPT-5.5: prós e contras
Prós
- Janela de contexto de 1M de tokens (1,050,000) com saída máxima de 128K e effort de raciocínio ajustável de none a xhigh
- Estado da arte no ARC-AGI-2 com 85.0% (contra 73.3% do GPT-5.4) e no Terminal-Bench 2.0 com 82.7%
- Forte autonomia em código agêntico: devs relatam que ele resolve de primeira tarefas que exigiam vários turnos do GPT-5.4 e corrige os próprios erros; +50 pontos no Code Arena contra o GPT-5.4
- Descontos agressivos: 90% de desconto em entrada cacheada ($0.50/1M) e 50% via Batch ou Flex ($2.50/$15)
- Rápido para um reasoner de fronteira: devs dizem que é o primeiro modelo GPT confortável de rodar em effort de thinking médio ou baixo
Contras
- O preço de tabela dobrou em relação ao GPT-5.4 ($5/$30 vs $2.50/$15) para a mesma janela de contexto de 1M de tokens
- Seguimento de instruções literal demais: devs relatam que ele falha em inferir a intenção em situações óbvias onde o Claude acerta
- Fica atrás do Claude Opus 4.8 no SWE-bench Pro (58.6% vs 69.2%); devs do HN ainda preferem o Claude em cerca de 2:1 para código
- Às vezes conservador demais nas mudanças de código, ou pula completamente o raciocínio profundo, respondendo de imediato a prompts complexos
- Sobretaxa de contexto longo: prompts acima de 272K tokens de entrada são cobrados a 2x na entrada e 1.5x na saída para a sessão inteira
O veredicto da arena
Escolha o GPT-5.5 em vez do GPT-5.4 se você precisa de mais autonomia agêntica, fluxos pesados em terminal ou raciocínio abstrato SOTA, mas saiba que o preço de tabela dobrou dos $2.50/$15 do GPT-5.4 para $5/$30 enquanto o contexto de 1M ficou o mesmo. Equipes fazendo refatoração multi-arquivo de alto risco podem ainda preferir o Claude Opus, que lidera o SWE-bench Pro (69.2% vs 58.6%) e infere melhor a intenção a partir de prompts soltos. Usuários sensíveis a orçamento devem ficar atentos à sobretaxa de 272K tokens e aos relatos de limites que se esgotam mais rápido, e apoiar-se em caching, Batch ou Flex para cortar os custos pela metade.
Polegar para cima ou para baixo
Dê seu veredicto
Você recomendaria o GPT-5.5 ou avisaria a multidão para ficar longe?
Melhores alternativas ao GPT-5.5
Todas as alternativasO modelo mais rápido da Anthropic: cerca de 90% da habilidade de código do Sonnet 4.5 a $1/$5 por 1M de tokens, contexto de 200K.
O carro-chefe da classe Mythos da Anthropic de junho de 2026: 80.3% no SWE-bench Pro, 11 pontos à frente de todos os outros modelos de fronteira
O Opus da Anthropic de abril de 2026: 87.6% no SWE-bench Verified, contexto de 1M, visão de alta resolução, hoje atrás do Opus 4.8
Compare o GPT-5.5 frente a frente
O que a multidão diz
“It is painfully literal. Where Claude infers intent in obvious places, 5.5 wants everything spelled out. And the price doubled vs 5.4 for the same 1M context.”
“85 on ARC-AGI-2 and you can feel it. Stuff that used to stall my agent just resolves now. 1M context with 128K output covers every workflow I have.”
“5.5 one-shots tasks that took 5.4 three turns, and it fixes its own mistakes mid-run instead of doubling down. The reasoning effort dial from none to xhigh is genuinely useful.”
GPT-5.5: perguntas frequentes
Quanto custa o GPT-5.5 por 1M de tokens?
O GPT-5.5 custa $5/1M in por 1M de tokens de entrada e $30/1M out por 1M de tokens de saída. Nível padrão a $5/$30 por 1M de tokens (entrada cacheada a $0.50), o dobro dos $2.50/$15 do GPT-5.4; Batch/Flex a $2.50/$15; Priority a $12.50/$75; GPT-5.5 Pro a $30/$180; prompts acima de 272K tokens de entrada são cobrados a 2x na entrada / 1.5x na saída.