Frente a frente

Logo de Claude Sonnet 5vsLogo de GPT-5.5

Claude Sonnet 5 vs GPT-5.5: qual modelo de IA vence em 2026?

Claude Sonnet 5 ($15/1M out ($10 intro until 2026-08-31)) e GPT-5.5 ($30/1M out) estão entre os modelos de IA mais usados de 2026. Em 6 votos da comunidade, Claude Sonnet 5 lidera com 57% de aprovação.

Veredicto rápido

Em Raciocínio, escolha GPT-5.5: a arena o avalia em 5/5 contra 4.5/5 de Claude Sonnet 5. No orçamento, Claude Sonnet 5 vence: começa em $15/1M out ($10 intro until 2026-08-31) contra $30/1M out de GPT-5.5.

Comparação linha por linha

A partir de
$15/1M out ($10 intro until 2026-08-31)Nível único: $3/$15 por 1M de tokens no padrão, $2/$10 promocional até 31 de ago de 2026; Batch API com -50%; o novo tokenizer gera cerca de 30% mais tokens por texto (1.0-1.35x segundo a Anthropic), elevando o custo efetivo.
$30/1M outNível padrão a $5/$30 por 1M de tokens (entrada cacheada a $0.50), o dobro dos $2.50/$15 do GPT-5.4; Batch/Flex a $2.50/$15; Priority a $12.50/$75; GPT-5.5 Pro a $30/$180; prompts acima de 272K tokens de entrada são cobrados a 2x na entrada / 1.5x na saída.
Provedor
Anthropic
OpenAI
Janela de contexto
1M tokens (128K max output)
1M tokens (1,050,000)
Preço de entrada
$3/1M in ($2 intro until 2026-08-31)
$5/1M in
Preço de saída
$15/1M out ($10 intro until 2026-08-31)
$30/1M out
Modalidades
text, vision (image input, text output)
text, vision (image input, text output)
Open weights
Não
Não
Pontuação da multidão
57%(3)
57%(3)
Notas da arena (1-5)
Raciocínio
4.5
5.0
Programação
4.5
4.5
Escrita
4.5
4.0
Velocidade
4.0
3.5
Custo-benefício
4.5
3.0

Pontos fortes e fracos

Claude Sonnet 5

  • Grandes ganhos agênticos sobre o Sonnet 4.6: Terminal-Bench 2.1 80.4% vs 67.0%, OSWorld-Verified 81.2% vs 78.5%, SWE-bench Pro 63.2% vs 58.1%
  • Iguala o Opus 4.8 em trabalho de conhecimento (GDPval-AA v2: 1,618 vs 1,615) e quase empata no Humanity's Last Exam com ferramentas (57.4% vs 57.9%) a 60% do preço do Opus 4.8 (40% durante a janela promocional)
  • Janela de contexto de 1M de tokens e saída máxima de 128K; preço promocional de $2/$10 por 1M de tokens até 31 de ago de 2026
  • Comportamento persistente de agente que se autoverifica: avaliações práticas notam que ele testa o próprio código e itera em problemas difíceis até resolver, ao contrário do Sonnet 4.6
  • Primeiro Sonnet com nível de effort xhigh e visão de alta resolução (imagens de 2576px); thinking adaptativo habilitado por padrão
  • Precisão de code review mais alta que o Sonnet 4.6 (38-40% vs 29%), produzindo menos achados falso-positivos
  • O novo tokenizer infla a contagem de tokens em cerca de 30% para o mesmo texto (1.0-1.35x segundo a Anthropic; ~1.4x em inglês, ~1.28x em Python medidos por Simon Willison), elevando o custo efetivo apesar do preço de tabela inalterado
  • Verboso e faminto por tokens: ~$2.29 por tarefa contra ~$1.20 do Sonnet 4.6 em testes independentes (101º de 161 em eficiência de custo); em effort alto o custo por tarefa pode superar o do Opus 4.8
  • Mensuravelmente mais lento que o Sonnet 4.6 em pequenas edições rotineiras e propenso a superengenharia em tarefas simples (avaliação prática do CodeRabbit)
  • Parâmetros de amostragem (temperature, top_p, top_k) removidos; valores não padrão retornam erro 400, quebrando pipelines existentes
  • O sentimento no lançamento no HN/Reddit foi misto: o rótulo '5' foi visto como promessa exagerada, e as salvaguardas de cibersegurança mais rígidas podem recusar trabalho benigno próximo de segurança

GPT-5.5

  • Janela de contexto de 1M de tokens (1,050,000) com saída máxima de 128K e effort de raciocínio ajustável de none a xhigh
  • Estado da arte no ARC-AGI-2 com 85.0% (contra 73.3% do GPT-5.4) e no Terminal-Bench 2.0 com 82.7%
  • Forte autonomia em código agêntico: devs relatam que ele resolve de primeira tarefas que exigiam vários turnos do GPT-5.4 e corrige os próprios erros; +50 pontos no Code Arena contra o GPT-5.4
  • Descontos agressivos: 90% de desconto em entrada cacheada ($0.50/1M) e 50% via Batch ou Flex ($2.50/$15)
  • Rápido para um reasoner de fronteira: devs dizem que é o primeiro modelo GPT confortável de rodar em effort de thinking médio ou baixo
  • O preço de tabela dobrou em relação ao GPT-5.4 ($5/$30 vs $2.50/$15) para a mesma janela de contexto de 1M de tokens
  • Seguimento de instruções literal demais: devs relatam que ele falha em inferir a intenção em situações óbvias onde o Claude acerta
  • Fica atrás do Claude Opus 4.8 no SWE-bench Pro (58.6% vs 69.2%); devs do HN ainda preferem o Claude em cerca de 2:1 para código
  • Às vezes conservador demais nas mudanças de código, ou pula completamente o raciocínio profundo, respondendo de imediato a prompts complexos
  • Sobretaxa de contexto longo: prompts acima de 272K tokens de entrada são cobrados a 2x na entrada e 1.5x na saída para a sessão inteira

Dê seu veredicto

Uma recomendação por ferramenta por gladiador. Ela redefine a pontuação da multidão que todos veem.

Claude Sonnet 5$15/1M out ($10 intro until 2026-08-31)
57%pontuação da multidão · 3
GPT-5.5$30/1M out
57%pontuação da multidão · 3

O veredicto da arena sobre o Claude Sonnet 5

Escolha o Sonnet 5 se você roda agentes de código, terminal ou computer-use e quer qualidade próxima do Opus 4.8 a preço de Sonnet, especialmente durante a janela promocional de $2/$10; ele é um upgrade estrito sobre o Sonnet 4.6 em effort baixo e médio. Reserve orçamento para o novo tokenizer e para a verbosidade: os custos reais por tarefa ficam bem acima dos do Sonnet 4.6, e nos níveis de effort mais altos o Opus 4.8 pode sair mais em conta por tarefa resolvida. Evite-o para pequenas edições sensíveis a latência ou pipelines que dependem de temperature e top_p, que agora retornam erro. O Sonnet 4.6 continua a escolha pragmática para cargas de alto volume com diffs minúsculos.

O veredicto da arena sobre o GPT-5.5

Escolha o GPT-5.5 em vez do GPT-5.4 se você precisa de mais autonomia agêntica, fluxos pesados em terminal ou raciocínio abstrato SOTA, mas saiba que o preço de tabela dobrou dos $2.50/$15 do GPT-5.4 para $5/$30 enquanto o contexto de 1M ficou o mesmo. Equipes fazendo refatoração multi-arquivo de alto risco podem ainda preferir o Claude Opus, que lidera o SWE-bench Pro (69.2% vs 58.6%) e infere melhor a intenção a partir de prompts soltos. Usuários sensíveis a orçamento devem ficar atentos à sobretaxa de 272K tokens e aos relatos de limites que se esgotam mais rápido, e apoiar-se em caching, Batch ou Flex para cortar os custos pela metade.

O que a multidão diz

Sobre o Claude Sonnet 5

Capitão Churn

Cheap per token, pricey per task. Independent tests had it near $2.29 a task vs $1.20 on 4.6, and at high effort it can out-cost Opus 4.8. It will not stop talking.

Polegar Dourado

Terminal-Bench going 67 to 80 over Sonnet 4.6 matches what I see. My CI-fix agent went from constant babysitting to mostly hands-off overnight.

São Deployus

Matches Opus 4.8 on knowledge work at 60% of the price, and the intro $2/$10 window makes it silly value. My research agent runs on Sonnet 5 now, zero regrets.

Sobre o GPT-5.5

Polegar Abaixus

It is painfully literal. Where Claude infers intent in obvious places, 5.5 wants everything spelled out. And the price doubled vs 5.4 for the same 1M context.

O Avaliador Justo

85 on ARC-AGI-2 and you can feel it. Stuff that used to stall my agent just resolves now. 1M context with 128K output covers every workflow I have.

Sir Entrega Muito

5.5 one-shots tasks that took 5.4 three turns, and it fixes its own mistakes mid-run instead of doubling down. The reasoning effort dial from none to xhigh is genuinely useful.

Perguntas frequentes

O Claude Sonnet 5 é melhor que o GPT-5.5?

Em Raciocínio, o GPT-5.5 pontua mais alto (5/5 vs 4.5/5). A escolha certa depende do seu caso de uso. A comparação linha por linha nesta página detalha preços, especificações principais e notas da arena.

Qual é mais barato, Claude Sonnet 5 ou GPT-5.5?

O Claude Sonnet 5 é mais barato: começa em $15/1M out ($10 intro until 2026-08-31), enquanto o GPT-5.5 começa em $30/1M out.

Quanto custam Claude Sonnet 5 e GPT-5.5 por 1M de tokens?

Claude Sonnet 5: $3/1M in ($2 intro until 2026-08-31) por 1M de tokens de entrada, $15/1M out ($10 intro until 2026-08-31) por 1M de tokens de saída. GPT-5.5: $5/1M in por 1M de tokens de entrada, $30/1M out por 1M de tokens de saída.