A arena · análise de modelo de IA

Claude Opus 4.6

por Anthropic

O Opus da Anthropic de fev 2026: contexto de 1M, thinking adaptativo, 80.8% no SWE-bench, hoje superado pelo Opus 4.8.

Pontuação da arena 3.5/5
Raciocínio4.0
Programação4.0
Escrita4.0
Velocidade2.5
Custo-benefício3.0
Visitar Claude Opus 4.6código agênticoanálise de contexto longofluxos de agentes multi-etaparefatoração de bases de código grandes
Preço

$25/1M out

Nível padrão a $5/$25 por 1M de tokens; contexto completo de 1M agora à tarifa padrão (a sobretaxa de lançamento de $10/$37.50 acima de 200K tokens foi depois retirada), Batch API com 50% de desconto ($2.50/$12.50), inferência somente nos EUA (inference_geo) com multiplicador de 1.1x.

Provedor

Anthropic

Janela de contexto

1M tokens (128K max output)

Preço de entrada

$5/1M in

Preço de saída

$25/1M out

Modalidades

text, vision (image input), text output

Open weights

Não

O que é o Claude Opus 4.6?

Modelo de fronteira da classe Opus lançado em 5 de fevereiro de 2026. Primeiro Opus com janela de contexto de 1M de tokens, thinking adaptativo e parâmetro de effort (de low a max). Registrou 80.8% no SWE-bench Verified e a melhor nota do Terminal-Bench 2.0 no lançamento; depois foi superado pelos Opus 4.7 e 4.8 pelo mesmo preço.

Claude Opus 4.6: prós e contras

Prós

  • 80.8% no SWE-bench Verified (média de 25 execuções) e melhor nota do Terminal-Bench 2.0 no lançamento, o modelo de código agêntico líder da sua geração (fev 2026)
  • Primeiro Opus com janela de contexto de 1M de tokens: 76% no MRCR v2 8-needle em 1M de tokens contra 18.5% do Sonnet 4.5
  • Grande salto de raciocínio sobre o Opus 4.5: ARC-AGI-2 68.8% vs 37.6%, +190 de Elo no GDPval-AA de tarefas de valor econômico (~144 de Elo acima do GPT-5.2)
  • Manteve o preço do Opus 4.5 ($5/$25 por 1M de tokens) apesar dos ganhos; o contexto completo de 1M passou a ser cobrado à tarifa padrão, com 50% de desconto no batch
  • Thinking adaptativo mais parâmetro de effort (low/medium/high/max) para dosar inteligência, latência e custo por requisição
  • Comportamento autônomo forte como agente: paraleliza o trabalho e exige menos supervisão que o Opus 4.5 (Vibe Check da Every.to)

Contras

  • Mais lento e mais verboso que o Opus 4.5; avaliadores relatam que o ritmo 'oscila sob carga' em execuções agênticas longas (Every.to)
  • A escrita regrediu: em testes cegos a equipe da Every.to preferiu a prosa do Opus 4.5, e o 4.6 mostra mais cacoetes de IA como construções do tipo 'X, não Y'
  • Às vezes faz mudanças inesperadas e 'nem sempre conhece as próprias skills', exigindo supervisão mais próxima que o GPT-5.x Codex segundo avaliadores
  • Superado em poucos meses pelos Opus 4.7 e 4.8 pelo mesmo preço de $5/$25, e o fast mode não está disponível no 4.6 desde junho de 2026 (as requisições rodam em velocidade padrão)
  • Alguns devs relatam fadiga de benchmark: os ganhos no dia a dia de código sobre o 4.5 são mais difíceis de sentir do que as notas sugerem, e o próprio SWE-bench ficou estável em relação ao 4.5 (80.8% vs 80.9%)

O veredicto da arena

Um upgrade claro sobre o Opus 4.5 para código agêntico e trabalho de contexto longo pelo mesmo preço, e liderou os benchmarks de código agêntico no lançamento. Em meados de 2026, porém, há pouca razão para começar projetos novos nele: o Opus 4.8 custa os mesmos $5/$25 e o supera em tudo, então escolha o 4.6 principalmente para fixar um comportamento já validado. Escritores devem evitá-lo, já que testes cegos preferiram a prosa do Opus 4.5, e usuários sensíveis a latência devem notar que ele é mais lento que o 4.5, sem opção de fast mode.

Polegar para cima ou para baixo

Dê seu veredicto

Você recomendaria o Claude Opus 4.6 ou avisaria a multidão para ficar longe?

50%pontuação da multidão · 0

Melhores alternativas ao Claude Opus 4.6

Todas as alternativas
1
Claude Haiku 4.5

O modelo mais rápido da Anthropic: cerca de 90% da habilidade de código do Sonnet 4.5 a $1/$5 por 1M de tokens, contexto de 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

O carro-chefe da classe Mythos da Anthropic de junho de 2026: 80.3% no SWE-bench Pro, 11 pontos à frente de todos os outros modelos de fronteira

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

O Opus da Anthropic de abril de 2026: 87.6% no SWE-bench Verified, contexto de 1M, visão de alta resolução, hoje atrás do Opus 4.8

$25/1M out57%(3)
Visit

Compare o Claude Opus 4.6 frente a frente

Claude Opus 4.6: perguntas frequentes

Quanto custa o Claude Opus 4.6 por 1M de tokens?

O Claude Opus 4.6 custa $5/1M in por 1M de tokens de entrada e $25/1M out por 1M de tokens de saída. Nível padrão a $5/$25 por 1M de tokens; contexto completo de 1M agora à tarifa padrão (a sobretaxa de lançamento de $10/$37.50 acima de 200K tokens foi depois retirada), Batch API com 50% de desconto ($2.50/$12.50), inferência somente nos EUA (inference_geo) com multiplicador de 1.1x.