Frente a frente

Logo de Claude Haiku 4.5vsLogo de Grok 4.3

Claude Haiku 4.5 vs Grok 4.3: qual modelo de IA vence em 2026?

Claude Haiku 4.5 ($5/1M out) e Grok 4.3 ($2.50/1M out) estão entre os modelos de IA mais usados de 2026. Em 2 votos da comunidade, Claude Haiku 4.5 lidera com 67% de aprovação.

Veredicto rápido

Em Raciocínio, escolha Grok 4.3: a arena o avalia em 4/5 contra 3/5 de Claude Haiku 4.5. No orçamento, Grok 4.3 vence: começa em $2.50/1M out contra $5/1M out de Claude Haiku 4.5.

Comparação linha por linha

A partir de
$5/1M outNível único: $1/1M de entrada, $5/1M de saída; leituras de cache de prompt a $0.10/1M (escritas de 5m a $1.25/1M) e Batch API corta 50% ($0.50/$2.50); sem sobretaxa de contexto longo (máximo de 200K).
$2.50/1M outTarifa fixa de $1.25 na entrada / $2.50 na saída em todos os níveis de effort de raciocínio; entrada cacheada a $0.20/1M. A página de preços da própria xAI não mostra sobretaxa de contexto longo, mas o OpenRouter lista tarifas escalonadas mais altas acima de 200K tokens totais.
Provedor
Anthropic
xAI
Janela de contexto
200K tokens
1M tokens
Preço de entrada
$1/1M in
$1.25/1M in
Preço de saída
$5/1M out
$2.50/1M out
Modalidades
text, vision (input); text output
text, vision (text output only)
Open weights
Não
Não
Pontuação da multidão
67%(2)
50%(0)
Notas da arena (1-5)
Raciocínio
3.0
4.0
Programação
3.5
3.5
Escrita
3.0
4.5
Velocidade
4.5
3.5
Custo-benefício
4.0
4.5

Pontos fortes e fracos

Claude Haiku 4.5

  • 73.3% no SWE-bench Verified, cerca de 90% do código agêntico do Sonnet 4.5 por um terço do preço
  • Rápido: mais de 2x a velocidade do Sonnet 4 segundo a Anthropic, com clientes de lançamento reportando 4-5x mais rápido que o Sonnet 4.5; ~92-110 tokens de saída/s medidos pela Artificial Analysis
  • Devs relatam edições de código precisas e localizadas que evitam mexer em código irrelevante, melhor que a classe GPT-5 mini nos primeiros testes
  • Suporta entrada de visão e extended thinking, algo raro nessa faixa de preço no lançamento
  • Muito adequado como modelo operário em arranjos multi-agente (Sonnet/Opus planejam, subagentes Haiku paralelos executam)
  • Leituras de prompt caching a $0.10/1M e desconto de 50% na Batch API reduzem ainda mais o custo efetivo
  • $5/1M de saída é caro para um modelo pequeno: os níveis Gemini Flash e GPT mini custam várias vezes menos em tarefas pesadas em saída
  • Contexto de 200K (contra 1M dos irmãos Sonnet 5/Opus) e saída máxima de 64K limitam trabalho em bases de código grandes e com saídas longas
  • Raciocínio interdomínios mediano: usuários relatam resultados fracos em tarefas de conhecimento do tipo GPQA, MedQA, MMMU
  • A vazão varia muito na prática (82-208 tok/s reportados) e a qualidade degrada em sessões agênticas longas de 7-8+ minutos
  • O cutoff de conhecimento (confiável até fev 2025) está defasado para os padrões de meados de 2026

Grok 4.3

  • Preço agressivo: $1.25/$2.50 por 1M de tokens, 58% mais barato na entrada e 83% na saída que o Grok 4, ficando abaixo do GPT-5.5 e do Gemini 3.1 Pro
  • Grande salto agêntico: +321 de Elo no GDPval-AA em relação ao Grok 4.20, com tool calling e seguimento de instruções fortes
  • Entrada cacheada a $0.20/1M (84% de desconto), uma grande economia para loops de agentes repetidos
  • Effort de raciocínio configurável (none/low/medium/high) em um modelo, a um preço, sem roteamento entre variantes rápida e profunda
  • Elogiado no HN pelo tom natural e conciso e por saídas densas em informação que reduzem os custos reais
  • Vazão sólida em torno de 130 tokens de saída/seg (Artificial Analysis)
  • Raciocínio de código julgado 'não competitivo com os grandes lançamentos de abril' por devs do HN; a fronteira de inteligência mal se moveu desde o Grok 4
  • A nota de não alucinação caiu 8 pontos em relação ao Grok 4.20 no AA-Omniscience; o 4.20 continua sendo a escolha mais segura da xAI para domínios críticos em precisão
  • Alto tempo até o primeiro token (~13s em effort de raciocínio alto segundo a Artificial Analysis), doloroso para apps interativos
  • A janela de contexto encolheu para 1M, contra os 2M do Grok 4.20
  • Queixas recorrentes de confiança e segurança (relatos de conteúdo nocivo, comportamento inconsistente) e sem suporte a MCP/apps conectados no app de consumo

Dê seu veredicto

Uma recomendação por ferramenta por gladiador. Ela redefine a pontuação da multidão que todos veem.

67%pontuação da multidão · 2
Grok 4.3$2.50/1M out
50%pontuação da multidão · 0

O veredicto da arena sobre o Claude Haiku 4.5

Escolha o Haiku 4.5 se você está no stack da Anthropic e precisa de qualidade de código quase nível Sonnet com baixa latência por um terço do preço: é um salto enorme sobre o Haiku 3.5 e brilha como modelo operário em pipelines multi-agente. Ele continua sendo o modelo pequeno atual da Anthropic em julho de 2026, então é o nível barato padrão para produtos baseados em Claude. Evite-o para raciocínio interdomínios profundo, bases de código muito grandes (teto de 200K de contexto) ou pura caça ao menor custo por token, onde os níveis Gemini Flash e GPT mini hoje são mais baratos, e suba para o Sonnet 5 quando qualidade importa mais que velocidade.

O veredicto da arena sobre o Grok 4.3

Escolha o Grok 4.3 se você roda pipelines agênticos ou de alto volume onde o custo por chamada domina: ele entrega raciocínio quase de fronteira e um grande salto em tool calling sobre o Grok 4.20 por uma fração do preço do GPT-5.5 ou do Gemini 3.1 Pro. Pule-o se precisão em código é sua prioridade, pois os desenvolvedores ainda colocam o Claude e os grandes lançamentos de abril à frente. Fique também no Grok 4.20 se você precisa do contexto de 2M dele ou da nota melhor de não alucinação para trabalho jurídico, médico ou de compliance. Apps sensíveis a latência devem testar os ~13s até o primeiro token antes de se comprometer.

O que a multidão diz

Sobre o Claude Haiku 4.5

Guardião do Repo

The precise localized edits are the underrated feature. It fixes the line that needs fixing and leaves the rest alone. GPT mini class models keep rewriting half my file.

Campeão das Vibes

Haiku 4.5 gives me about 90% of Sonnet agentic coding at a third of the price, and it is fast enough that edit loops feel instant. My default for quick fixes now.

Sobre o Grok 4.3

Nenhum veredicto ainda. Seja o primeiro a falar.

Perguntas frequentes

O Claude Haiku 4.5 é melhor que o Grok 4.3?

A multidão está atualmente com o Claude Haiku 4.5: 67% o recomendam, contra 50% para o Grok 4.3 (2 votos). Em Raciocínio, o Grok 4.3 pontua mais alto (4/5 vs 3/5). A escolha certa depende do seu caso de uso. A comparação linha por linha nesta página detalha preços, especificações principais e notas da arena.

Qual é mais barato, Claude Haiku 4.5 ou Grok 4.3?

O Grok 4.3 é mais barato: começa em $2.50/1M out, enquanto o Claude Haiku 4.5 começa em $5/1M out.

Quanto custam Claude Haiku 4.5 e Grok 4.3 por 1M de tokens?

Claude Haiku 4.5: $1/1M in por 1M de tokens de entrada, $5/1M out por 1M de tokens de saída. Grok 4.3: $1.25/1M in por 1M de tokens de entrada, $2.50/1M out por 1M de tokens de saída.