A arena · análise de modelo de IA
Claude Haiku 4.5
por Anthropic
O modelo mais rápido da Anthropic: cerca de 90% da habilidade de código do Sonnet 4.5 a $1/$5 por 1M de tokens, contexto de 200K.
$5/1M out
Nível único: $1/1M de entrada, $5/1M de saída; leituras de cache de prompt a $0.10/1M (escritas de 5m a $1.25/1M) e Batch API corta 50% ($0.50/$2.50); sem sobretaxa de contexto longo (máximo de 200K).
Anthropic
200K tokens
$1/1M in
$5/1M out
text, vision (input); text output
Não
O que é o Claude Haiku 4.5?
Modelo Claude pequeno e focado em velocidade, lançado em 15 de outubro de 2025. Marca 73.3% no SWE-bench Verified, aproximadamente 90% do desempenho em código agêntico do Sonnet 4.5 por um terço do custo. Suporta entrada de visão e extended thinking, com janela de contexto de 200K e saída máxima de 64K.
Claude Haiku 4.5: prós e contras
Prós
- 73.3% no SWE-bench Verified, cerca de 90% do código agêntico do Sonnet 4.5 por um terço do preço
- Rápido: mais de 2x a velocidade do Sonnet 4 segundo a Anthropic, com clientes de lançamento reportando 4-5x mais rápido que o Sonnet 4.5; ~92-110 tokens de saída/s medidos pela Artificial Analysis
- Devs relatam edições de código precisas e localizadas que evitam mexer em código irrelevante, melhor que a classe GPT-5 mini nos primeiros testes
- Suporta entrada de visão e extended thinking, algo raro nessa faixa de preço no lançamento
- Muito adequado como modelo operário em arranjos multi-agente (Sonnet/Opus planejam, subagentes Haiku paralelos executam)
- Leituras de prompt caching a $0.10/1M e desconto de 50% na Batch API reduzem ainda mais o custo efetivo
Contras
- $5/1M de saída é caro para um modelo pequeno: os níveis Gemini Flash e GPT mini custam várias vezes menos em tarefas pesadas em saída
- Contexto de 200K (contra 1M dos irmãos Sonnet 5/Opus) e saída máxima de 64K limitam trabalho em bases de código grandes e com saídas longas
- Raciocínio interdomínios mediano: usuários relatam resultados fracos em tarefas de conhecimento do tipo GPQA, MedQA, MMMU
- A vazão varia muito na prática (82-208 tok/s reportados) e a qualidade degrada em sessões agênticas longas de 7-8+ minutos
- O cutoff de conhecimento (confiável até fev 2025) está defasado para os padrões de meados de 2026
O veredicto da arena
Escolha o Haiku 4.5 se você está no stack da Anthropic e precisa de qualidade de código quase nível Sonnet com baixa latência por um terço do preço: é um salto enorme sobre o Haiku 3.5 e brilha como modelo operário em pipelines multi-agente. Ele continua sendo o modelo pequeno atual da Anthropic em julho de 2026, então é o nível barato padrão para produtos baseados em Claude. Evite-o para raciocínio interdomínios profundo, bases de código muito grandes (teto de 200K de contexto) ou pura caça ao menor custo por token, onde os níveis Gemini Flash e GPT mini hoje são mais baratos, e suba para o Sonnet 5 quando qualidade importa mais que velocidade.
Polegar para cima ou para baixo
Dê seu veredicto
Você recomendaria o Claude Haiku 4.5 ou avisaria a multidão para ficar longe?
Melhores alternativas ao Claude Haiku 4.5
Todas as alternativasO carro-chefe da classe Mythos da Anthropic de junho de 2026: 80.3% no SWE-bench Pro, 11 pontos à frente de todos os outros modelos de fronteira
O Opus da Anthropic de abril de 2026: 87.6% no SWE-bench Verified, contexto de 1M, visão de alta resolução, hoje atrás do Opus 4.8
O Sonnet mais agêntico da Anthropic: qualidade próxima do Opus 4.8 em código e agentes a $3/$15 com contexto de 1M
Compare o Claude Haiku 4.5 frente a frente
O que a multidão diz
“The precise localized edits are the underrated feature. It fixes the line that needs fixing and leaves the rest alone. GPT mini class models keep rewriting half my file.”
“Haiku 4.5 gives me about 90% of Sonnet agentic coding at a third of the price, and it is fast enough that edit loops feel instant. My default for quick fixes now.”
Claude Haiku 4.5: perguntas frequentes
Quanto custa o Claude Haiku 4.5 por 1M de tokens?
O Claude Haiku 4.5 custa $1/1M in por 1M de tokens de entrada e $5/1M out por 1M de tokens de saída. Nível único: $1/1M de entrada, $5/1M de saída; leituras de cache de prompt a $0.10/1M (escritas de 5m a $1.25/1M) e Batch API corta 50% ($0.50/$2.50); sem sobretaxa de contexto longo (máximo de 200K).