A arena · análise de modelo de IA

Claude Haiku 4.5

por Anthropic

O modelo mais rápido da Anthropic: cerca de 90% da habilidade de código do Sonnet 4.5 a $1/$5 por 1M de tokens, contexto de 200K.

Pontuação da arena 3.6/567% recomendam · 2 votos
Raciocínio3.0
Programação3.5
Escrita3.0
Velocidade4.5
Custo-benefício4.0
Visitar Claude Haiku 4.5cargas de API de alto volume e sensíveis a latênciaorquestração de subagentes e uso agêntico de ferramentasedições de código delimitadas e code reviewassistentes de chat em tempo real
Preço

$5/1M out

Nível único: $1/1M de entrada, $5/1M de saída; leituras de cache de prompt a $0.10/1M (escritas de 5m a $1.25/1M) e Batch API corta 50% ($0.50/$2.50); sem sobretaxa de contexto longo (máximo de 200K).

Provedor

Anthropic

Janela de contexto

200K tokens

Preço de entrada

$1/1M in

Preço de saída

$5/1M out

Modalidades

text, vision (input); text output

Open weights

Não

O que é o Claude Haiku 4.5?

Modelo Claude pequeno e focado em velocidade, lançado em 15 de outubro de 2025. Marca 73.3% no SWE-bench Verified, aproximadamente 90% do desempenho em código agêntico do Sonnet 4.5 por um terço do custo. Suporta entrada de visão e extended thinking, com janela de contexto de 200K e saída máxima de 64K.

Claude Haiku 4.5: prós e contras

Prós

  • 73.3% no SWE-bench Verified, cerca de 90% do código agêntico do Sonnet 4.5 por um terço do preço
  • Rápido: mais de 2x a velocidade do Sonnet 4 segundo a Anthropic, com clientes de lançamento reportando 4-5x mais rápido que o Sonnet 4.5; ~92-110 tokens de saída/s medidos pela Artificial Analysis
  • Devs relatam edições de código precisas e localizadas que evitam mexer em código irrelevante, melhor que a classe GPT-5 mini nos primeiros testes
  • Suporta entrada de visão e extended thinking, algo raro nessa faixa de preço no lançamento
  • Muito adequado como modelo operário em arranjos multi-agente (Sonnet/Opus planejam, subagentes Haiku paralelos executam)
  • Leituras de prompt caching a $0.10/1M e desconto de 50% na Batch API reduzem ainda mais o custo efetivo

Contras

  • $5/1M de saída é caro para um modelo pequeno: os níveis Gemini Flash e GPT mini custam várias vezes menos em tarefas pesadas em saída
  • Contexto de 200K (contra 1M dos irmãos Sonnet 5/Opus) e saída máxima de 64K limitam trabalho em bases de código grandes e com saídas longas
  • Raciocínio interdomínios mediano: usuários relatam resultados fracos em tarefas de conhecimento do tipo GPQA, MedQA, MMMU
  • A vazão varia muito na prática (82-208 tok/s reportados) e a qualidade degrada em sessões agênticas longas de 7-8+ minutos
  • O cutoff de conhecimento (confiável até fev 2025) está defasado para os padrões de meados de 2026

O veredicto da arena

Escolha o Haiku 4.5 se você está no stack da Anthropic e precisa de qualidade de código quase nível Sonnet com baixa latência por um terço do preço: é um salto enorme sobre o Haiku 3.5 e brilha como modelo operário em pipelines multi-agente. Ele continua sendo o modelo pequeno atual da Anthropic em julho de 2026, então é o nível barato padrão para produtos baseados em Claude. Evite-o para raciocínio interdomínios profundo, bases de código muito grandes (teto de 200K de contexto) ou pura caça ao menor custo por token, onde os níveis Gemini Flash e GPT mini hoje são mais baratos, e suba para o Sonnet 5 quando qualidade importa mais que velocidade.

Polegar para cima ou para baixo

Dê seu veredicto

Você recomendaria o Claude Haiku 4.5 ou avisaria a multidão para ficar longe?

67%pontuação da multidão · 2

Melhores alternativas ao Claude Haiku 4.5

Todas as alternativas
1
Claude Fable 5

O carro-chefe da classe Mythos da Anthropic de junho de 2026: 80.3% no SWE-bench Pro, 11 pontos à frente de todos os outros modelos de fronteira

$50/1M out63%(4)
Visit
2
Claude Opus 4.7

O Opus da Anthropic de abril de 2026: 87.6% no SWE-bench Verified, contexto de 1M, visão de alta resolução, hoje atrás do Opus 4.8

$25/1M out57%(3)
Visit
3
Claude Sonnet 5

O Sonnet mais agêntico da Anthropic: qualidade próxima do Opus 4.8 em código e agentes a $3/$15 com contexto de 1M

$15/1M out ($10 intro until 2026-08-31)57%(3)
Visit

Compare o Claude Haiku 4.5 frente a frente

O que a multidão diz

Guardião do Repo

The precise localized edits are the underrated feature. It fixes the line that needs fixing and leaves the rest alone. GPT mini class models keep rewriting half my file.

Campeão das Vibes

Haiku 4.5 gives me about 90% of Sonnet agentic coding at a third of the price, and it is fast enough that edit loops feel instant. My default for quick fixes now.

Claude Haiku 4.5: perguntas frequentes

Quanto custa o Claude Haiku 4.5 por 1M de tokens?

O Claude Haiku 4.5 custa $1/1M in por 1M de tokens de entrada e $5/1M out por 1M de tokens de saída. Nível único: $1/1M de entrada, $5/1M de saída; leituras de cache de prompt a $0.10/1M (escritas de 5m a $1.25/1M) e Batch API corta 50% ($0.50/$2.50); sem sobretaxa de contexto longo (máximo de 200K).