De arena · AI-model review
Claude Haiku 4.5
door Anthropic
Anthropics snelste model: ongeveer 90% van de programmeerkwaliteit van Sonnet 4.5 voor $1/$5 per 1M tokens, 200K context.
$5/1M out
Eén tarief: $1/1M input, $5/1M output; prompt cache reads $0.10/1M (5m writes $1.25/1M) en de Batch API haalt er 50% af ($0.50/$2.50); geen long-context-toeslag (200K max).
Anthropic
200K tokens
$1/1M in
$5/1M out
text, vision (input); text output
Nee
Wat is Claude Haiku 4.5?
Klein, op snelheid gericht Claude-model, uitgebracht op 15 oktober 2025. Scoort 73.3% op SWE-bench Verified, ruwweg 90% van de agentische programmeerprestaties van Sonnet 4.5 tegen een derde van de kosten. Ondersteunt vision-input en extended thinking, met een 200K context window en 64K max output.
Voor- en nadelen van Claude Haiku 4.5
Pluspunten
- 73.3% op SWE-bench Verified, ongeveer 90% van het agentisch programmeren van Sonnet 4.5 voor een derde van de prijs
- Snel: meer dan 2x de snelheid van Sonnet 4 volgens Anthropic, met lanceringsklanten die 4-5x sneller dan Sonnet 4.5 melden; ~92-110 output tok/s gemeten door Artificial Analysis
- Devs melden precieze, lokale codewijzigingen die irrelevante code met rust laten, beter dan de GPT-5 mini-klasse in vroege tests
- Ondersteunt zowel vision-input als extended thinking, zeldzaam in deze prijsklasse bij lancering
- Zeer geschikt als werkmodel in multi-agent-opstellingen (Sonnet/Opus plant, parallelle Haiku-subagents voeren uit)
- Prompt cache reads voor $0.10/1M en 50% Batch API-korting drukken de effectieve kosten verder
Minpunten
- $5/1M output is prijzig voor een klein model: de Gemini Flash- en GPT mini-klassen zijn meermaals goedkoper op output-zware taken
- 200K context (tegenover 1M voor de Sonnet 5/Opus-broers) en 64K max output beperken werk aan grote codebases en lange output
- Middelmatig redeneren over domeinen heen: gebruikers melden zwakke resultaten op kennistaken in de stijl van GPQA, MedQA en MMMU
- Doorvoersnelheid varieert flink in de praktijk (82-208 tok/s gemeld) en de kwaliteit zakt bij lange agentsessies van 7-8+ minuten
- De knowledge cutoff (betrouwbaar tot feb 2025) is gedateerd naar de maatstaven van medio 2026
Het verdict van de arena
Kies Haiku 4.5 als je op de Anthropic-stack zit en bijna-Sonnet-programmeerkwaliteit nodig hebt met lage latency voor een derde van de prijs: het is een enorme stap vooruit ten opzichte van Haiku 3.5 en blinkt uit als werkmodel in multi-agent-pipelines. Het is per juli 2026 nog steeds Anthropics huidige kleine model, dus de standaard goedkope laag voor producten op basis van Claude. Vermijd het voor diep redeneren over domeinen heen, zeer grote codebases (plafond van 200K context) of puur shoppen op prijs per token, waar de Gemini Flash- en GPT mini-klassen inmiddels goedkoper zijn, en stap op naar Sonnet 5 wanneer kwaliteit zwaarder weegt dan snelheid.
Duim omhoog of duim omlaag
Vel je verdict
Zou je Claude Haiku 4.5 aanraden, of waarschuw je het publiek?
Beste alternatieven voor Claude Haiku 4.5
Alle alternatievenAnthropics Mythos-klasse vlaggenschip van juni 2026: 80.3% op SWE-bench Pro, 11 punten voor op elk ander frontier-model
Anthropics Opus van april 2026: 87.6% SWE-bench Verified, 1M context, high-res vision, inmiddels voorbijgestreefd door Opus 4.8
Anthropics meest agentische Sonnet: bijna Opus 4.8-kwaliteit op programmeren en agents voor $3/$15 met 1M context
Vergelijk Claude Haiku 4.5 een-op-een
Wat het publiek zegt
“The precise localized edits are the underrated feature. It fixes the line that needs fixing and leaves the rest alone. GPT mini class models keep rewriting half my file.”
“Haiku 4.5 gives me about 90% of Sonnet agentic coding at a third of the price, and it is fast enough that edit loops feel instant. My default for quick fixes now.”
Claude Haiku 4.5: veelgestelde vragen
Hoeveel kost Claude Haiku 4.5 per 1M tokens?
Claude Haiku 4.5 kost $1/1M in per 1M input tokens en $5/1M out per 1M output tokens. Eén tarief: $1/1M input, $5/1M output; prompt cache reads $0.10/1M (5m writes $1.25/1M) en de Batch API haalt er 50% af ($0.50/$2.50); geen long-context-toeslag (200K max).