L'arena · recensione di modello IA
Claude Haiku 4.5
di Anthropic
Il modello più veloce di Anthropic: circa il 90% delle capacità di coding di Sonnet 4.5 a $1/$5 per 1M di tokens, contesto 200K.
$5/1M out
Tier unico: $1/1M in input, $5/1M in output; letture dalla prompt cache a $0.10/1M (scritture 5m a $1.25/1M) e Batch API a metà prezzo ($0.50/$2.50); nessun sovrapprezzo long-context (200K max).
Anthropic
200K tokens
$1/1M in
$5/1M out
text, vision (input); text output
No
Che cos'è Claude Haiku 4.5?
Modello Claude piccolo e votato alla velocità, uscito il 15 ottobre 2025. Segna 73.3% su SWE-bench Verified, circa il 90% delle prestazioni di coding agentico di Sonnet 4.5 a un terzo del costo. Supporta input visivo ed extended thinking, con finestra di contesto da 200K e 64K di output max.
Claude Haiku 4.5: pro e contro
Pro
- 73.3% su SWE-bench Verified, circa il 90% del coding agentico di Sonnet 4.5 a un terzo del prezzo
- Veloce: più di 2x la velocità di Sonnet 4 secondo Anthropic, con i clienti del lancio che riportano 4-5x rispetto a Sonnet 4.5; ~92-110 output tok/s misurati da Artificial Analysis
- Gli sviluppatori riportano modifiche al codice precise e localizzate che evitano di toccare codice non pertinente, meglio della classe GPT-5 mini nei primi test
- Supporta sia input visivo che extended thinking, cosa rara in questa fascia di prezzo al lancio
- Perfetto come modello worker nei setup multi-agente (Sonnet/Opus pianificano, sub-agenti Haiku paralleli eseguono)
- Letture dalla prompt cache a $0.10/1M e sconto Batch API del 50% abbassano ulteriormente il costo effettivo
Contro
- $5/1M in output è caro per un modello piccolo: le fasce Gemini Flash e GPT mini lo battono di svariate volte sui task ad alto volume di output
- Contesto di 200K (contro 1M dei fratelli Sonnet 5/Opus) e output max di 64K limitano il lavoro su grandi codebase e output lunghi
- Ragionamento cross-domain mediocre: gli utenti riportano risultati deboli su task di conoscenza in stile GPQA, MedQA, MMMU
- Throughput molto variabile in pratica (82-208 tok/s riportati) e qualità in calo nelle sessioni agentiche lunghe da 7-8+ minuti
- Cutoff di conoscenza (affidabile fino a feb 2025) datato per gli standard di metà 2026
Il verdetto dell'arena
Scegli Haiku 4.5 se sei sullo stack Anthropic e ti serve qualità di coding quasi da Sonnet a bassa latenza e a un terzo del prezzo: è un enorme passo avanti rispetto a Haiku 3.5 ed eccelle come modello worker nelle pipeline multi-agente. Resta il modello piccolo attuale di Anthropic a luglio 2026, quindi è la fascia economica di default per i prodotti basati su Claude. Evitalo per il ragionamento cross-domain profondo, le codebase molto grandi (tetto di contesto a 200K) o la pura caccia al costo per token, dove le fasce Gemini Flash e GPT mini ora costano meno, e passa a Sonnet 5 quando la qualità conta più della velocità.
Pollice su o pollice verso
Emetti il tuo verdetto
Consiglieresti Claude Haiku 4.5, o metteresti in guardia la folla?
Migliori alternative a Claude Haiku 4.5
Tutte le alternativeIl flagship di classe Mythos di Anthropic di giugno 2026: 80.3% su SWE-bench Pro, 11 punti sopra ogni altro modello di frontiera
L'Opus di Anthropic di aprile 2026: 87.6% su SWE-bench Verified, contesto 1M, visione ad alta risoluzione, ormai dietro a Opus 4.8
Il Sonnet più agentico di Anthropic: qualità vicina a Opus 4.8 su coding e agenti a $3/$15 con contesto 1M
Confronta Claude Haiku 4.5 testa a testa
Cosa dice la folla
“The precise localized edits are the underrated feature. It fixes the line that needs fixing and leaves the rest alone. GPT mini class models keep rewriting half my file.”
“Haiku 4.5 gives me about 90% of Sonnet agentic coding at a third of the price, and it is fast enough that edit loops feel instant. My default for quick fixes now.”
Claude Haiku 4.5: domande frequenti
Quanto costa Claude Haiku 4.5 per 1M di token?
Claude Haiku 4.5 costa $1/1M in per 1M di token in input e $5/1M out per 1M di token in output. Tier unico: $1/1M in input, $5/1M in output; letture dalla prompt cache a $0.10/1M (scritture 5m a $1.25/1M) e Batch API a metà prezzo ($0.50/$2.50); nessun sovrapprezzo long-context (200K max).