L'arena · recensione di modello IA
Claude Sonnet 5
di Anthropic
Il Sonnet più agentico di Anthropic: qualità vicina a Opus 4.8 su coding e agenti a $3/$15 con contesto 1M
$15/1M out ($10 intro until 2026-08-31)
Tier unico: $3/$15 per 1M di tokens standard, $2/$10 di lancio fino al 31 ago 2026; Batch API -50%; il nuovo tokenizer produce circa il 30% di tokens in più a parità di testo (1.0-1.35x secondo Anthropic), alzando il costo effettivo.
Anthropic
1M tokens (128K max output)
$3/1M in ($2 intro until 2026-08-31)
$15/1M out ($10 intro until 2026-08-31)
text, vision (image input, text output)
No
Che cos'è Claude Sonnet 5?
Modello di fascia media di Anthropic uscito il 30 giugno 2026, successore di Sonnet 4.6. Offre prestazioni vicine a Opus 4.8 su coding agentico, uso di tool e lavoro di conoscenza a prezzi da Sonnet. Contesto da 1M di tokens, 128K di output max, adaptive thinking attivo di default.
Claude Sonnet 5: pro e contro
Pro
- Grandi progressi agentici rispetto a Sonnet 4.6: Terminal-Bench 2.1 80.4% contro 67.0%, OSWorld-Verified 81.2% contro 78.5%, SWE-bench Pro 63.2% contro 58.1%
- Eguaglia Opus 4.8 sul lavoro di conoscenza (GDPval-AA v2: 1,618 contro 1,615) e quasi lo pareggia su Humanity's Last Exam con tool (57.4% contro 57.9%) al 60% del prezzo di Opus 4.8 (40% durante la finestra di lancio)
- Finestra di contesto da 1M di tokens e 128K di output max; prezzo di lancio di $2/$10 per 1M di tokens fino al 31 ago 2026
- Comportamento da agente auto-verificante e tenace: le recensioni sul campo notano che testa il proprio codice e itera sui problemi difficili fino a risolverli, a differenza di Sonnet 4.6
- Primo Sonnet con livello di effort xhigh e visione ad alta risoluzione (immagini a 2576px); adaptive thinking attivo di default
- Precisione superiore nella code review rispetto a Sonnet 4.6 (38-40% contro 29%), con meno falsi positivi
Contro
- Il nuovo tokenizer gonfia il conteggio dei tokens di circa il 30% a parità di testo (1.0-1.35x secondo Anthropic; ~1.4x in inglese, ~1.28x in Python misurati da Simon Willison), alzando il costo effettivo nonostante il prezzo di listino invariato
- Prolisso e vorace di tokens: ~$2.29 per task contro ~$1.20 di Sonnet 4.6 nei test indipendenti (101° su 161 per efficienza di costo); a effort alto il costo per task può superare Opus 4.8
- Misurabilmente più lento di Sonnet 4.6 sulle piccole modifiche di routine e incline all'over-engineering sui task semplici (recensione hands-on di CodeRabbit)
- Parametri di sampling (temperature, top_p, top_k) rimossi; i valori non di default restituiscono un errore 400, rompendo le pipeline esistenti
- Sentiment al lancio misto su HN/Reddit: l'etichetta '5' è stata vista come una promessa eccessiva, e le protezioni cybersecurity più severe possono rifiutare lavoro benigno vicino alla sicurezza
Il verdetto dell'arena
Scegli Sonnet 5 se usi agenti di coding, da terminale o computer-use e vuoi qualità vicina a Opus 4.8 a prezzi da Sonnet, soprattutto durante la finestra di lancio a $2/$10; è un upgrade netto rispetto a Sonnet 4.6 a effort basso e medio. Metti in conto il nuovo tokenizer e la sua prolissità: i costi reali per task superano di parecchio Sonnet 4.6, e ai livelli di effort più alti Opus 4.8 può essere l'affare migliore per task risolto. Evitalo per le piccole modifiche sensibili alla latenza o per le pipeline che dipendono da temperature e top_p, che ora vanno in errore. Sonnet 4.6 resta la scelta pragmatica per i carichi ad alto volume di micro-diff.
Pollice su o pollice verso
Emetti il tuo verdetto
Consiglieresti Claude Sonnet 5, o metteresti in guardia la folla?
Migliori alternative a Claude Sonnet 5
Tutte le alternativeIl modello più veloce di Anthropic: circa il 90% delle capacità di coding di Sonnet 4.5 a $1/$5 per 1M di tokens, contesto 200K.
Il flagship di classe Mythos di Anthropic di giugno 2026: 80.3% su SWE-bench Pro, 11 punti sopra ogni altro modello di frontiera
L'Opus di Anthropic di aprile 2026: 87.6% su SWE-bench Verified, contesto 1M, visione ad alta risoluzione, ormai dietro a Opus 4.8
Confronta Claude Sonnet 5 testa a testa
Cosa dice la folla
“Cheap per token, pricey per task. Independent tests had it near $2.29 a task vs $1.20 on 4.6, and at high effort it can out-cost Opus 4.8. It will not stop talking.”
“Terminal-Bench going 67 to 80 over Sonnet 4.6 matches what I see. My CI-fix agent went from constant babysitting to mostly hands-off overnight.”
“Matches Opus 4.8 on knowledge work at 60% of the price, and the intro $2/$10 window makes it silly value. My research agent runs on Sonnet 5 now, zero regrets.”
Claude Sonnet 5: domande frequenti
Quanto costa Claude Sonnet 5 per 1M di token?
Claude Sonnet 5 costa $3/1M in ($2 intro until 2026-08-31) per 1M di token in input e $15/1M out ($10 intro until 2026-08-31) per 1M di token in output. Tier unico: $3/$15 per 1M di tokens standard, $2/$10 di lancio fino al 31 ago 2026; Batch API -50%; il nuovo tokenizer produce circa il 30% di tokens in più a parità di testo (1.0-1.35x secondo Anthropic), alzando il costo effettivo.