Die Arena · KI-Modell im Test

Claude Sonnet 5

von Anthropic

Anthropics agentischstes Sonnet: fast Opus-4.8-Qualität bei Coding und Agents für $3/$15 mit 1M Kontext

Arena-Score 4.4/557% empfehlen es · 3 Stimmen
Reasoning4.5
Coding4.5
Schreiben4.5
Tempo4.0
Preis-Leistung4.5
Claude Sonnet 5 besuchenCoding-AgentsComputer-Use- und Terminal-AgentsLong-Context-Analysekosteneffiziente Wissensarbeit
Preis

$15/1M out ($10 intro until 2026-08-31)

Ein einziger Tarif: $3/$15 pro 1M Tokens standardmäßig, $2/$10 als Einführungspreis bis zum 31. Aug 2026; Batch-API -50%; der neue Tokenizer erzeugt rund 30% mehr Tokens pro Text (1.0-1.35x laut Anthropic), was die effektiven Kosten erhöht.

Anbieter

Anthropic

Kontextfenster

1M tokens (128K max output)

Input-Preis

$3/1M in ($2 intro until 2026-08-31)

Output-Preis

$15/1M out ($10 intro until 2026-08-31)

Modalitäten

text, vision (image input, text output)

Open Weights

Nein

Was ist Claude Sonnet 5?

Anthropics Mittelklasse-Modell, veröffentlicht am 30. Juni 2026 als Nachfolger von Sonnet 4.6. Liefert bei agentischem Coding, Tool-Nutzung und Wissensarbeit eine Leistung nahe an Opus 4.8, zu Sonnet-Preisen. 1M Token Kontext, 128K max. Output, adaptives Thinking standardmäßig aktiv.

Claude Sonnet 5: Vor- und Nachteile

Vorteile

  • Große agentische Zugewinne gegenüber Sonnet 4.6: Terminal-Bench 2.1 80.4% statt 67.0%, OSWorld-Verified 81.2% statt 78.5%, SWE-bench Pro 63.2% statt 58.1%
  • Erreicht Opus 4.8 bei Wissensarbeit (GDPval-AA v2: 1,618 vs 1,615) und liegt bei Humanity's Last Exam mit Tools fast gleichauf (57.4% vs 57.9%), zu 60% des Preises von Opus 4.8 (40% im Einführungszeitraum)
  • 1M Token Kontextfenster und 128K max. Output; Einführungspreis von $2/$10 pro 1M Tokens bis zum 31. Aug 2026
  • Beharrliches, selbstprüfendes Agent-Verhalten: Praxistests zeigen, dass es den eigenen Code testet und an harten Problemen bis zur Lösung iteriert, anders als Sonnet 4.6
  • Erstes Sonnet mit der Effort-Stufe xhigh und hochauflösender Vision (Bilder bis 2576px); adaptives Thinking standardmäßig aktiviert
  • Höhere Code-Review-Präzision als Sonnet 4.6 (38-40% statt 29%), mit weniger False-Positive-Befunden

Nachteile

  • Der neue Tokenizer bläht die Token-Zahl für denselben Text um rund 30% auf (1.0-1.35x laut Anthropic; ~1.4x Englisch, ~1.28x Python gemessen von Simon Willison), was die effektiven Kosten trotz unverändertem Listenpreis erhöht
  • Wortreich und token-hungrig: ~$2.29 pro Aufgabe statt ~$1.20 bei Sonnet 4.6 in unabhängigen Tests (Platz 101 von 161 bei der Kosteneffizienz); bei hohem Effort können die Kosten pro Aufgabe über Opus 4.8 liegen
  • Messbar langsamer als Sonnet 4.6 bei kleinen Routine-Edits und neigt zum Over-Engineering einfacher Aufgaben (Praxistest von CodeRabbit)
  • Sampling-Parameter (temperature, top_p, top_k) entfernt; Nicht-Standardwerte liefern einen 400-Fehler und brechen bestehende Pipelines
  • Gemischte Launch-Stimmung auf HN/Reddit: Das Label '5' galt als vollmundig, und striktere Cybersecurity-Schutzmechanismen können harmlose sicherheitsnahe Arbeit verweigern

Das Urteil der Arena

Wählen Sie Sonnet 5, wenn Sie Coding-, Terminal- oder Computer-Use-Agents betreiben und fast Opus-4.8-Qualität zu Sonnet-Preisen wollen, besonders im Einführungszeitraum mit $2/$10; auf low und medium Effort ist es ein striktes Upgrade gegenüber Sonnet 4.6. Kalkulieren Sie den neuen Tokenizer und die Wortfülle ein: Die realen Kosten pro Aufgabe liegen deutlich über Sonnet 4.6, und auf den höchsten Effort-Stufen kann Opus 4.8 pro gelöster Aufgabe das bessere Geschäft sein. Meiden Sie es für latenzsensible kleine Edits oder Pipelines, die auf temperature und top_p angewiesen sind, denn diese liefern jetzt Fehler. Sonnet 4.6 bleibt die pragmatische Wahl für Workloads mit vielen winzigen Diffs.

Daumen hoch oder Daumen runter

Fällen Sie Ihr Urteil

Würden Sie Claude Sonnet 5 empfehlen oder die Menge davor warnen?

57%Crowd-Score · 3

Top-Alternativen zu Claude Sonnet 5

Alle Alternativen
1
Claude Haiku 4.5

Anthropics schnellstes Modell: etwa 90% der Coding-Stärke von Sonnet 4.5 für $1/$5 pro 1M Tokens, 200K Kontext.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropics Mythos-Klasse-Flaggschiff vom Juni 2026: 80.3% auf SWE-bench Pro, 11 Punkte vor jedem anderen Frontier-Modell

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropics Opus vom April 2026: 87.6% SWE-bench Verified, 1M Kontext, hochauflösende Vision, inzwischen hinter Opus 4.8

$25/1M out57%(3)
Visit

Claude Sonnet 5 im direkten Vergleich

Was die Menge sagt

Käpt'n Churn

Cheap per token, pricey per task. Independent tests had it near $2.29 a task vs $1.20 on 4.6, and at high effort it can out-cost Opus 4.8. It will not stop talking.

Goldener Daumicus

Terminal-Bench going 67 to 80 over Sonnet 4.6 matches what I see. My CI-fix agent went from constant babysitting to mostly hands-off overnight.

Sankt Deployus

Matches Opus 4.8 on knowledge work at 60% of the price, and the intro $2/$10 window makes it silly value. My research agent runs on Sonnet 5 now, zero regrets.

Claude Sonnet 5: häufige Fragen

Was kostet Claude Sonnet 5 pro 1M Tokens?

Claude Sonnet 5 kostet $3/1M in ($2 intro until 2026-08-31) pro 1M Input-Tokens und $15/1M out ($10 intro until 2026-08-31) pro 1M Output-Tokens. Ein einziger Tarif: $3/$15 pro 1M Tokens standardmäßig, $2/$10 als Einführungspreis bis zum 31. Aug 2026; Batch-API -50%; der neue Tokenizer erzeugt rund 30% mehr Tokens pro Text (1.0-1.35x laut Anthropic), was die effektiven Kosten erhöht.