Die Arena · KI-Modell im Test

Claude Opus 4.8

von Anthropic

Anthropics Flaggschiff der Opus-Klasse für langlaufendes agentisches Coding; 1M Kontext für $5/$25 pro 1M Tokens.

Arena-Score 4.2/557% empfehlen es · 3 Stimmen
Reasoning4.5
Coding5.0
Schreiben5.0
Tempo3.0
Preis-Leistung3.5
Claude Opus 4.8 besuchenlanglaufende Coding-Agentsgroße Refactorings und Codebase-MigrationenCode-Review und DebuggingEnterprise-Wissensarbeit (Recht, Finanzen, Research)
Preis

$25/1M out

Standardtarif $5/$25 pro 1M Tokens (unverändert gegenüber Opus 4.7); Fast Mode als Research Preview für $10/$50 (gegenüber $30/$150 beim eingestellten Fast-Tarif von Opus 4.7); Batch-API 50% günstiger, also $2.50/$12.50; kein Long-Context-Aufschlag bis 1M Tokens; Prompt-Cache-Lesezugriffe für $0.50/1M.

Anbieter

Anthropic

Kontextfenster

1M tokens (128K max output)

Input-Preis

$5/1M in

Output-Preis

$25/1M out

Modalitäten

text, vision (image input up to 2576px, text output)

Open Weights

Nein

Was ist Claude Opus 4.8?

Anthropics leistungsfähigstes Modell der Opus-Klasse, veröffentlicht am 28. Mai 2026. Optimiert für langlaufendes agentisches Coding, Tool-Nutzung und ehrliche Selbsteinschätzung der eigenen Arbeit, mit 1M-Token-Kontextfenster, 128K max. Output und adaptivem Thinking mit Effort-Steuerung. Behält exakt die API-Oberfläche und die Preise von Opus 4.7.

Claude Opus 4.8: Vor- und Nachteile

Vorteile

  • SWE-Bench Pro 69.2% (gegenüber 64.3% bei Opus 4.7) und schlägt frühere Opus-Modelle auf CursorBench auf jeder Effort-Stufe; starke Praxisberichte zu großen Refactorings und dateiübergreifender Fehlersuche
  • Lässt Mängel im selbst generierten Code etwa 4x seltener unbeanstandet durchgehen als Opus 4.7; großer Sprung beim mathematischen Reasoning (USAMO 2026: 96.7% statt 69.3%)
  • 1M-Token-Kontext und 128K Output zum unveränderten Preis von $5/$25, ohne Long-Context-Aufschlag; Batch-API 50% günstiger ($2.50/$12.50)
  • Fast Mode (Research Preview) liefert bis zu 2.5x Output-Tempo für $10/$50, 3x günstiger als der Fast-Tarif von Opus 4.7 ($30/$150)
  • Einzigartige API-Features für Agents: System-Messages mitten in der Konversation, die den Prompt-Cache erhalten, und Dynamic Workflows, die in Claude Code parallele Subagents starten
  • 84% auf Online-Mind2Web (Browser-Automatisierung) und Rekordwert auf dem Legal Agent Benchmark (erstes Modell über 10% All-Pass); stark bei Enterprise-Wissensarbeit (Box meldet intern 87% statt 77%)

Nachteile

  • Berichte über Regressionen im Turn-by-Turn-Betrieb: übersah offensichtliche Anweisungen in Planungsdokumenten, beantwortete nur einen schmalen Ausschnitt des Ziels und generierte einfache UI im One-Shot schlechter als 4.7
  • Schreibstil von Intensivnutzern kritisiert: übertriebenes Relativieren, überängstliches Redigieren, das 'alles Mutige oder Witzige herausschneidet' (Steve Yegge), und Widerspruchsschleifen selbst gegen gut belegte Thesen
  • Sprachmisch-Macke: Nutzer berichten von zufälligen chinesischen, kyrillischen oder griechischen Einschüben in langen Recherche-Threads
  • Sichtbarer Qualitätsabfall jenseits von ~200K Tokens im Praxiseinsatz, trotz des beworbenen 1M-Fensters
  • Rückschritt auf Vending-Bench: fiel etwa 30x häufiger auf Betrüger-Lieferanten herein als 4.7 und verhandelt schlechter (eine Nebenwirkung des strikteren Ehrlichkeits-Alignments)

Das Urteil der Arena

Ein Drop-in-Upgrade für Nutzer von Opus 4.7: identische API-Oberfläche und $5/$25 mit echten Zugewinnen bei langlaufendem agentischem Coding, Code-Review und Enterprise-Analysen. Wählen Sie es, wenn Sie Claude Code, dateiübergreifende Migrationen, Security-Audits oder Agent-Pipelines betreiben, die über viele Schritte prüfen, handeln und verifizieren. Verzichten Sie darauf für schnelle One-Shot-UI-Snippets oder Prompts, die eng auf das Verhalten von 4.7 abgestimmt sind, wo Nutzer Regressionen melden, und greifen Sie zu Sonnet 5 ($3/$15, Einführungspreis $2/$10 bis Aug 2026), wenn Kosten wichtiger sind als maximale Leistung. Texter, die empfindlich auf Relativieren und überängstliches Redigieren reagieren, könnten seinen Stil frustrierend finden.

Daumen hoch oder Daumen runter

Fällen Sie Ihr Urteil

Würden Sie Claude Opus 4.8 empfehlen oder die Menge davor warnen?

57%Crowd-Score · 3

Top-Alternativen zu Claude Opus 4.8

Alle Alternativen
1
Claude Haiku 4.5

Anthropics schnellstes Modell: etwa 90% der Coding-Stärke von Sonnet 4.5 für $1/$5 pro 1M Tokens, 200K Kontext.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropics Mythos-Klasse-Flaggschiff vom Juni 2026: 80.3% auf SWE-bench Pro, 11 Punkte vor jedem anderen Frontier-Modell

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropics Opus vom April 2026: 87.6% SWE-bench Verified, 1M Kontext, hochauflösende Vision, inzwischen hinter Opus 4.8

$25/1M out57%(3)
Visit

Claude Opus 4.8 im direkten Vergleich

Was die Menge sagt

Richter Gnadenlos

Writing took a hit. It hedges everything and edits any bold or funny line out of my drafts. Also caught it answering a narrow slice of my planning doc and calling it done.

Champion der Vibes

Threw USAMO-level math at it for a lark and it just grinds through. 96.7 vs 69 for 4.7 tracks with what I see. Same $5/$25, 1M context, no excuse not to switch.

Glorius Maximus

Upgraded from 4.7 for a monorepo refactor and the difference is real. It actually flags its own sketchy code instead of shipping it. Multi-file bug hunts feel way less babysat.

Claude Opus 4.8: häufige Fragen

Was kostet Claude Opus 4.8 pro 1M Tokens?

Claude Opus 4.8 kostet $5/1M in pro 1M Input-Tokens und $25/1M out pro 1M Output-Tokens. Standardtarif $5/$25 pro 1M Tokens (unverändert gegenüber Opus 4.7); Fast Mode als Research Preview für $10/$50 (gegenüber $30/$150 beim eingestellten Fast-Tarif von Opus 4.7); Batch-API 50% günstiger, also $2.50/$12.50; kein Long-Context-Aufschlag bis 1M Tokens; Prompt-Cache-Lesezugriffe für $0.50/1M.