Die Arena · KI-Modell im Test

Claude Opus 5

von Anthropic

Anthropics Opus-Auffrischung vom Juli 2026: nahezu die Intelligenz von Fable 5 zum halben Preis, weiterhin $5/$25 wie bei Opus 4.8

Arena-Score 4/563% empfehlen es · 4 Stimmen
Reasoning5.0
Coding5.0
Schreiben4.0
Tempo2.0
Preis-Leistung4.0
Claude Opus 5 besuchenalltägliches Frontier-Coding und Agenten ohne den Preis von Fable 5Wissensarbeit im Unternehmen (Dokumente, Tabellen, Präsentationen)Teams, die bei Fable 5 auf Falsch-Positive der Klassifizierer stoßenMulti-Agenten-Orchestrierung und Writer-Verifier-Muster
Preis

$25/1M out

Offizieller Anthropic-API-Listenpreis für claude-opus-5: $5/1M Eingabe, $25/1M Ausgabe, unverändert gegenüber Opus 4.8, eine einzige Stufe mit 1M Kontext als Standard- und Maximalwert, 128K maximale Ausgabe, Prompt-Caching ab 512 Tokens. Der Research-Preview-Fast-Modus zu $10/$50 (rund 2,5-mal schneller) ist ausschließlich über die Claude-API verfügbar. Geprüft anhand von platform.claude.com (What's new in Opus 5), Stand Juli 2026.

Anbieter

Anthropic

Kontextfenster

1M tokens

Input-Preis

$5/1M in

Output-Preis

$25/1M out

Modalitäten

text, vision

Open Weights

Nein

Was ist Claude Opus 5?

Veröffentlicht am 24.07.2026 als direkter Nachfolger von Opus 4.8 in Anthropics Series-5-Reihe (Mythos 5, Fable 5, Sonnet 5, Opus 5). API-ID claude-opus-5: $5/$25 pro 1M Tokens (unverändert gegenüber Opus 4.8), 1M Kontext als Standard- und Maximalwert zugleich, 128K maximale Ausgabe, Thinking standardmäßig aktiv mit einer fünfstufigen Effort-Skala (low bis max). Positioniert als nahezu Frontier-Intelligenz zum halben Preis von Fable 5: Das Modell schlägt Fable 5 tatsächlich bei Frontier-Bench (43,3 % vs. 33,7 %) und GDPval-AA v2 (Elo 1861 vs. 1747), liegt bei SWE-bench Pro aber leicht dahinter (79,2 % vs. 80,0 %). Sicherheitsklassifizierer lösen 85 % seltener aus als bei Fable 5, und ein standardmäßiger Fallback-Modus verhindert stille Ablehnungsfehler.

Claude Opus 5: Vor- und Nachteile

Vorteile

  • Beim Launch Platz 1 in der Composite-Intelligence-Wertung über 190 Modelle bei Artificial Analysis, mit 43,3 % auf Frontier-Bench v0.1 gegenüber 34,4 % für GPT-5.6 Sol und 33,7 % für Claude Fable 5
  • 3,9-mal besser als GPT-5.6 Sol bei ARC-AGI-3 (neuartiges Schlussfolgern, 30,2 % vs. 7,8 %) und Elo 1861 bei GDPval-AA v2 für wirtschaftliche Wissensarbeit, vor Fable 5 (1747)
  • 79,2 % auf SWE-bench Pro, nur einen Punkt hinter Fable 5 (80,0 %) und 10 Punkte über Opus 4.8 (69,2 %), zum halben Preis von Fable 5; Cursors Mitgründer nennt es 'nahezu die Intelligenz von Fable 5 bei Geschwindigkeit und Kosten von Opus'
  • Gleiches Preismodell wie Opus 4.8 ($5/$25), aber größeres Fenster: 1M Kontext ist jetzt Standard- und einzige Stufe, mit 128K maximaler Ausgabe und Prompt-Caching ab 512 Tokens
  • Dual-Use-Sicherheitsklassifizierer lösen 85 % seltener aus als bei Fable 5, und der neue standardmäßige Fallback-Modus verhindert die stillen Ablehnungen mitten in der Sitzung, die den Start von Fable 5 belasteten
  • Überprüft die eigene Arbeit ohne Aufforderung, verarbeitet Tool-Wechsel mitten im Gespräch (Beta), ohne den Prompt-Cache zu zerstören, und ist ab Tag eins auf Claude.ai, der API, Bedrock, Vertex und Microsoft Foundry verfügbar

Nachteile

  • Auffällig langsam und sehr wortreich: 52,6 Ausgabe-Tokens/s und 68 Sekunden bis zum ersten Token bei Artificial Analysis, dabei verbrauchte das Modell im Test rund 100 Mio. Ausgabe-Tokens gegenüber einem Median von 63 Mio.
  • Die Wortfülle ist ein reales Kostenproblem: CodeRabbit maß rund 50 % mehr Lesevolumen und 65 % mehr Schreibvolumen pro Code-Review-Aufruf im Vergleich zu Referenz-Frontier-Modellen
  • Trotz der 'kosteneffizienten' Erzählung keine echte Preissenkung: identisch mit Opus 4.8 ($5/$25), nahe am Preis von GPT-5.6 ($5/$30) und mehr als doppelt so teuer wie vergleichbare Gemini- oder Grok-Stufen
  • Rezensenten beschreiben eine 'brillante, aber nervige' Persönlichkeit: Übervorsichtigkeit, Zurückhaltung und gelegentliche Ablehnung banaler Aufgaben wie das Lösen eines Merge-Konflikts (Feldtest von Lenny's Newsletter)
  • Breaking API-Änderung für Umsteiger von Opus 4.8: Thinking ist standardmäßig aktiv und lässt sich bei xhigh oder max Effort nicht deaktivieren (liefert einen 400-Fehler); der Fast-Modus ($10/$50, rund 2,5-mal schneller) ist nur über die API verfügbar, nicht auf Bedrock oder Vertex

Das Urteil der Arena

Claude Opus 5 ist die vernünftige Standardwahl der Series-5-Reihe: fast die gesamte Intelligenz von Fable 5 (bei Frontier-Bench und GDPval sogar mehr) zum exakt halben Token-Preis, mit Klassifizierern, die 85 % seltener auslösen. Wer Workloads wegen der Fähigkeiten zu Fable 5 migriert hat, aber die Rechnung oder die Falsch-Positiv-Ablehnungen stört, sollte sie hierher verlegen; wer noch bei Opus 4.8 ist, bekommt 10 SWE-bench-Pro-Punkte gratis dazu. Zwei ehrliche Gründe sprechen für eine andere Wahl: Latenz und Wortfülle. Mit 52,6 Tokens/s und 68 Sekunden bis zum ersten Token eignet es sich schlecht für interaktive UX, und sein Token-Appetit treibt die realen Kosten still über den Listenpreis hinaus, weshalb budgetsensible Pipelines mit hohem Volumen weiterhin bei Sonnet 5, Gemini oder DeepSeek besser aufgehoben sind. Fable 5 bleibt nur für die längsten autonomen Läufe sinnvoll, bei denen sein leichter Vorsprung bei SWE-bench Pro sich summiert.

Daumen hoch oder Daumen runter

Fällen Sie Ihr Urteil

Würden Sie Claude Opus 5 empfehlen oder die Menge davor warnen?

63%Crowd-Score · 4

Top-Alternativen zu Claude Opus 5

Alle Alternativen
1
Claude Haiku 4.5

Anthropics schnellstes Modell: etwa 90% der Coding-Stärke von Sonnet 4.5 für $1/$5 pro 1M Tokens, 200K Kontext.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropics Mythos-Klasse-Flaggschiff vom Juni 2026: 80.3% auf SWE-bench Pro, 11 Punkte vor jedem anderen Frontier-Modell

$50/1M out63%(4)
Visit
3
Kimi K3

Moonshots MoE-Modell mit 2,8 Billionen Parametern, das den 'neuen DeepSeek-Moment' auslöste: frontiernahe Werte für $3/$15

$15/1M out57%(3)
Visit

Claude Opus 5 im direkten Vergleich

Was die Menge sagt

Daumen Runtericus

The sticker price is unchanged but my invoice is not: it writes essays where Opus 4.8 wrote answers. 68 seconds to first token killed it for our support chat, we went back to Sonnet 5.

Der Faire Richter

Fed it a 40-tab financial model with cross-sheet formulas and asked for a scenario deck. It got the edge cases the analysts missed. For document-heavy enterprise work this is the best model I have used.

Sir Shipt-Viel

We moved off Fable 5 because the bio classifier kept flagging our genomics tooling. Opus 5 does the same work at half the price and I have not seen a single silent reroute since.

Wächter des Repos

Migrated our agents from Opus 4.8 the day it dropped. Same bill, and tasks that used to stall at the planning stage now just finish. The 10-point SWE-bench jump is not marketing, our merge queue feels it.

Claude Opus 5: häufige Fragen

Was kostet Claude Opus 5 pro 1M Tokens?

Claude Opus 5 kostet $5/1M in pro 1M Input-Tokens und $25/1M out pro 1M Output-Tokens. Offizieller Anthropic-API-Listenpreis für claude-opus-5: $5/1M Eingabe, $25/1M Ausgabe, unverändert gegenüber Opus 4.8, eine einzige Stufe mit 1M Kontext als Standard- und Maximalwert, 128K maximale Ausgabe, Prompt-Caching ab 512 Tokens. Der Research-Preview-Fast-Modus zu $10/$50 (rund 2,5-mal schneller) ist ausschließlich über die Claude-API verfügbar. Geprüft anhand von platform.claude.com (What's new in Opus 5), Stand Juli 2026.