Die Arena · KI-Modell im Test

Claude Opus 4.6

von Anthropic

Anthropics Opus vom Feb 2026: 1M Kontext, adaptives Thinking, 80.8% SWE-bench, inzwischen abgelöst von Opus 4.8.

Arena-Score 3.5/5
Reasoning4.0
Coding4.0
Schreiben4.0
Tempo2.5
Preis-Leistung3.0
Claude Opus 4.6 besuchenagentisches CodingLong-Context-Analysemehrstufige Agent-WorkflowsRefactoring großer Codebasen
Preis

$25/1M out

Standardtarif $5/$25 pro 1M Tokens; der volle 1M-Kontext inzwischen zum Standardtarif (der Aufschlag von $10/$37.50 oberhalb von 200K Tokens aus der Startphase wurde später gestrichen), Batch-API 50% günstiger ($2.50/$12.50), US-only-Inferenz (inference_geo) mit Faktor 1.1x.

Anbieter

Anthropic

Kontextfenster

1M tokens (128K max output)

Input-Preis

$5/1M in

Output-Preis

$25/1M out

Modalitäten

text, vision (image input), text output

Open Weights

Nein

Was ist Claude Opus 4.6?

Frontier-Modell der Opus-Klasse, veröffentlicht am 5. Februar 2026. Erstes Opus mit 1M-Token-Kontextfenster, adaptivem Thinking und einem Effort-Parameter (low bis max). Erreichte zum Start 80.8% auf SWE-bench Verified und den Spitzenwert auf Terminal-Bench 2.0; später abgelöst von Opus 4.7 und 4.8 zum identischen Preis.

Claude Opus 4.6: Vor- und Nachteile

Vorteile

  • 80.8% SWE-bench Verified (Durchschnitt aus 25 Durchläufen) und Spitzenwert auf Terminal-Bench 2.0 zum Start, das führende agentische Coding-Modell seiner Generation (Feb 2026)
  • Erstes Opus mit 1M-Token-Kontextfenster: 76% auf MRCR v2 8-needle bei 1M Tokens gegenüber 18.5% bei Sonnet 4.5
  • Großer Reasoning-Sprung gegenüber Opus 4.5: ARC-AGI-2 68.8% statt 37.6%, +190 Elo auf GDPval-AA-Aufgaben mit wirtschaftlichem Wert (~144 Elo vor GPT-5.2)
  • Behielt trotz der Zugewinne die Preise von Opus 4.5 bei ($5/$25 pro 1M Tokens); der volle 1M-Kontext wird inzwischen zum Standardtarif abgerechnet, 50% Batch-Rabatt
  • Adaptives Thinking plus Effort-Parameter (low/medium/high/max), um Intelligenz, Latenz und Kosten pro Anfrage auszubalancieren
  • Starkes autonomes Agent-Verhalten: parallelisiert Arbeit und braucht weniger Betreuung als Opus 4.5 (Every.to Vibe Check)

Nachteile

  • Langsamer und wortreicher als Opus 4.5; Tester berichten, das Tempo 'schwankt unter Last' bei langen agentischen Läufen (Every.to)
  • Rückschritt beim Schreiben: In Blindtests bevorzugte das Team von Every.to die Prosa von Opus 4.5, und 4.6 zeigt mehr KI-Floskeln wie 'X, nicht Y'-Konstruktionen
  • Nimmt manchmal unerwartete Änderungen vor und 'kennt die eigenen Fähigkeiten nicht immer', was laut Testern engere Aufsicht erfordert als GPT-5.x Codex
  • Innerhalb weniger Monate von Opus 4.7 und 4.8 zum gleichen Preis von $5/$25 abgelöst, und der Fast Mode ist auf 4.6 seit Juni 2026 nicht verfügbar (Anfragen laufen mit Standardtempo)
  • Manche Entwickler berichten von Benchmark-Müdigkeit: Die Coding-Zugewinne gegenüber 4.5 sind im Alltag schwerer zu spüren, als die Scores nahelegen, und SWE-bench selbst blieb gegenüber 4.5 flach (80.8% vs 80.9%)

Das Urteil der Arena

Ein klares Upgrade gegenüber Opus 4.5 für agentisches Coding und Long-Context-Arbeit zum identischen Preis, und es führte zum Start die agentischen Coding-Benchmarks an. Mitte 2026 gibt es jedoch kaum einen Grund, neue Projekte darauf zu starten: Opus 4.8 kostet die gleichen $5/$25 und übertrifft es auf ganzer Linie, wählen Sie 4.6 also vor allem, um ein bereits validiertes Verhalten zu pinnen. Für Texter ist es keine Empfehlung, da Blindtests die Prosa von Opus 4.5 bevorzugten, und latenzsensible Nutzer sollten wissen, dass es langsamer als 4.5 ist und keinen Fast Mode bietet.

Daumen hoch oder Daumen runter

Fällen Sie Ihr Urteil

Würden Sie Claude Opus 4.6 empfehlen oder die Menge davor warnen?

50%Crowd-Score · 0

Top-Alternativen zu Claude Opus 4.6

Alle Alternativen
1
Claude Haiku 4.5

Anthropics schnellstes Modell: etwa 90% der Coding-Stärke von Sonnet 4.5 für $1/$5 pro 1M Tokens, 200K Kontext.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropics Mythos-Klasse-Flaggschiff vom Juni 2026: 80.3% auf SWE-bench Pro, 11 Punkte vor jedem anderen Frontier-Modell

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropics Opus vom April 2026: 87.6% SWE-bench Verified, 1M Kontext, hochauflösende Vision, inzwischen hinter Opus 4.8

$25/1M out57%(3)
Visit

Claude Opus 4.6 im direkten Vergleich

Claude Opus 4.6: häufige Fragen

Was kostet Claude Opus 4.6 pro 1M Tokens?

Claude Opus 4.6 kostet $5/1M in pro 1M Input-Tokens und $25/1M out pro 1M Output-Tokens. Standardtarif $5/$25 pro 1M Tokens; der volle 1M-Kontext inzwischen zum Standardtarif (der Aufschlag von $10/$37.50 oberhalb von 200K Tokens aus der Startphase wurde später gestrichen), Batch-API 50% günstiger ($2.50/$12.50), US-only-Inferenz (inference_geo) mit Faktor 1.1x.