Hall of Fame · Live-Crowd-Ranking
Die LLM-Modelle Rangliste
Jeder Kandidat dieser Arena, live gerankt nach echten Urteilen der Menge: empfehlen oder meiden, ein Urteil pro Person. Die Reihenfolge bewegt sich mit jeder Stimme.
Aktualisiert am 21. Juli 2026
- Claude Haiku 4.5Besuchen
Anthropics schnellstes Modell: etwa 90% der Coding-Stärke von Sonnet 4.5 für $1/$5 pro 1M Tokens, 200K Kontext.
Reasoning3.0Coding3.5Schreiben3.0Tempo4.5Preis-Leistung4.0Preis$5/1M out - 2Claude Fable 5Besuchen
Anthropics Mythos-Klasse-Flaggschiff vom Juni 2026: 80.3% auf SWE-bench Pro, 11 Punkte vor jedem anderen Frontier-Modell
Reasoning5.0Coding5.0Schreiben4.5Tempo2.0Preis-Leistung3.0Preis$50/1M out - 3Claude Opus 4.7Besuchen
Anthropics Opus vom April 2026: 87.6% SWE-bench Verified, 1M Kontext, hochauflösende Vision, inzwischen hinter Opus 4.8
Reasoning4.5Coding4.5Schreiben4.5Tempo2.5Preis-Leistung3.0Preis$25/1M out - 4Claude Sonnet 5Besuchen
Anthropics agentischstes Sonnet: fast Opus-4.8-Qualität bei Coding und Agents für $3/$15 mit 1M Kontext
Reasoning4.5Coding4.5Schreiben4.5Tempo4.0Preis-Leistung4.5Preis$15/1M out ($10 intro until 2026-08-31) - 5Gemini 3 ProBesuchen
Googles Frontier-Modell vom Nov 2025: 1M Kontext, als erstes über 1500 Elo auf LMArena, ersetzt durch Gemini 3.1 Pro.
Reasoning4.5Coding4.5Schreiben3.5Tempo3.5Preis-Leistung4.0Preis$12/1M out (prompts ≤200K) - 6DeepSeek-V4Besuchen
Open-Weights-MoE mit 1.6T Parametern, 1M Token Kontext und fast Frontier-Niveau beim agentischen Coding für $0.87 pro 1M Output-Tokens
Reasoning4.5Coding4.5Schreiben3.5Tempo3.0Preis-Leistung5.0Preis$0.87/1M out - 7Claude Opus 4.8Besuchen
Anthropics Flaggschiff der Opus-Klasse für langlaufendes agentisches Coding; 1M Kontext für $5/$25 pro 1M Tokens.
Reasoning4.5Coding5.0Schreiben5.0Tempo3.0Preis-Leistung3.5Preis$25/1M out - 8GPT-5.5Besuchen
OpenAIs agentisches Flaggschiff: 1M Kontext, SOTA auf ARC-AGI-2 und Terminal-Bench 2.0, $5/$30 pro 1M Tokens.
Reasoning5.0Coding4.5Schreiben4.0Tempo3.5Preis-Leistung3.0Preis$30/1M out - 9Claude Opus 4.5Besuchen
Anthropics Frontier-Coder vom Nov 2025: als erstes Modell über 80% auf SWE-bench Verified, 66% günstiger als Opus 4.1
Reasoning3.5Coding3.5Schreiben3.5Tempo2.5Preis-Leistung2.5Preis$25/1M out - 10GPT-5.2Besuchen
OpenAIs Frontier-Modell vom Dez 2025: 400K Kontext, 80% SWE-bench Verified, starkes Reasoning, aber langsamer Output.
Reasoning4.0Coding4.0Schreiben3.5Tempo2.5Preis-Leistung3.5Preis$14/1M out - 11Grok 4.3Besuchen
xAIs 1M-Kontext-Frontier-Modell für $1.25/$2.50 pro 1M Tokens, optimiert für agentische Tool-Nutzung.
Reasoning4.0Coding3.5Schreiben4.5Tempo3.5Preis-Leistung4.5Preis$2.50/1M out - 12Claude Opus 4.6Besuchen
Anthropics Opus vom Feb 2026: 1M Kontext, adaptives Thinking, 80.8% SWE-bench, inzwischen abgelöst von Opus 4.8.
Reasoning4.0Coding4.0Schreiben4.0Tempo2.5Preis-Leistung3.0Preis$25/1M out - 13Gemini 3.5 FlashBesuchen
Googles Flaggschiff der Tempo-Klasse: schlägt Gemini 3.1 Pro beim agentischen Coding für $1.50/$9, 3x teurer als 3 Flash
Reasoning3.5Coding4.0Schreiben3.0Tempo5.0Preis-Leistung4.5Preis$9.00/1M out - 14Llama 4 (Scout / Maverick)Besuchen
Metas Open-Weight-MoE-Duo: 17B aktive Parameter, native Bildeingabe, 10M Token Kontext auf dem Papier
Reasoning2.5Coding2.0Schreiben2.5Tempo4.5Preis-Leistung3.5Preis$0.60/1M out (Maverick, hosted) - 15Mistral Large 3Besuchen
Open-Weight-Flaggschiff mit 675B MoE (41B aktiv), 256K Kontext, Bildeingabe und Preisen von $0.50/$1.50 pro 1M.
Reasoning3.0Coding3.0Schreiben4.0Tempo3.5Preis-Leistung4.0Preis$1.50/1M out
Top-Duelle
Direktvergleiche zwischen den Podiumsplätzen.