Hall of Fame · Live-Crowd-Ranking

Die LLM-Modelle Rangliste

Jeder Kandidat dieser Arena, live gerankt nach echten Urteilen der Menge: empfehlen oder meiden, ein Urteil pro Person. Die Reihenfolge bewegt sich mit jeder Stimme.

Aktualisiert am 21. Juli 2026

Lieber eine kuratierte Shortlist?Beste LLM-Modelle
  1. Claude Haiku 4.5

    Anthropics schnellstes Modell: etwa 90% der Coding-Stärke von Sonnet 4.5 für $1/$5 pro 1M Tokens, 200K Kontext.

    Reasoning3.0
    Coding3.5
    Schreiben3.0
    Tempo4.5
    Preis-Leistung4.0
    Preis$5/1M out
  2. 2
    Claude Fable 5

    Anthropics Mythos-Klasse-Flaggschiff vom Juni 2026: 80.3% auf SWE-bench Pro, 11 Punkte vor jedem anderen Frontier-Modell

    Reasoning5.0
    Coding5.0
    Schreiben4.5
    Tempo2.0
    Preis-Leistung3.0
    Preis$50/1M out
  3. 3
    Claude Opus 4.7

    Anthropics Opus vom April 2026: 87.6% SWE-bench Verified, 1M Kontext, hochauflösende Vision, inzwischen hinter Opus 4.8

    Reasoning4.5
    Coding4.5
    Schreiben4.5
    Tempo2.5
    Preis-Leistung3.0
    Preis$25/1M out
  4. 4
    Claude Sonnet 5

    Anthropics agentischstes Sonnet: fast Opus-4.8-Qualität bei Coding und Agents für $3/$15 mit 1M Kontext

    Reasoning4.5
    Coding4.5
    Schreiben4.5
    Tempo4.0
    Preis-Leistung4.5
    Preis$15/1M out ($10 intro until 2026-08-31)
  5. 5
    Gemini 3 Pro

    Googles Frontier-Modell vom Nov 2025: 1M Kontext, als erstes über 1500 Elo auf LMArena, ersetzt durch Gemini 3.1 Pro.

    Reasoning4.5
    Coding4.5
    Schreiben3.5
    Tempo3.5
    Preis-Leistung4.0
    Preis$12/1M out (prompts ≤200K)
  6. 6
    DeepSeek-V4

    Open-Weights-MoE mit 1.6T Parametern, 1M Token Kontext und fast Frontier-Niveau beim agentischen Coding für $0.87 pro 1M Output-Tokens

    Reasoning4.5
    Coding4.5
    Schreiben3.5
    Tempo3.0
    Preis-Leistung5.0
    Preis$0.87/1M out
  7. 7
    Claude Opus 4.8

    Anthropics Flaggschiff der Opus-Klasse für langlaufendes agentisches Coding; 1M Kontext für $5/$25 pro 1M Tokens.

    Reasoning4.5
    Coding5.0
    Schreiben5.0
    Tempo3.0
    Preis-Leistung3.5
    Preis$25/1M out
  8. 8
    GPT-5.5

    OpenAIs agentisches Flaggschiff: 1M Kontext, SOTA auf ARC-AGI-2 und Terminal-Bench 2.0, $5/$30 pro 1M Tokens.

    Reasoning5.0
    Coding4.5
    Schreiben4.0
    Tempo3.5
    Preis-Leistung3.0
    Preis$30/1M out
  9. 9
    Claude Opus 4.5

    Anthropics Frontier-Coder vom Nov 2025: als erstes Modell über 80% auf SWE-bench Verified, 66% günstiger als Opus 4.1

    Reasoning3.5
    Coding3.5
    Schreiben3.5
    Tempo2.5
    Preis-Leistung2.5
    Preis$25/1M out
  10. 10
    GPT-5.2

    OpenAIs Frontier-Modell vom Dez 2025: 400K Kontext, 80% SWE-bench Verified, starkes Reasoning, aber langsamer Output.

    Reasoning4.0
    Coding4.0
    Schreiben3.5
    Tempo2.5
    Preis-Leistung3.5
    Preis$14/1M out
  11. 11
    Grok 4.3

    xAIs 1M-Kontext-Frontier-Modell für $1.25/$2.50 pro 1M Tokens, optimiert für agentische Tool-Nutzung.

    Reasoning4.0
    Coding3.5
    Schreiben4.5
    Tempo3.5
    Preis-Leistung4.5
    Preis$2.50/1M out
  12. 12
    Claude Opus 4.6

    Anthropics Opus vom Feb 2026: 1M Kontext, adaptives Thinking, 80.8% SWE-bench, inzwischen abgelöst von Opus 4.8.

    Reasoning4.0
    Coding4.0
    Schreiben4.0
    Tempo2.5
    Preis-Leistung3.0
    Preis$25/1M out
  13. 13
    Gemini 3.5 Flash

    Googles Flaggschiff der Tempo-Klasse: schlägt Gemini 3.1 Pro beim agentischen Coding für $1.50/$9, 3x teurer als 3 Flash

    Reasoning3.5
    Coding4.0
    Schreiben3.0
    Tempo5.0
    Preis-Leistung4.5
    Preis$9.00/1M out
  14. 14
    Llama 4 (Scout / Maverick)

    Metas Open-Weight-MoE-Duo: 17B aktive Parameter, native Bildeingabe, 10M Token Kontext auf dem Papier

    Reasoning2.5
    Coding2.0
    Schreiben2.5
    Tempo4.5
    Preis-Leistung3.5
    Preis$0.60/1M out (Maverick, hosted)
  15. 15
    Mistral Large 3

    Open-Weight-Flaggschiff mit 675B MoE (41B aktiv), 256K Kontext, Bildeingabe und Preisen von $0.50/$1.50 pro 1M.

    Reasoning3.0
    Coding3.0
    Schreiben4.0
    Tempo3.5
    Preis-Leistung4.0
    Preis$1.50/1M out