Hall of Fame · Live publieksranking
De ranglijst voor LLM-modellen
Elke deelnemer in deze arena, live gerangschikt op echte publieksverdicten: aanraden of afraden, één verdict per persoon. De volgorde verschuift bij elke stem.
Bijgewerkt op 21 juli 2026
- Claude Haiku 4.5Bezoeken
Anthropics snelste model: ongeveer 90% van de programmeerkwaliteit van Sonnet 4.5 voor $1/$5 per 1M tokens, 200K context.
Redeneren3.0Programmeren3.5Schrijven3.0Snelheid4.5Prijs-kwaliteit4.0Prijs$5/1M out - 2Claude Fable 5Bezoeken
Anthropics Mythos-klasse vlaggenschip van juni 2026: 80.3% op SWE-bench Pro, 11 punten voor op elk ander frontier-model
Redeneren5.0Programmeren5.0Schrijven4.5Snelheid2.0Prijs-kwaliteit3.0Prijs$50/1M out - 3Claude Opus 4.7Bezoeken
Anthropics Opus van april 2026: 87.6% SWE-bench Verified, 1M context, high-res vision, inmiddels voorbijgestreefd door Opus 4.8
Redeneren4.5Programmeren4.5Schrijven4.5Snelheid2.5Prijs-kwaliteit3.0Prijs$25/1M out - 4Claude Sonnet 5Bezoeken
Anthropics meest agentische Sonnet: bijna Opus 4.8-kwaliteit op programmeren en agents voor $3/$15 met 1M context
Redeneren4.5Programmeren4.5Schrijven4.5Snelheid4.0Prijs-kwaliteit4.5Prijs$15/1M out ($10 intro until 2026-08-31) - 5Gemini 3 ProBezoeken
Googles frontier-model van nov 2025: 1M context, als eerste boven 1500 Elo op LMArena, vervangen door Gemini 3.1 Pro.
Redeneren4.5Programmeren4.5Schrijven3.5Snelheid3.5Prijs-kwaliteit4.0Prijs$12/1M out (prompts ≤200K) - 6DeepSeek-V4Bezoeken
Open-weights 1.6T MoE met 1M tokens context en bijna-frontier agentisch programmeren voor $0.87 per 1M output-tokens
Redeneren4.5Programmeren4.5Schrijven3.5Snelheid3.0Prijs-kwaliteit5.0Prijs$0.87/1M out - 7Claude Opus 4.8Bezoeken
Anthropics vlaggenschip in de Opus-klasse voor langlopend agentisch programmeren; 1M context voor $5/$25 per 1M tokens.
Redeneren4.5Programmeren5.0Schrijven5.0Snelheid3.0Prijs-kwaliteit3.5Prijs$25/1M out - 8GPT-5.5Bezoeken
OpenAI's agentische vlaggenschip: 1M context, SOTA op ARC-AGI-2 en Terminal-Bench 2.0, $5/$30 per 1M tokens.
Redeneren5.0Programmeren4.5Schrijven4.0Snelheid3.5Prijs-kwaliteit3.0Prijs$30/1M out - 9Claude Opus 4.5Bezoeken
Anthropics frontier-coder van nov 2025: als eerste boven 80% op SWE-bench Verified, 66% goedkoper dan Opus 4.1
Redeneren3.5Programmeren3.5Schrijven3.5Snelheid2.5Prijs-kwaliteit2.5Prijs$25/1M out - 10GPT-5.2Bezoeken
OpenAI's frontier-model van dec 2025: 400K context, 80% SWE-bench Verified, sterk redeneren maar trage output.
Redeneren4.0Programmeren4.0Schrijven3.5Snelheid2.5Prijs-kwaliteit3.5Prijs$14/1M out - 11Grok 4.3Bezoeken
xAI's frontier-model met 1M context voor $1.25/$2.50 per 1M tokens, afgestemd op agentisch toolgebruik.
Redeneren4.0Programmeren3.5Schrijven4.5Snelheid3.5Prijs-kwaliteit4.5Prijs$2.50/1M out - 12Claude Opus 4.6Bezoeken
Anthropics Opus van feb 2026: 1M context, adaptief denken, 80.8% SWE-bench, inmiddels opgevolgd door Opus 4.8.
Redeneren4.0Programmeren4.0Schrijven4.0Snelheid2.5Prijs-kwaliteit3.0Prijs$25/1M out - 13Gemini 3.5 FlashBezoeken
Googles vlaggenschip in de snelheidsklasse: verslaat Gemini 3.1 Pro op agentisch programmeren voor $1.50/$9, 3x duurder dan 3 Flash
Redeneren3.5Programmeren4.0Schrijven3.0Snelheid5.0Prijs-kwaliteit4.5Prijs$9.00/1M out - 14Llama 4 (Scout / Maverick)Bezoeken
Meta's open-weight MoE-duo: 17B actieve parameters, native beeldinput, op papier 10M tokens context
Redeneren2.5Programmeren2.0Schrijven2.5Snelheid4.5Prijs-kwaliteit3.5Prijs$0.60/1M out (Maverick, hosted) - 15Mistral Large 3Bezoeken
Open-weight 675B MoE-vlaggenschip (41B actief) met 256K context, vision-input en prijzen van $0.50/$1.50 per 1M.
Redeneren3.0Programmeren3.0Schrijven4.0Snelheid3.5Prijs-kwaliteit4.0Prijs$1.50/1M out
Topduels
Een-op-een-vergelijkingen tussen de podiumkandidaten.