Hall of Fame · Classifica in diretta della folla
La classifica Modelli LLM
Tutti i contendenti di questa arena, classificati in tempo reale dai verdetti reali della folla: consigliare o evitare, un verdetto per persona. L'ordine cambia a ogni voto.
Aggiornato il 21 luglio 2026
- Claude Haiku 4.5Visita
Il modello più veloce di Anthropic: circa il 90% delle capacità di coding di Sonnet 4.5 a $1/$5 per 1M di tokens, contesto 200K.
Ragionamento3.0Coding3.5Scrittura3.0Velocità4.5Rapporto qualità-prezzo4.0Prezzo$5/1M out - 2Claude Fable 5Visita
Il flagship di classe Mythos di Anthropic di giugno 2026: 80.3% su SWE-bench Pro, 11 punti sopra ogni altro modello di frontiera
Ragionamento5.0Coding5.0Scrittura4.5Velocità2.0Rapporto qualità-prezzo3.0Prezzo$50/1M out - 3Claude Opus 4.7Visita
L'Opus di Anthropic di aprile 2026: 87.6% su SWE-bench Verified, contesto 1M, visione ad alta risoluzione, ormai dietro a Opus 4.8
Ragionamento4.5Coding4.5Scrittura4.5Velocità2.5Rapporto qualità-prezzo3.0Prezzo$25/1M out - 4Claude Sonnet 5Visita
Il Sonnet più agentico di Anthropic: qualità vicina a Opus 4.8 su coding e agenti a $3/$15 con contesto 1M
Ragionamento4.5Coding4.5Scrittura4.5Velocità4.0Rapporto qualità-prezzo4.5Prezzo$15/1M out ($10 intro until 2026-08-31) - 5Gemini 3 ProVisita
Il modello di frontiera di Google di nov 2025: contesto 1M, primo oltre i 1500 Elo su LMArena, sostituito da Gemini 3.1 Pro.
Ragionamento4.5Coding4.5Scrittura3.5Velocità3.5Rapporto qualità-prezzo4.0Prezzo$12/1M out (prompts ≤200K) - 6DeepSeek-V4Visita
MoE open weights da 1.6T con contesto da 1M di tokens e coding agentico quasi di frontiera a $0.87 per 1M di output tokens
Ragionamento4.5Coding4.5Scrittura3.5Velocità3.0Rapporto qualità-prezzo5.0Prezzo$0.87/1M out - 7Claude Opus 4.8Visita
Il modello flagship di fascia Opus di Anthropic per il coding agentico a lungo orizzonte; contesto 1M a $5/$25 per 1M di tokens.
Ragionamento4.5Coding5.0Scrittura5.0Velocità3.0Rapporto qualità-prezzo3.5Prezzo$25/1M out - 8GPT-5.5Visita
Il flagship agentico di OpenAI: contesto 1M, SOTA su ARC-AGI-2 e Terminal-Bench 2.0, $5/$30 per 1M di tokens.
Ragionamento5.0Coding4.5Scrittura4.0Velocità3.5Rapporto qualità-prezzo3.0Prezzo$30/1M out - 9Claude Opus 4.5Visita
Il coder di frontiera di Anthropic di nov 2025: primo a superare l'80% su SWE-bench Verified, prezzo tagliato del 66% rispetto a Opus 4.1
Ragionamento3.5Coding3.5Scrittura3.5Velocità2.5Rapporto qualità-prezzo2.5Prezzo$25/1M out - 10GPT-5.2Visita
Il modello di frontiera di OpenAI di dic 2025: contesto 400K, 80% su SWE-bench Verified, ragionamento solido ma output lento.
Ragionamento4.0Coding4.0Scrittura3.5Velocità2.5Rapporto qualità-prezzo3.5Prezzo$14/1M out - 11Grok 4.3Visita
Il modello di frontiera di xAI con contesto 1M a $1.25/$2.50 per 1M di tokens, ottimizzato per l'uso agentico dei tool.
Ragionamento4.0Coding3.5Scrittura4.5Velocità3.5Rapporto qualità-prezzo4.5Prezzo$2.50/1M out - 12Claude Opus 4.6Visita
L'Opus di Anthropic di feb 2026: contesto 1M, adaptive thinking, 80.8% su SWE-bench, ormai superato da Opus 4.8.
Ragionamento4.0Coding4.0Scrittura4.0Velocità2.5Rapporto qualità-prezzo3.0Prezzo$25/1M out - 13Gemini 3.5 FlashVisita
Il flagship veloce di Google: batte Gemini 3.1 Pro sul coding agentico a $1.50/$9, 3x più caro di 3 Flash
Ragionamento3.5Coding4.0Scrittura3.0Velocità5.0Rapporto qualità-prezzo4.5Prezzo$9.00/1M out - 14Llama 4 (Scout / Maverick)Visita
Il duo MoE open weights di Meta: 17B di parametri attivi, input immagini nativo, contesto da 10M di tokens sulla carta
Ragionamento2.5Coding2.0Scrittura2.5Velocità4.5Rapporto qualità-prezzo3.5Prezzo$0.60/1M out (Maverick, hosted) - 15Mistral Large 3Visita
Flagship MoE open weights da 675B (41B attivi) con contesto 256K, input immagini e prezzi a $0.50/$1.50 per 1M.
Ragionamento3.0Coding3.0Scrittura4.0Velocità3.5Rapporto qualità-prezzo4.0Prezzo$1.50/1M out
Duelli al vertice
I testa a testa tra gli strumenti del podio.