Hall of Fame · Classifica in diretta della folla

La classifica Modelli LLM

Tutti i contendenti di questa arena, classificati in tempo reale dai verdetti reali della folla: consigliare o evitare, un verdetto per persona. L'ordine cambia a ogni voto.

Aggiornato il 21 luglio 2026

Preferisci una selezione curata?Migliori modelli LLM
  1. Claude Haiku 4.5

    Il modello più veloce di Anthropic: circa il 90% delle capacità di coding di Sonnet 4.5 a $1/$5 per 1M di tokens, contesto 200K.

    Ragionamento3.0
    Coding3.5
    Scrittura3.0
    Velocità4.5
    Rapporto qualità-prezzo4.0
    Prezzo$5/1M out
  2. 2
    Claude Fable 5

    Il flagship di classe Mythos di Anthropic di giugno 2026: 80.3% su SWE-bench Pro, 11 punti sopra ogni altro modello di frontiera

    Ragionamento5.0
    Coding5.0
    Scrittura4.5
    Velocità2.0
    Rapporto qualità-prezzo3.0
    Prezzo$50/1M out
  3. 3
    Claude Opus 4.7

    L'Opus di Anthropic di aprile 2026: 87.6% su SWE-bench Verified, contesto 1M, visione ad alta risoluzione, ormai dietro a Opus 4.8

    Ragionamento4.5
    Coding4.5
    Scrittura4.5
    Velocità2.5
    Rapporto qualità-prezzo3.0
    Prezzo$25/1M out
  4. 4
    Claude Sonnet 5

    Il Sonnet più agentico di Anthropic: qualità vicina a Opus 4.8 su coding e agenti a $3/$15 con contesto 1M

    Ragionamento4.5
    Coding4.5
    Scrittura4.5
    Velocità4.0
    Rapporto qualità-prezzo4.5
    Prezzo$15/1M out ($10 intro until 2026-08-31)
  5. 5
    Gemini 3 Pro

    Il modello di frontiera di Google di nov 2025: contesto 1M, primo oltre i 1500 Elo su LMArena, sostituito da Gemini 3.1 Pro.

    Ragionamento4.5
    Coding4.5
    Scrittura3.5
    Velocità3.5
    Rapporto qualità-prezzo4.0
    Prezzo$12/1M out (prompts ≤200K)
  6. 6
    DeepSeek-V4

    MoE open weights da 1.6T con contesto da 1M di tokens e coding agentico quasi di frontiera a $0.87 per 1M di output tokens

    Ragionamento4.5
    Coding4.5
    Scrittura3.5
    Velocità3.0
    Rapporto qualità-prezzo5.0
    Prezzo$0.87/1M out
  7. 7
    Claude Opus 4.8

    Il modello flagship di fascia Opus di Anthropic per il coding agentico a lungo orizzonte; contesto 1M a $5/$25 per 1M di tokens.

    Ragionamento4.5
    Coding5.0
    Scrittura5.0
    Velocità3.0
    Rapporto qualità-prezzo3.5
    Prezzo$25/1M out
  8. 8
    GPT-5.5

    Il flagship agentico di OpenAI: contesto 1M, SOTA su ARC-AGI-2 e Terminal-Bench 2.0, $5/$30 per 1M di tokens.

    Ragionamento5.0
    Coding4.5
    Scrittura4.0
    Velocità3.5
    Rapporto qualità-prezzo3.0
    Prezzo$30/1M out
  9. 9
    Claude Opus 4.5

    Il coder di frontiera di Anthropic di nov 2025: primo a superare l'80% su SWE-bench Verified, prezzo tagliato del 66% rispetto a Opus 4.1

    Ragionamento3.5
    Coding3.5
    Scrittura3.5
    Velocità2.5
    Rapporto qualità-prezzo2.5
    Prezzo$25/1M out
  10. 10
    GPT-5.2

    Il modello di frontiera di OpenAI di dic 2025: contesto 400K, 80% su SWE-bench Verified, ragionamento solido ma output lento.

    Ragionamento4.0
    Coding4.0
    Scrittura3.5
    Velocità2.5
    Rapporto qualità-prezzo3.5
    Prezzo$14/1M out
  11. 11
    Grok 4.3

    Il modello di frontiera di xAI con contesto 1M a $1.25/$2.50 per 1M di tokens, ottimizzato per l'uso agentico dei tool.

    Ragionamento4.0
    Coding3.5
    Scrittura4.5
    Velocità3.5
    Rapporto qualità-prezzo4.5
    Prezzo$2.50/1M out
  12. 12
    Claude Opus 4.6

    L'Opus di Anthropic di feb 2026: contesto 1M, adaptive thinking, 80.8% su SWE-bench, ormai superato da Opus 4.8.

    Ragionamento4.0
    Coding4.0
    Scrittura4.0
    Velocità2.5
    Rapporto qualità-prezzo3.0
    Prezzo$25/1M out
  13. 13
    Gemini 3.5 Flash

    Il flagship veloce di Google: batte Gemini 3.1 Pro sul coding agentico a $1.50/$9, 3x più caro di 3 Flash

    Ragionamento3.5
    Coding4.0
    Scrittura3.0
    Velocità5.0
    Rapporto qualità-prezzo4.5
    Prezzo$9.00/1M out
  14. 14
    Llama 4 (Scout / Maverick)

    Il duo MoE open weights di Meta: 17B di parametri attivi, input immagini nativo, contesto da 10M di tokens sulla carta

    Ragionamento2.5
    Coding2.0
    Scrittura2.5
    Velocità4.5
    Rapporto qualità-prezzo3.5
    Prezzo$0.60/1M out (Maverick, hosted)
  15. 15
    Mistral Large 3

    Flagship MoE open weights da 675B (41B attivi) con contesto 256K, input immagini e prezzi a $0.50/$1.50 per 1M.

    Ragionamento3.0
    Coding3.0
    Scrittura4.0
    Velocità3.5
    Rapporto qualità-prezzo4.0
    Prezzo$1.50/1M out