L'arena · recensione di modello IA
GPT-5.2
di OpenAI
Il modello di frontiera di OpenAI di dic 2025: contesto 400K, 80% su SWE-bench Verified, ragionamento solido ma output lento.
$14/1M out
gpt-5.2 base (Thinking) a $1.75/$14 per 1M; tier gpt-5.2-pro a $21/$168; input in cache $0.175 (sconto del 90%).
OpenAI
400K tokens (128K max output)
$1.75/1M in
$14/1M out
text, vision (text output only)
No
Che cos'è GPT-5.2?
Modello di ragionamento di frontiera di OpenAI uscito l'11 dicembre 2025, pensato per il lavoro professionale e gli agenti a lunga esecuzione. Contesto da 400K tokens, input testo e immagini, cinque livelli di reasoning effort (da none a xhigh). Superato da GPT-5.4/5.5 nel 2026 ma ancora servito via API al prezzo della generazione precedente.
GPT-5.2: pro e contro
Pro
- 80.0% su SWE-bench Verified e 55.6% su SWE-Bench Pro al lancio, quasi alla pari con Claude Opus 4.5 (80.9%)
- GDPval: pareggia o batte i professionisti umani nel 70.9% dei confronti, quasi il doppio del 38.8% di GPT-5.1
- Ottimo in scienze e matematica: 92.4% su GPQA Diamond (Thinking, 93.2% Pro) e 40.3% su FrontierMath, stato dell'arte alla release
- Contesto da 400K con retrieval long-context quasi perfetto su MRCR v2 fino a 256K tokens
- 30% di allucinazioni in meno rispetto a GPT-5.1 (tasso di errore sulle query reali di ChatGPT sceso dall'8.8% al 6.2%)
- Più economico dei suoi successori: $1.75/$14 per 1M contro $2.50/$15 (GPT-5.4) e $5/$30 (GPT-5.5)
Contro
- La velocità è la lamentela numero uno della community: extended thinking riportato fino a ~4 tokens/s in ChatGPT, e il Pro può pensare a lungo e fallire comunque
- I punteggi di punta dei benchmark sono stati ottenuti a reasoning effort xhigh, che consuma molti più tokens e tempo delle impostazioni di default
- Regressione di personalità molto criticata rispetto a GPT-5.1: gli utenti su Reddit lo hanno definito 'troppo corporate, troppo prudente' e 'un passo indietro' per chat e scrittura
- Il coding resta dietro alla linea Anthropic nei confronti Elo testa a testa (un'analisi successiva su Opus 4.7 citava un gap di 144 Elo); niente modalità audio, niente fine-tuning
- Già superato a metà 2026: OpenAI raccomanda GPT-5.5 e GPT-5.2 non compare più nella pagina prezzi principale dell'API
Il verdetto dell'arena
Scegli GPT-5.2 al posto di GPT-5.1 per ragionamento pesante, long-context o lavoro agentico: quasi raddoppia il tasso di vittoria GDPval di GPT-5.1, taglia le allucinazioni del 30% e gestisce contesti da 400K in modo affidabile. A metà 2026 è soprattutto una scelta di convenienza, a $1.75/$14 contro i $5/$30 di GPT-5.5, restando competente sulla maggior parte dei task professionali. Evitalo per la chat sensibile alla latenza e la scrittura creativa, dove gli utenti lo hanno trovato lento e più piatto di GPT-5.1. I team che vogliono l'attuale frontiera di OpenAI dovrebbero invece pagare per GPT-5.5.
Pollice su o pollice verso
Emetti il tuo verdetto
Consiglieresti GPT-5.2, o metteresti in guardia la folla?
Migliori alternative a GPT-5.2
Tutte le alternativeIl modello più veloce di Anthropic: circa il 90% delle capacità di coding di Sonnet 4.5 a $1/$5 per 1M di tokens, contesto 200K.
Il flagship di classe Mythos di Anthropic di giugno 2026: 80.3% su SWE-bench Pro, 11 punti sopra ogni altro modello di frontiera
L'Opus di Anthropic di aprile 2026: 87.6% su SWE-bench Verified, contesto 1M, visione ad alta risoluzione, ormai dietro a Opus 4.8
Confronta GPT-5.2 testa a testa
Cosa dice la folla
“The thinking speed is brutal, I clocked something like 4 tok/s in ChatGPT on extended thinking. Pro will grind for ages and still whiff. Great scores, painful to actually use.”
“GDPval numbers are wild, it ties or beats human pros in 71% of comparisons. For science and math work (92.4 GPQA Diamond) it earned a spot in my stack.”
GPT-5.2: domande frequenti
Quanto costa GPT-5.2 per 1M di token?
GPT-5.2 costa $1.75/1M in per 1M di token in input e $14/1M out per 1M di token in output. gpt-5.2 base (Thinking) a $1.75/$14 per 1M; tier gpt-5.2-pro a $21/$168; input in cache $0.175 (sconto del 90%).