L'arena · recensione di modello IA

GPT-5.2

di OpenAI

Il modello di frontiera di OpenAI di dic 2025: contesto 400K, 80% su SWE-bench Verified, ragionamento solido ma output lento.

Punteggio dell'arena 3.5/550% lo consiglia · 2 voti
Ragionamento4.0
Coding4.0
Scrittura3.5
Velocità2.5
Rapporto qualità-prezzo3.5
Visita GPT-5.2analisi long-contextcoding agenticoragionamento matematico e scientificolavoro professionale su documenti e fogli di calcolo
Prezzo

$14/1M out

gpt-5.2 base (Thinking) a $1.75/$14 per 1M; tier gpt-5.2-pro a $21/$168; input in cache $0.175 (sconto del 90%).

Fornitore

OpenAI

Finestra di contesto

400K tokens (128K max output)

Prezzo in input

$1.75/1M in

Prezzo in output

$14/1M out

Modalità

text, vision (text output only)

Open weights

No

Che cos'è GPT-5.2?

Modello di ragionamento di frontiera di OpenAI uscito l'11 dicembre 2025, pensato per il lavoro professionale e gli agenti a lunga esecuzione. Contesto da 400K tokens, input testo e immagini, cinque livelli di reasoning effort (da none a xhigh). Superato da GPT-5.4/5.5 nel 2026 ma ancora servito via API al prezzo della generazione precedente.

GPT-5.2: pro e contro

Pro

  • 80.0% su SWE-bench Verified e 55.6% su SWE-Bench Pro al lancio, quasi alla pari con Claude Opus 4.5 (80.9%)
  • GDPval: pareggia o batte i professionisti umani nel 70.9% dei confronti, quasi il doppio del 38.8% di GPT-5.1
  • Ottimo in scienze e matematica: 92.4% su GPQA Diamond (Thinking, 93.2% Pro) e 40.3% su FrontierMath, stato dell'arte alla release
  • Contesto da 400K con retrieval long-context quasi perfetto su MRCR v2 fino a 256K tokens
  • 30% di allucinazioni in meno rispetto a GPT-5.1 (tasso di errore sulle query reali di ChatGPT sceso dall'8.8% al 6.2%)
  • Più economico dei suoi successori: $1.75/$14 per 1M contro $2.50/$15 (GPT-5.4) e $5/$30 (GPT-5.5)

Contro

  • La velocità è la lamentela numero uno della community: extended thinking riportato fino a ~4 tokens/s in ChatGPT, e il Pro può pensare a lungo e fallire comunque
  • I punteggi di punta dei benchmark sono stati ottenuti a reasoning effort xhigh, che consuma molti più tokens e tempo delle impostazioni di default
  • Regressione di personalità molto criticata rispetto a GPT-5.1: gli utenti su Reddit lo hanno definito 'troppo corporate, troppo prudente' e 'un passo indietro' per chat e scrittura
  • Il coding resta dietro alla linea Anthropic nei confronti Elo testa a testa (un'analisi successiva su Opus 4.7 citava un gap di 144 Elo); niente modalità audio, niente fine-tuning
  • Già superato a metà 2026: OpenAI raccomanda GPT-5.5 e GPT-5.2 non compare più nella pagina prezzi principale dell'API

Il verdetto dell'arena

Scegli GPT-5.2 al posto di GPT-5.1 per ragionamento pesante, long-context o lavoro agentico: quasi raddoppia il tasso di vittoria GDPval di GPT-5.1, taglia le allucinazioni del 30% e gestisce contesti da 400K in modo affidabile. A metà 2026 è soprattutto una scelta di convenienza, a $1.75/$14 contro i $5/$30 di GPT-5.5, restando competente sulla maggior parte dei task professionali. Evitalo per la chat sensibile alla latenza e la scrittura creativa, dove gli utenti lo hanno trovato lento e più piatto di GPT-5.1. I team che vogliono l'attuale frontiera di OpenAI dovrebbero invece pagare per GPT-5.5.

Pollice su o pollice verso

Emetti il tuo verdetto

Consiglieresti GPT-5.2, o metteresti in guardia la folla?

50%punteggio della folla · 2

Migliori alternative a GPT-5.2

Tutte le alternative
1
Claude Haiku 4.5

Il modello più veloce di Anthropic: circa il 90% delle capacità di coding di Sonnet 4.5 a $1/$5 per 1M di tokens, contesto 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Il flagship di classe Mythos di Anthropic di giugno 2026: 80.3% su SWE-bench Pro, 11 punti sopra ogni altro modello di frontiera

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

L'Opus di Anthropic di aprile 2026: 87.6% su SWE-bench Verified, contesto 1M, visione ad alta risoluzione, ormai dietro a Opus 4.8

$25/1M out57%(3)
Visit

Confronta GPT-5.2 testa a testa

Cosa dice la folla

Niente Rimborsus

The thinking speed is brutal, I clocked something like 4 tok/s in ChatGPT on extended thinking. Pro will grind for ages and still whiff. Great scores, painful to actually use.

San Deployus

GDPval numbers are wild, it ties or beats human pros in 71% of comparisons. For science and math work (92.4 GPQA Diamond) it earned a spot in my stack.

GPT-5.2: domande frequenti

Quanto costa GPT-5.2 per 1M di token?

GPT-5.2 costa $1.75/1M in per 1M di token in input e $14/1M out per 1M di token in output. gpt-5.2 base (Thinking) a $1.75/$14 per 1M; tier gpt-5.2-pro a $21/$168; input in cache $0.175 (sconto del 90%).