L'arena · recensione di modello IA

GPT-5.5

di OpenAI

Il flagship agentico di OpenAI: contesto 1M, SOTA su ARC-AGI-2 e Terminal-Bench 2.0, $5/$30 per 1M di tokens.

Punteggio dell'arena 4/557% lo consiglia · 3 voti
Ragionamento5.0
Coding4.5
Scrittura4.0
Velocità3.5
Rapporto qualità-prezzo3.0
Visita GPT-5.5coding agenticoanalisi long-contextagenti computer-useautomazione da terminale e CLI
Prezzo

$30/1M out

Tier standard $5/$30 per 1M di tokens (input in cache $0.50), il doppio dei $2.50/$15 di GPT-5.4; Batch/Flex $2.50/$15; Priority $12.50/$75; GPT-5.5 Pro $30/$180; prompt oltre i 272K tokens di input fatturati 2x in input / 1.5x in output.

Fornitore

OpenAI

Finestra di contesto

1M tokens (1,050,000)

Prezzo in input

$5/1M in

Prezzo in output

$30/1M out

Modalità

text, vision (image input, text output)

Open weights

No

Che cos'è GPT-5.5?

Modello di ragionamento di punta di OpenAI, uscito il 23 aprile 2026. Costruito per coding agentico, computer use e lavoro di conoscenza a lungo orizzonte, con finestra di contesto da 1,050,000 tokens e 128K di output max. Accetta input testo e immagini, produce testo, con function calling, structured outputs e tool per agenti ospitati via Responses API.

GPT-5.5: pro e contro

Pro

  • Finestra di contesto da 1M di tokens (1,050,000) con 128K di output max e reasoning effort regolabile da none a xhigh
  • Stato dell'arte su ARC-AGI-2 con 85.0% (contro 73.3% di GPT-5.4) e su Terminal-Bench 2.0 con 82.7%
  • Grande autonomia nel coding agentico: gli sviluppatori riportano che risolve al primo colpo task che a GPT-5.4 richiedevano più turni e corregge i propri errori; +50 punti su Code Arena rispetto a GPT-5.4
  • Sconti aggressivi: 90% sull'input in cache ($0.50/1M) e 50% via Batch o Flex ($2.50/$15)
  • Veloce per un reasoner di frontiera: gli sviluppatori dicono che è il primo modello GPT che si può usare comodamente a thinking effort medio o basso

Contro

  • Prezzo di listino raddoppiato rispetto a GPT-5.4 ($5/$30 contro $2.50/$15) a parità di finestra di contesto da 1M di tokens
  • Segue le istruzioni in modo troppo letterale: gli sviluppatori riportano che non riesce a inferire l'intento in punti ovvi dove Claude ci arriva
  • Dietro a Claude Opus 4.8 su SWE-bench Pro (58.6% contro 69.2%); gli sviluppatori su HN preferiscono ancora Claude circa 2:1 per il coding
  • A volte troppo conservativo con le modifiche al codice o salta del tutto il ragionamento profondo, rispondendo subito a prompt complessi
  • Sovrapprezzo long-context: i prompt oltre i 272K tokens di input sono fatturati 2x in input e 1.5x in output per l'intera sessione

Il verdetto dell'arena

Scegli GPT-5.5 al posto di GPT-5.4 se ti servono più autonomia agentica, workflow intensivi da terminale o ragionamento astratto allo stato dell'arte, ma sappi che il listino è raddoppiato dai $2.50/$15 di GPT-5.4 a $5/$30 mentre il contesto da 1M di tokens è rimasto lo stesso. I team che fanno refactoring multi-file ad alto rischio potrebbero comunque preferire Claude Opus, che guida SWE-bench Pro (69.2% contro 58.6%) e inferisce meglio l'intento dai prompt approssimativi. Chi bada al budget deve tenere d'occhio il sovrapprezzo oltre i 272K tokens e le segnalazioni di limiti che si bruciano più in fretta, e appoggiarsi a caching, Batch o Flex per dimezzare i costi.

Pollice su o pollice verso

Emetti il tuo verdetto

Consiglieresti GPT-5.5, o metteresti in guardia la folla?

57%punteggio della folla · 3

Migliori alternative a GPT-5.5

Tutte le alternative
1
Claude Haiku 4.5

Il modello più veloce di Anthropic: circa il 90% delle capacità di coding di Sonnet 4.5 a $1/$5 per 1M di tokens, contesto 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Il flagship di classe Mythos di Anthropic di giugno 2026: 80.3% su SWE-bench Pro, 11 punti sopra ogni altro modello di frontiera

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

L'Opus di Anthropic di aprile 2026: 87.6% su SWE-bench Verified, contesto 1M, visione ad alta risoluzione, ormai dietro a Opus 4.8

$25/1M out57%(3)
Visit

Confronta GPT-5.5 testa a testa

Cosa dice la folla

Pollice Versicus

It is painfully literal. Where Claude infers intent in obvious places, 5.5 wants everything spelled out. And the price doubled vs 5.4 for the same 1M context.

Il Recensore Imparziale

85 on ARC-AGI-2 and you can feel it. Stuff that used to stall my agent just resolves now. 1M context with 128K output covers every workflow I have.

Ser Shippa-Tanto

5.5 one-shots tasks that took 5.4 three turns, and it fixes its own mistakes mid-run instead of doubling down. The reasoning effort dial from none to xhigh is genuinely useful.

GPT-5.5: domande frequenti

Quanto costa GPT-5.5 per 1M di token?

GPT-5.5 costa $5/1M in per 1M di token in input e $30/1M out per 1M di token in output. Tier standard $5/$30 per 1M di tokens (input in cache $0.50), il doppio dei $2.50/$15 di GPT-5.4; Batch/Flex $2.50/$15; Priority $12.50/$75; GPT-5.5 Pro $30/$180; prompt oltre i 272K tokens di input fatturati 2x in input / 1.5x in output.