Arena · recenzja: model AI

GPT-5.5

od OpenAI

Agentowy flagowiec OpenAI: 1M kontekstu, SOTA na ARC-AGI-2 i Terminal-Bench 2.0, $5/$30 za 1M tokenów.

Wynik areny 4/557% rekomendacji · 3 głosy
Rozumowanie5.0
Kodowanie4.5
Pisanie4.0
Szybkość3.5
Stosunek jakości do ceny3.0
Odwiedź GPT-5.5kodowanie agentoweanaliza długiego kontekstuagenci computer-useautomatyzacja terminala i CLI
Cena

$30/1M out

Poziom standardowy $5/$30 za 1M tokenów (cache'owane wejście $0.50), dwa razy więcej niż $2.50/$15 u GPT-5.4; Batch/Flex $2.50/$15; Priority $12.50/$75; GPT-5.5 Pro $30/$180; prompty powyżej 272K tokenów wejścia rozliczane 2x wejście / 1.5x wyjście.

Dostawca

OpenAI

Okno kontekstu

1M tokens (1,050,000)

Cena wejścia

$5/1M in

Cena wyjścia

$30/1M out

Modalności

text, vision (image input, text output)

Open weights

Nie

Czym jest GPT-5.5?

Flagowy model rozumowania OpenAI, wydany 23 kwietnia 2026. Zbudowany pod kodowanie agentowe, computer use i długoterminową pracę wiedzową, z oknem kontekstu 1,050,000 tokenów i 128K maks. wyjścia. Przyjmuje tekst i obraz na wejściu, generuje tekst, z function calling, structured outputs i hostowanymi narzędziami agentowymi przez Responses API.

GPT-5.5: plusy i minusy

Plusy

  • Okno kontekstu 1M tokenów (1,050,000) ze 128K maks. wyjścia i wysiłkiem rozumowania regulowanym od none do xhigh
  • State-of-the-art na ARC-AGI-2 z 85.0% (vs 73.3% dla GPT-5.4) i Terminal-Bench 2.0 z 82.7%
  • Mocna autonomia w kodowaniu agentowym: deweloperzy raportują, że za jednym podejściem robi zadania, które GPT-5.4 zajmowały wiele tur, i naprawia własne błędy; +50 punktów na Code Arena vs GPT-5.4
  • Agresywne zniżki: 90% taniej za cache'owane wejście ($0.50/1M) i 50% taniej przez Batch lub Flex ($2.50/$15)
  • Szybki jak na frontierowy model rozumujący: deweloperzy mówią, że to pierwszy model GPT, na którym komfortowo pracuje się przy średnim lub niskim wysiłku myślenia

Minusy

  • Cena katalogowa podwoiła się vs GPT-5.4 ($5/$30 vs $2.50/$15) przy tym samym oknie kontekstu 1M tokenów
  • Nadmiernie dosłowne wykonywanie instrukcji: deweloperzy raportują, że nie potrafi odczytać intencji w oczywistych miejscach, gdzie Claude sobie radzi
  • Ustępuje Claude Opus 4.8 na SWE-bench Pro (58.6% vs 69.2%); deweloperzy na HN wciąż wolą Claude do kodowania mniej więcej 2:1
  • Czasem zbyt zachowawczy przy zmianach w kodzie albo całkiem pomija głębokie rozumowanie, odpowiadając natychmiast na złożone prompty
  • Dopłata za długi kontekst: prompty powyżej 272K tokenów wejścia rozliczane 2x za wejście i 1.5x za wyjście dla całej sesji

Werdykt areny

Wybierz GPT-5.5 zamiast GPT-5.4, jeśli potrzebujesz mocniejszej autonomii agentowej, workflowów ciężkich na terminalu albo SOTA w rozumowaniu abstrakcyjnym, ale pamiętaj, że cena katalogowa podwoiła się z $2.50/$15 u GPT-5.4 do $5/$30, a kontekst 1M tokenów pozostał ten sam. Zespoły robiące wieloplikowe refaktoryzacje wysokiego ryzyka mogą nadal woleć Claude Opus, który prowadzi na SWE-bench Pro (69.2% vs 58.6%) i lepiej odczytuje intencje z luźnych promptów. Użytkownicy pilnujący budżetu powinni uważać na dopłatę powyżej 272K tokenów i raporty o szybszym wypalaniu limitów, i mocno korzystać z cachingu, Batch lub Flex, by ciąć koszty o połowę.

Kciuk w górę czy kciuk w dół

Wydaj swój werdykt

Polecasz GPT-5.5, czy ostrzegasz przed nim tłum?

57%wynik tłumu · 3

Najlepsze alternatywy dla GPT-5.5

Wszystkie alternatywy
1
Claude Haiku 4.5

Najszybszy model Anthropic: około 90% umiejętności kodowania Sonnet 4.5 za $1/$5 za 1M tokenów, 200K kontekstu.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Flagowiec Anthropic klasy Mythos z czerwca 2026: 80.3% na SWE-bench Pro, 11 punktów przewagi nad każdym innym modelem frontierowym

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Opus Anthropic z kwietnia 2026: 87.6% SWE-bench Verified, 1M kontekstu, wizja wysokiej rozdzielczości, dziś za Opus 4.8

$25/1M out57%(3)
Visit

Porównaj GPT-5.5 w pojedynku

Co mówi tłum

Kciuk-w-Dółus

It is painfully literal. Where Claude infers intent in obvious places, 5.5 wants everything spelled out. And the price doubled vs 5.4 for the same 1M context.

Sprawiedliwy Recenzent

85 on ARC-AGI-2 and you can feel it. Stuff that used to stall my agent just resolves now. 1M context with 128K output covers every workflow I have.

Sir Wdrożycus

5.5 one-shots tasks that took 5.4 three turns, and it fixes its own mistakes mid-run instead of doubling down. The reasoning effort dial from none to xhigh is genuinely useful.

GPT-5.5: najczęstsze pytania

Ile kosztuje GPT-5.5 za 1M tokenów?

GPT-5.5 kosztuje $5/1M in za 1M tokenów wejściowych i $30/1M out za 1M tokenów wyjściowych. Poziom standardowy $5/$30 za 1M tokenów (cache'owane wejście $0.50), dwa razy więcej niż $2.50/$15 u GPT-5.4; Batch/Flex $2.50/$15; Priority $12.50/$75; GPT-5.5 Pro $30/$180; prompty powyżej 272K tokenów wejścia rozliczane 2x wejście / 1.5x wyjście.