Arena · Review model AI

GPT-5.5

oleh OpenAI

Flagship agentik OpenAI: context 1M, SOTA di ARC-AGI-2 dan Terminal-Bench 2.0, $5/$30 per 1M tokens.

Skor arena 4/557% merekomendasikan · 3 suara
Penalaran5.0
Coding4.5
Menulis4.0
Kecepatan3.5
Nilai3.0
Kunjungi GPT-5.5coding agentikanalisis long-contextagen computer-useotomasi terminal dan CLI
Harga

$30/1M out

Tarif standar $5/$30 per 1M tokens (cached input $0.50), dua kali lipat $2.50/$15 milik GPT-5.4; Batch/Flex $2.50/$15; Priority $12.50/$75; GPT-5.5 Pro $30/$180; prompt di atas 272K input tokens ditagih 2x masuk / 1.5x keluar.

Penyedia

OpenAI

Context window

1M tokens (1,050,000)

Harga input

$5/1M in

Harga output

$30/1M out

Modalitas

text, vision (image input, text output)

Open weights

Tidak

Apa itu GPT-5.5?

Model reasoning unggulan OpenAI, dirilis 23 April 2026. Dibangun untuk coding agentik, computer use, dan pekerjaan pengetahuan jangka panjang, dengan context window 1,050,000 token dan output maksimum 128K. Menerima input teks dan gambar, menghasilkan teks, dengan function calling, structured outputs, dan tool agen terkelola via Responses API.

Kelebihan & kekurangan GPT-5.5

Kelebihan

  • Context window 1M token (1,050,000) dengan output maksimum 128K dan reasoning effort yang bisa diatur dari none hingga xhigh
  • State-of-the-art di ARC-AGI-2 dengan 85.0% (vs 73.3% untuk GPT-5.4) dan Terminal-Bench 2.0 dengan 82.7%
  • Otonomi coding agentik kuat: developer melaporkan ia menuntaskan sekali jalan tugas yang butuh beberapa giliran di GPT-5.4 dan memperbaiki kesalahannya sendiri; +50 poin di Code Arena vs GPT-5.4
  • Diskon agresif: potongan 90% untuk cached input ($0.50/1M) dan 50% via Batch atau Flex ($2.50/$15)
  • Cepat untuk ukuran reasoner frontier: developer menyebutnya model GPT pertama yang nyaman dijalankan pada thinking effort medium atau low

Kekurangan

  • Harga resmi naik dua kali lipat vs GPT-5.4 ($5/$30 vs $2.50/$15) untuk context window 1M token yang sama
  • Terlalu harfiah mengikuti instruksi: developer melaporkan ia gagal menangkap maksud di tempat-tempat yang jelas, di mana Claude berhasil
  • Tertinggal dari Claude Opus 4.8 di SWE-bench Pro (58.6% vs 69.2%); developer HN masih memfavoritkan Claude kira-kira 2:1 untuk coding
  • Kadang terlalu konservatif dengan perubahan kode atau melewatkan penalaran mendalam sama sekali, langsung menjawab pada prompt kompleks
  • Biaya tambahan long-context: prompt di atas 272K input tokens ditagih 2x input dan 1.5x output untuk seluruh sesi

Vonis arena

Pilih GPT-5.5 di atas GPT-5.4 jika Anda butuh otonomi agentik lebih kuat, alur kerja yang berat di terminal, atau penalaran abstrak SOTA, tetapi ketahuilah harga resminya naik dua kali lipat dari $2.50/$15 milik GPT-5.4 menjadi $5/$30 sementara context 1M token tidak berubah. Tim yang mengerjakan refactoring multi-file berisiko tinggi mungkin tetap lebih memilih Claude Opus, yang memimpin SWE-bench Pro (69.2% vs 58.6%) dan lebih baik menangkap maksud dari prompt yang longgar. Pengguna dengan anggaran ketat perlu mewaspadai biaya tambahan 272K token dan laporan limit yang lebih cepat habis, dan mengandalkan caching, Batch, atau Flex untuk memangkas biaya separuh.

Jempol ke atas atau ke bawah

Jatuhkan vonis Anda

Apakah Anda akan merekomendasikan GPT-5.5, atau memperingatkan penonton agar menjauh?

57%skor penonton · 3

Alternatif GPT-5.5 terbaik

Semua alternatif
1
Claude Haiku 4.5

Model tercepat Anthropic: sekitar 90% kemampuan coding Sonnet 4.5 seharga $1/$5 per 1M tokens, context 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Flagship kelas Mythos dari Anthropic edisi Juni 2026: 80.3% di SWE-bench Pro, unggul 11 poin dari semua model frontier lainnya

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Opus Anthropic edisi April 2026: 87.6% SWE-bench Verified, context 1M, vision resolusi tinggi, kini tertinggal dari Opus 4.8

$25/1M out57%(3)
Visit

Bandingkan GPT-5.5 head-to-head

Kata penonton

Jempol Bawahicus

It is painfully literal. Where Claude infers intent in obvious places, 5.5 wants everything spelled out. And the price doubled vs 5.4 for the same 1M context.

Sang Penilai Adil

85 on ARC-AGI-2 and you can feel it. Stuff that used to stall my agent just resolves now. 1M context with 128K output covers every workflow I have.

Tuan Rilis Melulu

5.5 one-shots tasks that took 5.4 three turns, and it fixes its own mistakes mid-run instead of doubling down. The reasoning effort dial from none to xhigh is genuinely useful.

GPT-5.5: pertanyaan yang sering diajukan

Berapa biaya GPT-5.5 per 1M token?

GPT-5.5 berbiaya $5/1M in per 1M token input dan $30/1M out per 1M token output. Tarif standar $5/$30 per 1M tokens (cached input $0.50), dua kali lipat $2.50/$15 milik GPT-5.4; Batch/Flex $2.50/$15; Priority $12.50/$75; GPT-5.5 Pro $30/$180; prompt di atas 272K input tokens ditagih 2x masuk / 1.5x keluar.