Arena · Review model AI

Claude Opus 5

oleh Anthropic

Pembaruan Opus dari Anthropic pada Juli 2026: kecerdasan mendekati Fable 5 dengan setengah harga, tetap $5/$25 seperti Opus 4.8

Skor arena 4/563% merekomendasikan · 4 suara
Penalaran5.0
Coding5.0
Menulis4.0
Kecepatan2.0
Nilai4.0
Kunjungi Claude Opus 5coding dan agent frontier sehari-hari tanpa harga selangit Fable 5pekerjaan pengetahuan enterprise (dokumen, spreadsheet, slide presentasi)tim yang sering terkena false positive classifier Fable 5orkestrasi multi-agent dan pola writer-verifier
Harga

$25/1M out

Harga resmi API Anthropic untuk claude-opus-5: $5/1M input, $25/1M output, tidak berubah dari Opus 4.8, satu tier tunggal dengan konteks 1M sebagai default sekaligus maksimum, output maksimum 128K, prompt caching mulai dari 512 token. Fast mode tahap research-preview seharga $10/$50 (sekitar 2.5x lebih cepat) hanya tersedia di Claude API. Diverifikasi terhadap platform.claude.com (What's new in Opus 5) pada 2026-07.

Penyedia

Anthropic

Context window

1M tokens

Harga input

$5/1M in

Harga output

$25/1M out

Modalitas

text, vision

Open weights

Tidak

Apa itu Claude Opus 5?

Dirilis pada 2026-07-24 sebagai pengganti langsung Opus 4.8 dalam jajaran Series 5 Anthropic (Mythos 5, Fable 5, Sonnet 5, Opus 5). ID API claude-opus-5: $5/$25 per 1M token (tidak berubah dari Opus 4.8), konteks 1M sebagai nilai default sekaligus maksimum, output maksimum 128K, thinking aktif secara default dengan skala usaha lima tingkat (low hingga max). Diposisikan sebagai kecerdasan mendekati level frontier dengan setengah harga Fable 5: model ini bahkan mengungguli Fable 5 pada Frontier-Bench (43.3% vs 33.7%) dan GDPval-AA v2 (Elo 1861 vs 1747), meski sedikit tertinggal pada SWE-bench Pro (79.2% vs 80.0%). Classifier keamanan terpicu 85% lebih jarang dibandingkan pada Fable 5, dan mode fallback default mencegah kesalahan penolakan diam-diam.

Kelebihan & kekurangan Claude Opus 5

Kelebihan

  • Menduduki peringkat #1 dalam kecerdasan komposit di antara 190 model pada Artificial Analysis saat peluncuran, dengan skor 43.3% pada Frontier-Bench v0.1 dibandingkan 34.4% untuk GPT-5.6 Sol dan 33.7% untuk Claude Fable 5
  • 3.9x lebih unggul dibandingkan GPT-5.6 Sol pada penalaran baru ARC-AGI-3 (30.2% vs 7.8%), serta Elo 1861 pada pekerjaan pengetahuan ekonomi GDPval-AA v2, mengungguli Fable 5 (1747)
  • 79.2% pada SWE-bench Pro, hanya berselisih satu poin dari Fable 5 (80.0%) dan 10 poin di atas Opus 4.8 (69.2%), dengan setengah harga Fable; salah satu co-founder Cursor menyebutnya 'kecerdasan mendekati Fable 5 dengan kecepatan dan biaya setara Opus'
  • Harga tetap sama seperti Opus 4.8, yaitu $5/$25, namun dengan jendela konteks lebih besar: 1M konteks kini menjadi tier default sekaligus satu-satunya, dengan output maksimum 128K dan prompt caching mulai dari 512 token
  • Classifier keamanan dual-use terpicu 85% lebih jarang dibandingkan pada Fable 5, dan mode fallback default yang baru mencegah penolakan diam-diam di tengah sesi yang sempat membebani peluncuran Fable
  • Memverifikasi hasil kerjanya sendiri tanpa diminta, menangani perubahan tool di tengah percakapan (beta) tanpa merusak prompt cache, dan tersedia sejak hari pertama di Claude.ai, API, Bedrock, Vertex, dan Microsoft Foundry

Kekurangan

  • Tergolong lambat dan sangat verbose: 52.6 output token/detik dan 68 detik hingga token pertama pada Artificial Analysis, serta menghabiskan sekitar 100M output token selama evaluasi mereka, dibandingkan median 63M
  • Verbositas ini menjadi masalah biaya nyata: CodeRabbit mengukur model ini membaca sekitar 50% lebih banyak dan menulis sekitar 65% lebih banyak dibandingkan model frontier acuan per panggilan code review
  • Tidak ada pemotongan harga sesungguhnya meski narasinya 'cost-efficient': sama persis dengan Opus 4.8 ($5/$25), hampir setara harga GPT-5.6 ($5/$30), dan lebih dari 2x tier Gemini atau Grok yang sebanding
  • Para reviewer menggambarkan kepribadiannya sebagai 'brilian tapi menjengkelkan': verifikasi berlebihan, sikap berhati-hati berlebihan, dan sesekali menolak tugas sepele seperti menyelesaikan merge conflict (ulasan lapangan Lenny's Newsletter)
  • Perubahan API yang bersifat breaking bagi pengguna yang bermigrasi dari Opus 4.8: thinking aktif secara default dan tidak dapat dinonaktifkan pada level usaha xhigh atau max (mengembalikan error 400); Fast mode ($10/$50, sekitar 2.5x lebih cepat) hanya tersedia lewat API, tidak di Bedrock atau Vertex

Vonis arena

Claude Opus 5 adalah pilihan default paling masuk akal di jajaran Series 5: sebagian besar kecerdasan Fable 5 (bahkan melampaui Fable pada Frontier-Bench dan GDPval) dengan harga token tepat setengahnya, plus classifier yang terpicu 85% lebih jarang. Jika beban kerja sudah dipindahkan ke Fable 5 demi kapabilitas namun tagihannya terasa berat atau sering kena penolakan false positive, model ini layak dipertimbangkan sebagai pengganti; jika masih memakai Opus 4.8, upgrade ini memberi tambahan 10 poin SWE-bench Pro tanpa biaya tambahan. Dua alasan jujur untuk memilih model lain: latensi dan verbositas. Dengan kecepatan 52.6 token/detik dan 68 detik hingga token pertama, model ini kurang cocok untuk UX interaktif, dan 'nafsu' tokennya diam-diam menggelembungkan biaya riil di atas harga resmi, sehingga pipeline bervolume tinggi yang sensitif terhadap anggaran tetap lebih cocok memakai Sonnet 5, Gemini, atau DeepSeek. Fable 5 baru layak dipertahankan untuk run otonom terpanjang, di mana keunggulan tipisnya pada SWE-bench Pro terasa akumulatif.

Jempol ke atas atau ke bawah

Jatuhkan vonis Anda

Apakah Anda akan merekomendasikan Claude Opus 5, atau memperingatkan penonton agar menjauh?

63%skor penonton · 4

Alternatif Claude Opus 5 terbaik

Semua alternatif
1
Claude Haiku 4.5

Model tercepat Anthropic: sekitar 90% kemampuan coding Sonnet 4.5 seharga $1/$5 per 1M tokens, context 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Flagship kelas Mythos dari Anthropic edisi Juni 2026: 80.3% di SWE-bench Pro, unggul 11 poin dari semua model frontier lainnya

$50/1M out63%(4)
Visit
3
Kimi K3

MoE 2.8T parameter dari Moonshot yang memicu 'momen DeepSeek jilid baru': skor mendekati frontier dengan harga $3/$15

$15/1M out57%(3)
Visit

Bandingkan Claude Opus 5 head-to-head

Kata penonton

Jempol Bawahicus

The sticker price is unchanged but my invoice is not: it writes essays where Opus 4.8 wrote answers. 68 seconds to first token killed it for our support chat, we went back to Sonnet 5.

Sang Penilai Adil

Fed it a 40-tab financial model with cross-sheet formulas and asked for a scenario deck. It got the edge cases the analysts missed. For document-heavy enterprise work this is the best model I have used.

Tuan Rilis Melulu

We moved off Fable 5 because the bio classifier kept flagging our genomics tooling. Opus 5 does the same work at half the price and I have not seen a single silent reroute since.

Penjaga Repo

Migrated our agents from Opus 4.8 the day it dropped. Same bill, and tasks that used to stall at the planning stage now just finish. The 10-point SWE-bench jump is not marketing, our merge queue feels it.

Claude Opus 5: pertanyaan yang sering diajukan

Berapa biaya Claude Opus 5 per 1M token?

Claude Opus 5 berbiaya $5/1M in per 1M token input dan $25/1M out per 1M token output. Harga resmi API Anthropic untuk claude-opus-5: $5/1M input, $25/1M output, tidak berubah dari Opus 4.8, satu tier tunggal dengan konteks 1M sebagai default sekaligus maksimum, output maksimum 128K, prompt caching mulai dari 512 token. Fast mode tahap research-preview seharga $10/$50 (sekitar 2.5x lebih cepat) hanya tersedia di Claude API. Diverifikasi terhadap platform.claude.com (What's new in Opus 5) pada 2026-07.