Arena ยท Review model AI
Claude Opus 4.6
oleh Anthropic
Opus Anthropic edisi Feb 2026: context 1M, adaptive thinking, 80.8% SWE-bench, kini digantikan oleh Opus 4.8.
$25/1M out
Tarif standar $5/$25 per 1M tokens; context 1M penuh kini dengan tarif standar (premi masa peluncuran $10/$37.50 di atas 200K tokens kemudian dihapus), Batch API diskon 50% ($2.50/$12.50), inferensi khusus AS (inference_geo) pengali 1.1x.
Anthropic
1M tokens (128K max output)
$5/1M in
$25/1M out
text, vision (image input), text output
Tidak
Apa itu Claude Opus 4.6?
Model frontier kelas Opus yang dirilis 5 Februari 2026. Opus pertama dengan context window 1M token, adaptive thinking, dan parameter effort (low hingga max). Mencetak 80.8% di SWE-bench Verified dan skor teratas Terminal-Bench 2.0 saat peluncuran; kemudian digantikan oleh Opus 4.7 dan 4.8 dengan harga identik.
Kelebihan & kekurangan Claude Opus 4.6
Kelebihan
- 80.8% SWE-bench Verified (rata-rata 25 percobaan) dan skor teratas Terminal-Bench 2.0 saat peluncuran, model coding agentik terdepan di generasinya (Feb 2026)
- Opus pertama dengan context window 1M token: 76% di MRCR v2 8-needle pada 1M tokens vs 18.5% untuk Sonnet 4.5
- Lompatan penalaran besar dibanding Opus 4.5: ARC-AGI-2 68.8% vs 37.6%, +190 Elo pada tugas nilai ekonomi GDPval-AA (sekitar 144 Elo di atas GPT-5.2)
- Mempertahankan harga Opus 4.5 ($5/$25 per 1M tokens) meski dengan peningkatan tersebut; context 1M penuh kini ditagih dengan tarif standar, diskon batch 50%
- Adaptive thinking plus parameter effort (low/medium/high/max) untuk menukar kecerdasan, latensi, dan biaya per permintaan
- Perilaku agen otonom yang kuat: memparalelkan pekerjaan dan butuh lebih sedikit pendampingan dibanding Opus 4.5 (Every.to Vibe Check)
Kekurangan
- Lebih lambat dan lebih bertele-tele dibanding Opus 4.5; reviewer melaporkan temponya 'goyah saat dibebani' pada sesi agentik panjang (Every.to)
- Kemampuan menulis mundur: dalam uji buta, tim Every.to lebih menyukai prosa Opus 4.5, dan 4.6 memperlihatkan lebih banyak gaya khas AI seperti konstruksi 'X not Y'
- Kadang membuat perubahan tak terduga dan 'tidak selalu tahu skill-nya sendiri', sehingga butuh pengawasan lebih ketat dibanding GPT-5.x Codex menurut para reviewer
- Digantikan dalam hitungan bulan oleh Opus 4.7 dan 4.8 dengan harga sama $5/$25, dan mode fast tidak tersedia di 4.6 sejak Juni 2026 (permintaan berjalan pada kecepatan standar)
- Sebagian developer melaporkan kelelahan benchmark: peningkatan coding harian dibanding 4.5 lebih sulit dirasakan daripada yang tersirat dari skor, dan SWE-bench sendiri stagnan vs 4.5 (80.8% vs 80.9%)
Vonis arena
Peningkatan yang jelas dibanding Opus 4.5 untuk coding agentik dan pekerjaan long-context dengan harga identik, dan model ini memegang benchmark coding agentik teratas saat peluncuran. Namun pada pertengahan 2026 nyaris tidak ada alasan memulai proyek baru di atasnya: Opus 4.8 berharga sama $5/$25 dan mengunggulinya di semua lini, jadi pilih 4.6 terutama untuk mematok perilaku yang sudah tervalidasi. Penulis sebaiknya menghindarinya, karena uji buta lebih menyukai prosa Opus 4.5, dan pengguna yang sensitif latensi perlu tahu bahwa model ini lebih lambat dari 4.5 tanpa opsi mode fast.
Jempol ke atas atau ke bawah
Jatuhkan vonis Anda
Apakah Anda akan merekomendasikan Claude Opus 4.6, atau memperingatkan penonton agar menjauh?
Alternatif Claude Opus 4.6 terbaik
Semua alternatifModel tercepat Anthropic: sekitar 90% kemampuan coding Sonnet 4.5 seharga $1/$5 per 1M tokens, context 200K.
Flagship kelas Mythos dari Anthropic edisi Juni 2026: 80.3% di SWE-bench Pro, unggul 11 poin dari semua model frontier lainnya
Opus Anthropic edisi April 2026: 87.6% SWE-bench Verified, context 1M, vision resolusi tinggi, kini tertinggal dari Opus 4.8
Bandingkan Claude Opus 4.6 head-to-head
Claude Opus 4.6: pertanyaan yang sering diajukan
Berapa biaya Claude Opus 4.6 per 1M token?
Claude Opus 4.6 berbiaya $5/1M in per 1M token input dan $25/1M out per 1M token output. Tarif standar $5/$25 per 1M tokens; context 1M penuh kini dengan tarif standar (premi masa peluncuran $10/$37.50 di atas 200K tokens kemudian dihapus), Batch API diskon 50% ($2.50/$12.50), inferensi khusus AS (inference_geo) pengali 1.1x.