Arena · yapay zeka modeli incelemesi

Claude Opus 5

Anthropic tarafından

Anthropic'in Temmuz 2026 Opus yenilemesi: Fable 5'e yakın zeka, yarı fiyatına, Opus 4.8 ile aynı $5/$25 fiyatlandırmasıyla

Arena puanı 4/5%63 tavsiye · 4 oy
Akıl yürütme5.0
Kodlama5.0
Yazarlık4.0
Hız2.0
Fiyat/performans4.0
Claude Opus 5 sitesini ziyaret etFable 5 fiyatlandırması olmadan günlük sınır düzeyi kodlama ve ajanlarkurumsal bilgi işi (belgeler, elektronik tablolar, sunumlar)Fable 5 sınıflandırıcı yanlış pozitifleriyle karşılaşan ekiplerçoklu ajan orkestrasyonu ve writer-verifier desenleri
Fiyat

$25/1M out

claude-opus-5 için resmi Anthropic API liste fiyatı: 1M girdi için $5, 1M çıktı için $25, Opus 4.8 ile değişmedi; 1M bağlamın varsayılan ve maksimum olduğu tek seviye, 128K maksimum çıktı, 512 tokenden itibaren istem önbellekleme. $10/$50 fiyatlı (yaklaşık 2,5 kat daha hızlı) araştırma önizlemesindeki Fast modu yalnızca Claude API'de mevcut. platform.claude.com (What's new in Opus 5) referans alınarak Temmuz 2026'da doğrulandı.

Sağlayıcı

Anthropic

Bağlam penceresi

1M tokens

Girdi fiyatı

$5/1M in

Çıktı fiyatı

$25/1M out

Modaliteler

text, vision

Open weights

Hayır

Claude Opus 5 nedir?

24.07.2026 tarihinde Anthropic'in Series 5 serisinde (Mythos 5, Fable 5, Sonnet 5, Opus 5) Opus 4.8'in doğrudan yerine geçen model olarak yayınlandı. API kimliği claude-opus-5: 1M token başına $5/$25 (Opus 4.8 ile değişmedi), hem varsayılan hem de maksimum olarak 1M bağlam penceresi, 128K maksimum çıktı, beş seviyeli çaba ölçeğiyle (low'dan max'a) varsayılan olarak açık düşünme modu. Fable 5'in yarı fiyatına sınır düzeyine yakın zeka olarak konumlandırılıyor: aslında Frontier-Bench'te (%43,3'e karşı %33,7) ve GDPval-AA v2'de (Elo 1861'e karşı 1747) Fable 5'i geride bırakırken, SWE-bench Pro'da (%79,2'ye karşı %80,0) hafifçe geride kalıyor. Güvenlik sınıflandırıcıları Fable 5'e kıyasla %85 daha az tetikleniyor ve varsayılan yedek mod, sessiz reddetme hatalarını önlüyor.

Claude Opus 5 artıları ve eksileri

Artılar

  • Piyasaya çıkışta Artificial Analysis'te 190 model arasında bileşik zeka sıralamasında 1. sırada yer aldı; Frontier-Bench v0.1'de %43,3 puan alırken GPT-5.6 Sol %34,4, Claude Fable 5 ise %33,7 puan aldı
  • ARC-AGI-3'teki yeni akıl yürütme testinde GPT-5.6 Sol'dan 3,9 kat daha başarılı (%30,2'ye karşı %7,8) ve GDPval-AA v2 ekonomik bilgi işi testinde Elo 1861 ile Fable 5'in (1747) önünde
  • SWE-bench Pro'da %79,2 ile Fable 5'in (%80,0) bir puan gerisinde ve Opus 4.8'in (%69,2) 10 puan üzerinde, Fable'ın yarı fiyatına; Cursor'ın kurucu ortağı modeli 'Opus hızında ve maliyetinde Fable 5'e yakın zeka' olarak tanımlıyor
  • Opus 4.8 ile aynı $5/$25 fiyatlandırma, ama daha geniş bir pencereyle: 1M bağlam artık varsayılan ve tek seviye, 128K maksimum çıktı ve 512 tokenden itibaren istem önbellekleme ile
  • Çift kullanımlı güvenlik sınıflandırıcıları Fable 5'e kıyasla %85 daha az tetikleniyor ve yeni varsayılan yedek mod, Fable'ın lansmanına damga vuran oturum içi sessiz reddetmeleri önlüyor
  • Söylenmeden kendi işini doğruluyor, konuşma sırasında araç değişikliklerini (beta) istem önbelleğini bozmadan yönetiyor ve ilk günden itibaren Claude.ai, API, Bedrock, Vertex ve Microsoft Foundry üzerinde kullanılabiliyor

Eksiler

  • Belirgin şekilde yavaş ve oldukça ayrıntılı: Artificial Analysis'e göre saniyede 52,6 çıktı tokeni ve ilk tokene kadar 68 saniye; değerlendirme sırasında 63M medyan tokene karşılık yaklaşık 100M çıktı tokeni tükettiği tespit edildi
  • Ayrıntılılık gerçek dünyada maliyet sorununa dönüşüyor: CodeRabbit, modelin her kod incelemesi çağrısında referans sınır modellerine kıyasla yaklaşık %50 daha fazla okuduğunu ve yaklaşık %65 daha fazla yazdığını ölçtü
  • 'Maliyet açısından verimli' söylemine rağmen gerçek bir fiyat indirimi yok: Opus 4.8 ile aynı ($5/$25), GPT-5.6 fiyatına yakın ($5/$30) ve karşılaştırılabilir Gemini ya da Grok seviyelerinin 2 katından fazla
  • İncelemeciler modelin kişiliğini 'parlak ama sinir bozucu' olarak tanımlıyor: aşırı doğrulama, temkinli ifadeler ve birleştirme çakışması çözmek gibi sıradan görevlerde zaman zaman reddetme (Lenny's Newsletter saha incelemesi)
  • Opus 4.8'den geçiş yapanlar için API'de uyumluluğu bozan bir değişiklik: düşünme varsayılan olarak açık ve xhigh veya max çaba seviyesinde kapatılamıyor (400 hatası döndürüyor); Fast modu ($10/$50, yaklaşık 2,5 kat daha hızlı) yalnızca API üzerinden sunuluyor, Bedrock veya Vertex'te yok

Arenanın hükmü

Claude Opus 5, Series 5 serisinin makul varsayılan seçimi: Fable 5'in zekasının çoğuna (hatta Frontier-Bench ve GDPval'de Fable'dan daha fazlasına) tam olarak yarı token fiyatına ve %85 daha az tetiklenen sınıflandırıcılarla sahip. Yetenek için iş yüklerini Fable 5'e taşıyıp faturadan veya yanlış pozitif reddetmelerden rahatsız olanlar, bunları buraya taşımalı; hâlâ Opus 4.8 kullananlar içinse bu yükseltme, bedavaya 10 SWE-bench Pro puanı demek. Başka yere bakmak için iki dürüst neden var: gecikme ve ayrıntılılık. Saniyede 52,6 token ve ilk tokene kadar 68 saniye ile etkileşimli kullanıcı deneyimine pek uygun değil, token iştahı da etiket fiyatının ötesinde gerçek maliyetleri sessizce şişiriyor; bu yüzden bütçeye duyarlı, yüksek hacimli iş akışları hâlâ Sonnet 5, Gemini veya DeepSeek'e ait. Fable 5, yalnızca SWE-bench Pro'daki küçük üstünlüğünün biriktiği en uzun otonom çalıştırmalar için saklanmalı.

Başparmak yukarı ya da aşağı

Hükmünüzü verin

Claude Opus 5 aracını tavsiye eder misiniz, yoksa kalabalığı uyarır mısınız?

63%kalabalık puanı · 4

En iyi Claude Opus 5 alternatifleri

Tüm alternatifler
1
Claude Haiku 4.5

Anthropic'in en hızlı modeli: Sonnet 4.5'in kodlama becerisinin yaklaşık %90'ı, 1M token başına $1/$5, 200K bağlam.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropic'in Haziran 2026 Mythos sınıfı amiral gemisi: SWE-bench Pro'da 80.3%, diğer tüm sınır modellerden 11 puan önde

$50/1M out63%(4)
Visit
3
Kimi K3

Moonshot'un 2,8 trilyon parametreli MoE modeli 'yeni DeepSeek anı'nı tetikledi: $3/$15 fiyatına sınıra yakın puanlar

$15/1M out57%(3)
Visit

Claude Opus 5 birebir karşılaştırmaları

Kalabalık ne diyor

Başparmak Aşağıcus

The sticker price is unchanged but my invoice is not: it writes essays where Opus 4.8 wrote answers. 68 seconds to first token killed it for our support chat, we went back to Sonnet 5.

Adil Yorumcu

Fed it a 40-tab financial model with cross-sheet formulas and asked for a scenario deck. It got the edge cases the analysts missed. For document-heavy enterprise work this is the best model I have used.

Sör Durmadan Yayınlar

We moved off Fable 5 because the bio classifier kept flagging our genomics tooling. Opus 5 does the same work at half the price and I have not seen a single silent reroute since.

Repo Muhafızı

Migrated our agents from Opus 4.8 the day it dropped. Same bill, and tasks that used to stall at the planning stage now just finish. The 10-point SWE-bench jump is not marketing, our merge queue feels it.

Claude Opus 5: sık sorulan sorular

Claude Opus 5 1M token başına ne kadar tutuyor?

Claude Opus 5, 1M girdi tokeni başına $5/1M in ve 1M çıktı tokeni başına $25/1M out tutuyor. claude-opus-5 için resmi Anthropic API liste fiyatı: 1M girdi için $5, 1M çıktı için $25, Opus 4.8 ile değişmedi; 1M bağlamın varsayılan ve maksimum olduğu tek seviye, 128K maksimum çıktı, 512 tokenden itibaren istem önbellekleme. $10/$50 fiyatlı (yaklaşık 2,5 kat daha hızlı) araştırma önizlemesindeki Fast modu yalnızca Claude API'de mevcut. platform.claude.com (What's new in Opus 5) referans alınarak Temmuz 2026'da doğrulandı.