Arena · recenzja: model AI

Claude Opus 5

od Anthropic

Odświeżenie Opus od Anthropic z lipca 2026: inteligencja bliska Fable 5 za połowę ceny, wciąż $5/$25 jak w Opus 4.8

Wynik areny 4/563% rekomendacji · 4 głosy
Rozumowanie5.0
Kodowanie5.0
Pisanie4.0
Szybkość2.0
Stosunek jakości do ceny4.0
Odwiedź Claude Opus 5codziennego kodowania klasy frontier i agentów bez cennika Fable 5korporacyjnej pracy z wiedzą (dokumenty, arkusze, prezentacje)zespołów napotykających fałszywe alarmy klasyfikatorów Fable 5orkiestracji multiagentowej i wzorców typu writer-verifier
Cena

$25/1M out

Oficjalna cena katalogowa Anthropic API dla claude-opus-5: $5/1M tokenów wejściowych, $25/1M tokenów wyjściowych, bez zmian względem Opus 4.8, jeden poziom z kontekstem 1M jako wartością domyślną i maksymalną, maksymalnie 128K tokenów na wyjściu, cache'owanie promptów od 512 tokenów. Tryb Fast w wersji research preview za $10/$50 (około 2,5 razy szybszy) dostępny jest wyłącznie w Claude API. Zweryfikowano na podstawie platform.claude.com (What's new in Opus 5), lipiec 2026.

Dostawca

Anthropic

Okno kontekstu

1M tokens

Cena wejścia

$5/1M in

Cena wyjścia

$25/1M out

Modalności

text, vision

Open weights

Nie

Czym jest Claude Opus 5?

Wydany 24.07.2026 jako bezpośredni następca Opus 4.8 w linii Series 5 od Anthropic (Mythos 5, Fable 5, Sonnet 5, Opus 5). ID API to claude-opus-5: $5/$25 za 1M tokenów (bez zmian względem Opus 4.8), kontekst 1M jako wartość domyślna i maksymalna zarazem, maksymalnie 128K tokenów na wyjściu, myślenie włączone domyślnie z pięciopoziomową skalą wysiłku (od low do max). Pozycjonowany jako inteligencja bliska granicy możliwości za połowę ceny Fable 5: w praktyce przewyższa Fable 5 w Frontier-Bench (43,3 % wobec 33,7 %) i GDPval-AA v2 (Elo 1861 wobec 1747), nieznacznie ustępując mu w SWE-bench Pro (79,2 % wobec 80,0 %). Klasyfikatory bezpieczeństwa uruchamiają się o 85 % rzadziej niż w Fable 5, a domyślny tryb awaryjny zapobiega cichym błędom odmowy.

Claude Opus 5: plusy i minusy

Plusy

  • Sklasyfikowany na 1. miejscu pod względem inteligencji ogólnej wśród 190 modeli w rankingu Artificial Analysis w dniu premiery, z wynikiem 43,3 % w Frontier-Bench v0.1 wobec 34,4 % dla GPT-5.6 Sol i 33,7 % dla Claude Fable 5
  • 3,9 razy lepszy od GPT-5.6 Sol w nowatorskim rozumowaniu ARC-AGI-3 (30,2 % wobec 7,8 %) oraz Elo 1861 w pracy wiedzowej GDPval-AA v2, przed Fable 5 (1747)
  • 79,2 % w SWE-bench Pro, punkt procentowy od Fable 5 (80,0 %) i 10 punktów powyżej Opus 4.8 (69,2 %), za połowę ceny Fable; współzałożyciel Cursora określa go jako model 'o inteligencji bliskiej Fable 5, ale w tempie i po cenie Opus'
  • Ta sama cena $5/$25 co w Opus 4.8, ale z większym oknem: kontekst 1M jest teraz domyślnym i jedynym poziomem, z maksymalnie 128K tokenów na wyjściu oraz cache'owaniem promptów od 512 tokenów
  • Klasyfikatory bezpieczeństwa dualnego zastosowania uruchamiają się o 85 % rzadziej niż w Fable 5, a nowy domyślny tryb awaryjny eliminuje ciche odmowy w trakcie sesji, które utrudniały start Fable
  • Samodzielnie weryfikuje swoją pracę bez polecenia, obsługuje zmiany narzędzi w trakcie rozmowy (wersja beta) bez utraty cache'u promptów i jest dostępny od pierwszego dnia w Claude.ai, API, Bedrock, Vertex oraz Microsoft Foundry

Minusy

  • Zauważalnie wolny i bardzo rozwlekły: 52,6 tokena wyjściowego na sekundę i 68 sekund do pierwszego tokenu w Artificial Analysis, a podczas testów zużył około 100M tokenów wyjściowych wobec mediany 63M
  • Rozwlekłość to realny problem kosztowy: CodeRabbit zmierzył, że model odczytuje około 50 % więcej i zapisuje około 65 % więcej treści niż referencyjne modele klasy frontier przy jednym przeglądzie kodu
  • Brak faktycznej obniżki ceny mimo narracji o 'efektywności kosztowej': cena identyczna jak w Opus 4.8 ($5/$25), niemal na poziomie GPT-5.6 ($5/$30) i ponad 2 razy wyższa niż porównywalne poziomy Gemini czy Grok
  • Recenzenci opisują osobowość modelu jako 'genialną, ale irytującą': nadmierna weryfikacja, unikanie jednoznacznych odpowiedzi i sporadyczne odmowy przy prostych zadaniach, jak rozwiązanie konfliktu scalania (recenzja terenowa Lenny's Newsletter)
  • Zmiana API łamiąca kompatybilność dla użytkowników migrujących z Opus 4.8: myślenie jest włączone domyślnie i nie da się go wyłączyć przy poziomie wysiłku xhigh lub max (zwraca błąd 400); tryb Fast ($10/$50, około 2,5 razy szybszy) dostępny jest wyłącznie przez API, nie w Bedrock ani Vertex

Werdykt areny

Claude Opus 5 to rozsądny domyślny wybór z linii Series 5: większość inteligencji Fable 5 (a w Frontier-Bench i GDPval nawet więcej niż Fable) za dokładnie połowę ceny tokenów, z klasyfikatorami uruchamiającymi się o 85 % rzadziej. Jeśli obciążenia zostały przeniesione na Fable 5 ze względu na możliwości, ale rachunek lub fałszywe odmowy są problemem, warto przenieść je tutaj; dla użytkowników wciąż pracujących na Opus 4.8 aktualizacja oznacza 10 dodatkowych punktów w SWE-bench Pro bez dopłaty. Dwa uczciwe powody, by rozejrzeć się za czymś innym, to opóźnienie i rozwlekłość. Przy 52,6 tokena na sekundę i 68 sekundach do pierwszego tokenu model słabo sprawdza się w interaktywnym UX, a jego apetyt na tokeny po cichu podnosi realne koszty ponad cenę katalogową, więc wrażliwe na budżet pipeline'y o wysokim wolumenie wciąż lepiej powierzyć Sonnet 5, Gemini lub DeepSeek. Fable 5 warto zachować jedynie do najdłuższych autonomicznych zadań, gdzie jego niewielka przewaga w SWE-bench Pro się kumuluje.

Kciuk w górę czy kciuk w dół

Wydaj swój werdykt

Polecasz Claude Opus 5, czy ostrzegasz przed nim tłum?

63%wynik tłumu · 4

Najlepsze alternatywy dla Claude Opus 5

Wszystkie alternatywy
1
Claude Haiku 4.5

Najszybszy model Anthropic: około 90% umiejętności kodowania Sonnet 4.5 za $1/$5 za 1M tokenów, 200K kontekstu.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Flagowiec Anthropic klasy Mythos z czerwca 2026: 80.3% na SWE-bench Pro, 11 punktów przewagi nad każdym innym modelem frontierowym

$50/1M out63%(4)
Visit
3
Kimi K3

MoE od Moonshot z 2,8 biliona parametrów, które wywołało 'nowy moment DeepSeek': wyniki bliskie granicy możliwości za $3/$15

$15/1M out57%(3)
Visit

Porównaj Claude Opus 5 w pojedynku

Co mówi tłum

Kciuk-w-Dółus

The sticker price is unchanged but my invoice is not: it writes essays where Opus 4.8 wrote answers. 68 seconds to first token killed it for our support chat, we went back to Sonnet 5.

Sprawiedliwy Recenzent

Fed it a 40-tab financial model with cross-sheet formulas and asked for a scenario deck. It got the edge cases the analysts missed. For document-heavy enterprise work this is the best model I have used.

Sir Wdrożycus

We moved off Fable 5 because the bio classifier kept flagging our genomics tooling. Opus 5 does the same work at half the price and I have not seen a single silent reroute since.

Strażnik Repozytorium

Migrated our agents from Opus 4.8 the day it dropped. Same bill, and tasks that used to stall at the planning stage now just finish. The 10-point SWE-bench jump is not marketing, our merge queue feels it.

Claude Opus 5: najczęstsze pytania

Ile kosztuje Claude Opus 5 za 1M tokenów?

Claude Opus 5 kosztuje $5/1M in za 1M tokenów wejściowych i $25/1M out za 1M tokenów wyjściowych. Oficjalna cena katalogowa Anthropic API dla claude-opus-5: $5/1M tokenów wejściowych, $25/1M tokenów wyjściowych, bez zmian względem Opus 4.8, jeden poziom z kontekstem 1M jako wartością domyślną i maksymalną, maksymalnie 128K tokenów na wyjściu, cache'owanie promptów od 512 tokenów. Tryb Fast w wersji research preview za $10/$50 (około 2,5 razy szybszy) dostępny jest wyłącznie w Claude API. Zweryfikowano na podstawie platform.claude.com (What's new in Opus 5), lipiec 2026.