Arena · recenzja: model AI
Claude Opus 4.5
od Anthropic
Frontierowy koder Anthropic z listopada 2025: pierwszy powyżej 80% na SWE-bench Verified, wyceniony 66% taniej niż Opus 4.1
$25/1M out
Oficjalna cena katalogowa API Anthropic dla claude-opus-4-5 (jeden poziom, bez dopłaty za długi kontekst; 200K kontekstu, 64K maks. wyjścia); ta sama stawka $5/$25 co u następców Opus 4.6-4.8; obowiązuje 50% zniżki batch i prompt caching. Zweryfikowano względem przeglądu modeli na platform.claude.com, 2026-07.
Anthropic
200K tokens
$5/1M in
$25/1M out
text, vision
Nie
Czym jest Claude Opus 4.5?
Flagowy model rozumowania i kodowania od Anthropic, wydany 2025-11-24. Pierwszy model, który przekroczył 80% na SWE-bench Verified (80.9%), na starcie z ceną obniżoną o 66% względem Opus 4.1 i nowym parametrem effort. Dziś model legacy, zastąpiony przez Opus 4.6 do 4.8 w tej samej cenie API.
Claude Opus 4.5: plusy i minusy
Plusy
- Pierwszy model powyżej 80% na SWE-bench Verified (80.9% na starcie), lepszy od Gemini 3 Pro i GPT-5.1 w rzeczywistym kodowaniu
- Cięcie ceny o 66% względem Opus 4.1 ($5/$25 vs $15/$75 za 1M tokenów) uczyniło klasę Opus opłacalną w produkcji
- 48-76% mniej tokenów wyjściowych niż Sonnet 4.5 przy równej lub lepszej jakości, co dodatkowo wzmacnia obniżkę ceny
- Parametr effort (wprowadzony wraz z tym modelem) pozwala wymieniać głębię rozumowania na koszt i opóźnienie dla każdego wywołania
- Mocne relacje z praktyki: złożone refaktoryzacje za jednym podejściem, wyłapane race conditions, które umykały innym modelom, zbieżność w ~4 iteracjach agentowych vs ~10 u rywali
- +29% na Vending-Bench względem Sonnet 4.5, z mniejszą liczbą ślepych zaułków w długich zadaniach autonomicznych
Minusy
- Tylko 200K okna kontekstu (maks. 64K wyjścia), daleko za 1M u Gemini 3 Pro i nowszych modeli Claude; użytkownicy zgłaszali wybiórczą uwagę powyżej ~70% zapełnienia kontekstu
- Na starcie zamknięty za planami Max za $100-200/mies. w aplikacjach Claude; subskrybenci Pro zostali odcięci, a intensywni użytkownicy i tak trafiali na limity (HN nazwał to 'penny-wise and pound-foolish')
- Umiarkowane opóźnienie; extended thinking dokłada koszt i zwłokę przy prostych zadaniach
- Zastąpiony od początku 2026: Opus 4.6/4.7/4.8 kosztują te same $5/$25 przy 1M kontekstu i wyższych benchmarkach, więc 4.5 nie ma już przewagi cenowej
- Przestarzała powierzchnia API: ręczne extended thinking przez budget_tokens zamiast adaptacyjnego myślenia nowszych modeli Claude
Werdykt areny
Wybierz Claude Opus 4.5 tylko wtedy, gdy masz obciążenie już dostrojone i przypięte do tego snapshotu (claude-opus-4-5-20251101) i potrzebujesz stabilności. To było przełomowe wydanie, pierwsze powyżej 80% na SWE-bench Verified i z ceną obniżoną o 66% względem Opus 4.1, ale Anthropic sprzedaje dziś Opus 4.6 do 4.8 po identycznej stawce $5/$25, z oknem kontekstu 1M i lepszymi wynikami. Każdy, kto startuje z nowym projektem, powinien wybrać Opus 4.8, a użytkownicy wrażliwi na koszty dostaną kodowanie klasy niemal Opus w Sonnet 5 za $3/$15 (promocyjnie $2/$10 do sierpnia 2026). Omijaj go całkowicie, jeśli Twoje prompty zbliżają się do sufitu 200K kontekstu.
Kciuk w górę czy kciuk w dół
Wydaj swój werdykt
Polecasz Claude Opus 4.5, czy ostrzegasz przed nim tłum?
Najlepsze alternatywy dla Claude Opus 4.5
Wszystkie alternatywyNajszybszy model Anthropic: około 90% umiejętności kodowania Sonnet 4.5 za $1/$5 za 1M tokenów, 200K kontekstu.
Flagowiec Anthropic klasy Mythos z czerwca 2026: 80.3% na SWE-bench Pro, 11 punktów przewagi nad każdym innym modelem frontierowym
Opus Anthropic z kwietnia 2026: 87.6% SWE-bench Verified, 1M kontekstu, wizja wysokiej rozdzielczości, dziś za Opus 4.8
Porównaj Claude Opus 4.5 w pojedynku
Claude Opus 4.5: najczęstsze pytania
Ile kosztuje Claude Opus 4.5 za 1M tokenów?
Claude Opus 4.5 kosztuje $5/1M in za 1M tokenów wejściowych i $25/1M out za 1M tokenów wyjściowych. Oficjalna cena katalogowa API Anthropic dla claude-opus-4-5 (jeden poziom, bez dopłaty za długi kontekst; 200K kontekstu, 64K maks. wyjścia); ta sama stawka $5/$25 co u następców Opus 4.6-4.8; obowiązuje 50% zniżki batch i prompt caching. Zweryfikowano względem przeglądu modeli na platform.claude.com, 2026-07.