Arena · recenzja: model AI
Claude Opus 4.6
od Anthropic
Opus Anthropic z lutego 2026: 1M kontekstu, adaptacyjne myślenie, 80.8% SWE-bench, dziś zastąpiony przez Opus 4.8.
$25/1M out
Poziom standardowy $5/$25 za 1M tokenów; pełny kontekst 1M już według stawek standardowych (startowa dopłata $10/$37.50 powyżej 200K tokenów została później zniesiona), batch API 50% taniej ($2.50/$12.50), inferencja wyłącznie w USA (inference_geo) z mnożnikiem 1.1x.
Anthropic
1M tokens (128K max output)
$5/1M in
$25/1M out
text, vision (image input), text output
Nie
Czym jest Claude Opus 4.6?
Frontierowy model klasy Opus wydany 5 lutego 2026. Pierwszy Opus z oknem kontekstu 1M tokenów, adaptacyjnym myśleniem i parametrem effort (od low do max). Na starcie zanotował 80.8% na SWE-bench Verified i najwyższy wynik Terminal-Bench 2.0; później zastąpiony przez Opus 4.7 i 4.8 w identycznej cenie.
Claude Opus 4.6: plusy i minusy
Plusy
- 80.8% SWE-bench Verified (średnia z 25 prób) i najwyższy wynik Terminal-Bench 2.0 na starcie, wiodący model kodowania agentowego swojej generacji (luty 2026)
- Pierwszy Opus z oknem kontekstu 1M tokenów: 76% na MRCR v2 8-needle przy 1M tokenów vs 18.5% dla Sonnet 4.5
- Duży skok w rozumowaniu względem Opus 4.5: ARC-AGI-2 68.8% vs 37.6%, +190 Elo na zadaniach wartości ekonomicznej GDPval-AA (~144 Elo nad GPT-5.2)
- Zachował cenę Opus 4.5 ($5/$25 za 1M tokenów) mimo postępów; pełny kontekst 1M rozliczany według stawek standardowych, 50% zniżki batch
- Adaptacyjne myślenie plus parametr effort (low/medium/high/max) do wymiany inteligencji, opóźnienia i kosztu dla każdego żądania
- Mocne zachowanie jako agent autonomiczny: zrównolegla pracę i wymaga mniej prowadzenia za rękę niż Opus 4.5 (Every.to Vibe Check)
Minusy
- Wolniejszy i bardziej rozwlekły niż Opus 4.5; recenzenci piszą, że tempo 'faluje pod obciążeniem' w długich przebiegach agentowych (Every.to)
- Regres w pisaniu: w ślepych testach zespół Every.to wolał prozę Opus 4.5, a 4.6 pokazuje więcej AI-izmów typu konstrukcje 'X, nie Y'
- Czasem wprowadza nieoczekiwane zmiany i 'nie zawsze zna własne umiejętności', przez co według recenzentów wymaga bliższego nadzoru niż GPT-5.x Codex
- Zastąpiony w ciągu miesięcy przez Opus 4.7 i 4.8 w tej samej cenie $5/$25, a fast mode jest niedostępny na 4.6 od czerwca 2026 (żądania działają ze standardową prędkością)
- Część deweloperów zgłasza zmęczenie benchmarkami: codzienne zyski w kodowaniu względem 4.5 trudniej poczuć, niż sugerują wyniki, a sam SWE-bench stał w miejscu vs 4.5 (80.8% vs 80.9%)
Werdykt areny
Wyraźny upgrade względem Opus 4.5 w kodowaniu agentowym i pracy na długim kontekście przy identycznej cenie; na starcie trzymał czołowe benchmarki kodowania agentowego. W połowie 2026 nie ma jednak powodu, by zaczynać na nim nowe projekty: Opus 4.8 kosztuje te same $5/$25 i wyprzedza go na całej linii, więc 4.6 wybieraj głównie po to, by przypiąć już zwalidowane zachowanie. Piszący powinni go unikać, bo ślepe testy wskazały prozę Opus 4.5, a użytkownicy wrażliwi na opóźnienia muszą wiedzieć, że jest wolniejszy od 4.5 i bez opcji fast mode.
Kciuk w górę czy kciuk w dół
Wydaj swój werdykt
Polecasz Claude Opus 4.6, czy ostrzegasz przed nim tłum?
Najlepsze alternatywy dla Claude Opus 4.6
Wszystkie alternatywyNajszybszy model Anthropic: około 90% umiejętności kodowania Sonnet 4.5 za $1/$5 za 1M tokenów, 200K kontekstu.
Flagowiec Anthropic klasy Mythos z czerwca 2026: 80.3% na SWE-bench Pro, 11 punktów przewagi nad każdym innym modelem frontierowym
Opus Anthropic z kwietnia 2026: 87.6% SWE-bench Verified, 1M kontekstu, wizja wysokiej rozdzielczości, dziś za Opus 4.8
Porównaj Claude Opus 4.6 w pojedynku
Claude Opus 4.6: najczęstsze pytania
Ile kosztuje Claude Opus 4.6 za 1M tokenów?
Claude Opus 4.6 kosztuje $5/1M in za 1M tokenów wejściowych i $25/1M out za 1M tokenów wyjściowych. Poziom standardowy $5/$25 za 1M tokenów; pełny kontekst 1M już według stawek standardowych (startowa dopłata $10/$37.50 powyżej 200K tokenów została później zniesiona), batch API 50% taniej ($2.50/$12.50), inferencja wyłącznie w USA (inference_geo) z mnożnikiem 1.1x.