Arena · recenzja: model AI

Claude Sonnet 5

od Anthropic

Najbardziej agentowy Sonnet od Anthropic: jakość bliska Opus 4.8 w kodowaniu i agentach za $3/$15 z kontekstem 1M

Wynik areny 4.4/557% rekomendacji · 3 głosy
Rozumowanie4.5
Kodowanie4.5
Pisanie4.5
Szybkość4.0
Stosunek jakości do ceny4.5
Odwiedź Claude Sonnet 5agenci kodującyagenci computer-use i terminalowianaliza długiego kontekstuefektywna kosztowo praca wiedzowa
Cena

$15/1M out ($10 intro until 2026-08-31)

Jeden poziom: $3/$15 za 1M tokenów standardowo, $2/$10 promocyjnie do 31 sierpnia 2026; Batch API -50%; nowy tokenizer daje mniej więcej 30% więcej tokenów na tekst (1.0-1.35x według Anthropic), podnosząc efektywny koszt.

Dostawca

Anthropic

Okno kontekstu

1M tokens (128K max output)

Cena wejścia

$3/1M in ($2 intro until 2026-08-31)

Cena wyjścia

$15/1M out ($10 intro until 2026-08-31)

Modalności

text, vision (image input, text output)

Open weights

Nie

Czym jest Claude Sonnet 5?

Model średniej klasy od Anthropic wydany 30 czerwca 2026, następca Sonnet 4.6. Dostarcza wydajność bliską Opus 4.8 w kodowaniu agentowym, użyciu narzędzi i pracy wiedzowej w cenach Sonnet. Kontekst 1M tokenów, 128K maks. wyjścia, adaptacyjne myślenie włączone domyślnie.

Claude Sonnet 5: plusy i minusy

Plusy

  • Duże zyski agentowe względem Sonnet 4.6: Terminal-Bench 2.1 80.4% vs 67.0%, OSWorld-Verified 81.2% vs 78.5%, SWE-bench Pro 63.2% vs 58.1%
  • Dorównuje Opus 4.8 w pracy wiedzowej (GDPval-AA v2: 1,618 vs 1,615) i niemal remisuje z nim na Humanity's Last Exam z narzędziami (57.4% vs 57.9%) za 60% ceny Opus 4.8 (40% w oknie promocyjnym)
  • Okno kontekstu 1M tokenów i 128K maks. wyjścia; cena promocyjna $2/$10 za 1M tokenów do 31 sierpnia 2026
  • Wytrwałe, samoweryfikujące zachowanie agentowe: recenzje z praktyki odnotowują, że testuje własny kod i iteruje nad trudnymi problemami aż do rozwiązania, w przeciwieństwie do Sonnet 4.6
  • Pierwszy Sonnet z poziomem effort xhigh i wizją wysokiej rozdzielczości (obrazy 2576px); adaptacyjne myślenie włączone domyślnie
  • Wyższa precyzja code review niż Sonnet 4.6 (38-40% vs 29%), czyli mniej fałszywie pozytywnych znalezisk

Minusy

  • Nowy tokenizer zawyża liczbę tokenów o mniej więcej 30% dla tego samego tekstu (1.0-1.35x według Anthropic; ~1.4x angielski, ~1.28x Python w pomiarach Simona Willisona), podnosząc efektywny koszt mimo niezmienionej ceny katalogowej
  • Rozwlekły i tokenożerny: ~$2.29 na zadanie vs ~$1.20 dla Sonnet 4.6 w niezależnych testach (101. miejsce na 161 pod względem efektywności kosztowej); przy wysokim effort koszt na zadanie może przewyższyć Opus 4.8
  • Mierzalnie wolniejszy od Sonnet 4.6 przy małych rutynowych edycjach i skłonny do przeinżynierowania prostych zadań (recenzja praktyczna CodeRabbit)
  • Parametry samplowania (temperature, top_p, top_k) usunięte; wartości inne niż domyślne zwracają błąd 400, co psuje istniejące pipeline'y
  • Nastroje po premierze na HN/Reddit były mieszane: etykietę '5' uznano za obietnicę na wyrost, a ostrzejsze zabezpieczenia cyberbezpieczeństwa potrafią odmawiać nieszkodliwej pracy okołobezpieczeństwowej

Werdykt areny

Wybierz Sonnet 5, jeśli prowadzisz agentów kodujących, terminalowych lub computer-use i chcesz jakości bliskiej Opus 4.8 w cenach Sonnet, zwłaszcza w oknie promocyjnym $2/$10; na niskim i średnim effort to bezwzględny upgrade względem Sonnet 4.6. Zabudżetuj nowy tokenizer i jego rozwlekłość: realne koszty na zadanie są wyraźnie wyższe niż u Sonnet 4.6, a na najwyższych poziomach effort Opus 4.8 może wychodzić taniej na rozwiązane zadanie. Unikaj go przy małych edycjach wrażliwych na opóźnienia oraz w pipeline'ach opartych na temperature i top_p, które teraz zwracają błąd. Sonnet 4.6 pozostaje pragmatycznym wyborem dla masowych obciążeń z drobnymi diffami.

Kciuk w górę czy kciuk w dół

Wydaj swój werdykt

Polecasz Claude Sonnet 5, czy ostrzegasz przed nim tłum?

57%wynik tłumu · 3

Najlepsze alternatywy dla Claude Sonnet 5

Wszystkie alternatywy
1
Claude Haiku 4.5

Najszybszy model Anthropic: około 90% umiejętności kodowania Sonnet 4.5 za $1/$5 za 1M tokenów, 200K kontekstu.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Flagowiec Anthropic klasy Mythos z czerwca 2026: 80.3% na SWE-bench Pro, 11 punktów przewagi nad każdym innym modelem frontierowym

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Opus Anthropic z kwietnia 2026: 87.6% SWE-bench Verified, 1M kontekstu, wizja wysokiej rozdzielczości, dziś za Opus 4.8

$25/1M out57%(3)
Visit

Porównaj Claude Sonnet 5 w pojedynku

Co mówi tłum

Kapitan Churn

Cheap per token, pricey per task. Independent tests had it near $2.29 a task vs $1.20 on 4.6, and at high effort it can out-cost Opus 4.8. It will not stop talking.

Złoty Kciukus

Terminal-Bench going 67 to 80 over Sonnet 4.6 matches what I see. My CI-fix agent went from constant babysitting to mostly hands-off overnight.

Święty Deployus

Matches Opus 4.8 on knowledge work at 60% of the price, and the intro $2/$10 window makes it silly value. My research agent runs on Sonnet 5 now, zero regrets.

Claude Sonnet 5: najczęstsze pytania

Ile kosztuje Claude Sonnet 5 za 1M tokenów?

Claude Sonnet 5 kosztuje $3/1M in ($2 intro until 2026-08-31) za 1M tokenów wejściowych i $15/1M out ($10 intro until 2026-08-31) za 1M tokenów wyjściowych. Jeden poziom: $3/$15 za 1M tokenów standardowo, $2/$10 promocyjnie do 31 sierpnia 2026; Batch API -50%; nowy tokenizer daje mniej więcej 30% więcej tokenów na tekst (1.0-1.35x według Anthropic), podnosząc efektywny koszt.