아레나 · AI 모델 리뷰
Claude Sonnet 5
제공: Anthropic
Anthropic의 가장 에이전트다운 Sonnet: 코딩과 에이전트에서 Opus 4.8에 근접한 품질을 $3/$15와 1M 컨텍스트로 제공
$15/1M out ($10 intro until 2026-08-31)
단일 요금제: 표준 1M 토큰당 $3/$15, 2026년 8월 31일까지 프로모션 $2/$10. Batch API -50%. 새 토크나이저는 같은 텍스트에서 약 30% 더 많은 토큰을 산출해(Anthropic 기준 1.0-1.35x) 실질 비용이 올라갑니다.
Anthropic
1M tokens (128K max output)
$3/1M in ($2 intro until 2026-08-31)
$15/1M out ($10 intro until 2026-08-31)
text, vision (image input, text output)
없음
Claude Sonnet 5은(는) 어떤 툴인가?
2026년 6월 30일에 출시되어 Sonnet 4.6을 잇는 Anthropic의 미드티어 모델입니다. 에이전트 코딩, 툴 사용, 지식 업무에서 Opus 4.8에 근접한 성능을 Sonnet 가격에 제공합니다. 1M 토큰 컨텍스트, 128K 최대 출력, 적응형 사고 기본 활성화.
Claude Sonnet 5의 장단점
장점
- Sonnet 4.6 대비 큰 에이전트 성능 향상: Terminal-Bench 2.1 80.4% vs 67.0%, OSWorld-Verified 81.2% vs 78.5%, SWE-bench Pro 63.2% vs 58.1%
- 지식 업무에서 Opus 4.8과 대등하고(GDPval-AA v2: 1,618 vs 1,615) 툴 사용 Humanity's Last Exam에서도 거의 동률(57.4% vs 57.9%)이면서 가격은 Opus 4.8의 60%(프로모션 기간에는 40%)입니다
- 1M 토큰 컨텍스트 윈도우와 128K 최대 출력, 2026년 8월 31일까지 1M 토큰당 $2/$10의 프로모션 가격
- 끈질기게 자체 검증하는 에이전트 동작: 실사용 리뷰에 따르면 Sonnet 4.6과 달리 자기 코드를 직접 테스트하고 어려운 문제를 풀릴 때까지 반복합니다
- xhigh effort 레벨과 고해상도 비전(2576px 이미지)을 갖춘 최초의 Sonnet이며, 적응형 사고가 기본 활성화되어 있습니다
- Sonnet 4.6보다 높은 코드 리뷰 정밀도(38-40% vs 29%)로 오탐 지적이 더 적습니다
단점
- 새 토크나이저가 같은 텍스트에서 토큰 수를 약 30% 부풀립니다(Anthropic 기준 1.0-1.35x, Simon Willison 측정 영어 약 1.4x, Python 약 1.28x). 표시 가격은 그대로지만 실질 비용이 올라갑니다
- 장황하고 토큰을 많이 소모합니다: 독립 테스트에서 작업당 약 $2.29로 Sonnet 4.6의 약 $1.20 대비 높았고(비용 효율 161개 모델 중 101위), high effort에서는 작업당 비용이 Opus 4.8을 넘을 수 있습니다
- 작은 일상적 수정에서 Sonnet 4.6보다 눈에 띄게 느리고, 단순한 작업을 과도하게 설계하는 경향이 있습니다(CodeRabbit 실사용 리뷰)
- 샘플링 파라미터(temperature, top_p, top_k)가 제거되었습니다. 기본값이 아닌 값은 400 오류를 반환해 기존 파이프라인이 깨집니다
- HN/Reddit의 출시 반응은 엇갈렸습니다: '5'라는 이름이 과장이라는 평이 있었고, 강화된 사이버 보안 안전장치가 무해한 보안 관련 작업을 거부할 수 있습니다
아레나의 평결
코딩, 터미널, 컴퓨터 사용 에이전트를 운영하면서 Sonnet 가격에 Opus 4.8에 근접한 품질을 원한다면 Sonnet 5를 선택하십시오. 특히 $2/$10 프로모션 기간에 유리하며, low와 medium effort에서는 Sonnet 4.6의 완전한 상위 호환입니다. 다만 새 토크나이저와 장황함을 예산에 반영하십시오: 실제 작업당 비용이 Sonnet 4.6을 크게 웃돌고, 최고 effort 레벨에서는 해결한 작업당 비용 기준으로 Opus 4.8이 더 나은 선택일 수 있습니다. 지연 시간에 민감한 소규모 수정이나 temperature와 top_p에 의존하는 파이프라인에는 피하십시오, 이제 오류가 발생합니다. 소규모 diff를 대량으로 처리하는 워크로드에는 Sonnet 4.6이 여전히 실용적인 선택입니다.
엄지 위인가, 엄지 아래인가
평결을 내리세요
Claude Sonnet 5을(를) 추천하시겠습니까, 아니면 대중에게 경고하시겠습니까?
Claude Sonnet 5 대안 베스트
모든 대안 보기Anthropic의 최고속 모델: Sonnet 4.5 코딩 실력의 약 90%를 1M 토큰당 $1/$5에, 200K 컨텍스트.
Anthropic의 2026년 6월 Mythos급 플래그십: SWE-bench Pro 80.3%, 다른 모든 프런티어 모델을 11점 차로 앞섬
Anthropic의 2026년 4월 Opus: SWE-bench Verified 87.6%, 1M 컨텍스트, 고해상도 비전, 현재는 Opus 4.8에 뒤처짐
Claude Sonnet 5 1:1 비교
대중의 목소리
“Cheap per token, pricey per task. Independent tests had it near $2.29 a task vs $1.20 on 4.6, and at high effort it can out-cost Opus 4.8. It will not stop talking.”
“Terminal-Bench going 67 to 80 over Sonnet 4.6 matches what I see. My CI-fix agent went from constant babysitting to mostly hands-off overnight.”
“Matches Opus 4.8 on knowledge work at 60% of the price, and the intro $2/$10 window makes it silly value. My research agent runs on Sonnet 5 now, zero regrets.”
Claude Sonnet 5: 자주 묻는 질문
Claude Sonnet 5의 1M 토큰당 비용은 얼마인가요?
Claude Sonnet 5은(는) 입력 토큰 1M당 $3/1M in ($2 intro until 2026-08-31), 출력 토큰 1M당 $15/1M out ($10 intro until 2026-08-31)입니다. 단일 요금제: 표준 1M 토큰당 $3/$15, 2026년 8월 31일까지 프로모션 $2/$10. Batch API -50%. 새 토크나이저는 같은 텍스트에서 약 30% 더 많은 토큰을 산출해(Anthropic 기준 1.0-1.35x) 실질 비용이 올라갑니다.