아레나 · AI 모델 리뷰
Claude Opus 4.6
제공: Anthropic
Anthropic의 2026년 2월 Opus: 1M 컨텍스트, 적응형 사고, SWE-bench 80.8%, 현재는 Opus 4.8에 자리를 내줌.
$25/1M out
표준 요금제 1M 토큰당 $5/$25. 전체 1M 컨텍스트가 이제 표준 요율로 과금됩니다(출시 당시 200K 토큰 초과분에 부과되던 $10/$37.50 할증은 이후 폐지). 배치 API 50% 할인($2.50/$12.50), 미국 내 추론(inference_geo)은 1.1x 배율.
Anthropic
1M tokens (128K max output)
$5/1M in
$25/1M out
text, vision (image input), text output
없음
Claude Opus 4.6은(는) 어떤 툴인가?
2026년 2월 5일에 출시된 프런티어 Opus급 모델입니다. 1M 토큰 컨텍스트 윈도우, 적응형 사고, effort 파라미터(low~max)를 갖춘 최초의 Opus입니다. 출시 시점에 SWE-bench Verified 80.8%와 Terminal-Bench 2.0 최고 점수를 기록했으며, 이후 동일 가격의 Opus 4.7과 4.8에 자리를 내줬습니다.
Claude Opus 4.6의 장단점
장점
- SWE-bench Verified 80.8%(25회 시행 평균)와 출시 시점 Terminal-Bench 2.0 최고 점수로, 해당 세대(2026년 2월) 최고의 에이전트 코딩 모델이었습니다
- 1M 토큰 컨텍스트 윈도우를 갖춘 최초의 Opus: 1M 토큰에서 MRCR v2 8-needle 76%, Sonnet 4.5는 18.5%에 그쳤습니다
- Opus 4.5 대비 큰 추론 도약: ARC-AGI-2 68.8% vs 37.6%, 경제 가치 과제 GDPval-AA에서 +190 Elo(GPT-5.2 대비 약 144 Elo 우위)
- 성능 향상에도 Opus 4.5 가격($5/$25 per 1M tokens)을 유지했으며, 이제 전체 1M 컨텍스트가 표준 요율로 과금되고 배치 할인 50%가 적용됩니다
- 적응형 사고와 effort 파라미터(low/medium/high/max)로 요청별로 지능, 지연 시간, 비용을 조절할 수 있습니다
- 자율 에이전트 동작이 뛰어납니다: 작업을 병렬화하고 Opus 4.5보다 손이 덜 갑니다(Every.to Vibe Check)
단점
- Opus 4.5보다 느리고 장황합니다. 리뷰어들은 긴 에이전트 실행에서 '부하가 걸리면 속도가 흔들린다'고 보고합니다(Every.to)
- 글쓰기가 퇴보했습니다: 블라인드 테스트에서 Every.to 팀은 Opus 4.5의 문장을 선호했고, 4.6은 'X가 아니라 Y' 구문 같은 AI 특유의 표현이 더 많습니다
- 때때로 예상치 못한 변경을 가하고 '자기 능력을 스스로 잘 모르는' 경우가 있어, 리뷰어들에 따르면 GPT-5.x Codex보다 더 촘촘한 감독이 필요합니다
- 출시 몇 달 만에 동일한 $5/$25 가격의 Opus 4.7과 4.8에 자리를 내줬으며, 2026년 6월부터 4.6에서는 fast mode를 쓸 수 없습니다(요청이 표준 속도로 실행됩니다)
- 일부 개발자는 벤치마크 피로감을 호소합니다: 일상 코딩에서 4.5 대비 체감 향상이 점수만큼 크지 않고, SWE-bench 자체도 4.5와 사실상 동률이었습니다(80.8% vs 80.9%)
아레나의 평결
동일 가격에 에이전트 코딩과 장문 컨텍스트 작업에서 Opus 4.5를 확실히 앞서는 업그레이드이며, 출시 시점에는 에이전트 코딩 벤치마크 정상을 지켰습니다. 그러나 2026년 중반 기준으로 새 프로젝트를 이 모델로 시작할 이유는 거의 없습니다: Opus 4.8이 동일한 $5/$25에 전 영역에서 더 뛰어나므로, 4.6은 이미 검증해 둔 동작을 고정할 때 주로 선택하십시오. 블라인드 테스트에서 Opus 4.5의 문장이 선호되었으니 글쓰기 용도라면 피해야 하며, 지연 시간에 민감한 사용자는 4.5보다 느린 데다 fast mode 옵션도 없다는 점에 유의하십시오.
엄지 위인가, 엄지 아래인가
평결을 내리세요
Claude Opus 4.6을(를) 추천하시겠습니까, 아니면 대중에게 경고하시겠습니까?
Claude Opus 4.6 대안 베스트
모든 대안 보기Anthropic의 최고속 모델: Sonnet 4.5 코딩 실력의 약 90%를 1M 토큰당 $1/$5에, 200K 컨텍스트.
Anthropic의 2026년 6월 Mythos급 플래그십: SWE-bench Pro 80.3%, 다른 모든 프런티어 모델을 11점 차로 앞섬
Anthropic의 2026년 4월 Opus: SWE-bench Verified 87.6%, 1M 컨텍스트, 고해상도 비전, 현재는 Opus 4.8에 뒤처짐
Claude Opus 4.6 1:1 비교
Claude Opus 4.6: 자주 묻는 질문
Claude Opus 4.6의 1M 토큰당 비용은 얼마인가요?
Claude Opus 4.6은(는) 입력 토큰 1M당 $5/1M in, 출력 토큰 1M당 $25/1M out입니다. 표준 요금제 1M 토큰당 $5/$25. 전체 1M 컨텍스트가 이제 표준 요율로 과금됩니다(출시 당시 200K 토큰 초과분에 부과되던 $10/$37.50 할증은 이후 폐지). 배치 API 50% 할인($2.50/$12.50), 미국 내 추론(inference_geo)은 1.1x 배율.