1:1 대결

Claude Opus 5 로고vsClaude Opus 4.7 로고

Claude Opus 5 vs Claude Opus 4.7: 2026년, 어떤 AI 모델이 이길까?

Claude Opus 5($25/1M out)와 Claude Opus 4.7($25/1M out)는 2026년 가장 많이 쓰이는 AI 모델 중 둘입니다. 커뮤니티 투표 7건 기준, Claude Opus 5가 지지율 63%로 앞서고 있습니다.

빠른 평결

추론 항목에서는 Claude Opus 5를 고르세요: 아레나 점수 5/5, Claude Opus 4.7는 4.5/5입니다. 둘 다 같은 가격에서 시작합니다: $25/1M out.

항목별 비교

시작 가격
$25/1M outclaude-opus-5의 앤스로픽 공식 API 정가는 입력 100만 토큰당 5달러, 출력 100만 토큰당 25달러로 Opus 4.8과 동일합니다. 컨텍스트는 1M 토큰 단일 등급으로 기본값이자 최대값이며, 최대 출력은 128K, 프롬프트 캐싱은 512 토큰부터 지원됩니다. 리서치 프리뷰 단계인 Fast 모드(10달러/50달러, 약 2.5배 빠름)는 Claude API 전용입니다. platform.claude.com(Opus 5의 새로운 기능 페이지)을 기준으로 2026년 7월에 확인했습니다.
$25/1M out표준 API 요금제에서 1M 토큰당 입력 $5 / 출력 $25, 전체 1M 컨텍스트까지 균일가(장문 컨텍스트 할증 없음). Batch API -50%. 새 토크나이저는 4.7 이전 모델 대비 약 30% 더 많은 토큰을 산출합니다.
제공사
Anthropic
Anthropic
컨텍스트 윈도우
1M tokens
1M tokens (128K max output)
입력 가격
$5/1M in
$5/1M in
출력 가격
$25/1M out
$25/1M out
모달리티
text, vision
text + image input (up to 2576px), text output
오픈 웨이트
없음
없음
대중 점수
63%(4)
57%(3)
아레나 평점(1-5)
추론
5.0
4.5
코딩
5.0
4.5
글쓰기
4.0
4.5
속도
2.0
2.5
가성비
4.0
3.0

강점과 약점

Claude Opus 5

  • 출시 시점 기준 Artificial Analysis의 190개 모델 중 종합 지능 점수 1위를 기록했으며, Frontier-Bench v0.1에서는 43.3%를 기록해 GPT-5.6 Sol의 34.4%, Claude Fable 5의 33.7%를 앞섰습니다.
  • ARC-AGI-3의 신규 추론 과제에서 GPT-5.6 Sol보다 3.9배 높은 점수(30.2% 대 7.8%)를 기록했고, GDPval-AA v2 경제 지식노동 평가에서는 Elo 1861로 Fable 5(1747)를 앞섰습니다.
  • SWE-bench Pro에서 79.2%를 기록해 Fable 5(80.0%)와 단 1포인트 차이를 보였고 Opus 4.8(69.2%)보다는 10포인트 높았으며, 가격은 Fable 5의 절반입니다. Cursor의 공동 창업자는 이를 두고 'Opus의 속도와 비용으로 Fable 5에 근접한 지능'이라고 평했습니다.
  • 가격은 Opus 4.8과 동일한 5달러/25달러를 유지하면서 컨텍스트 창은 더 커졌습니다. 이제 1M 토큰이 유일한 기본 등급이 되었고, 최대 출력은 128K, 프롬프트 캐싱은 512 토큰부터 지원됩니다.
  • 이중 용도 안전성 분류기의 오작동이 Fable 5보다 85% 적으며, 새로운 기본 폴백 모드는 Fable 5 출시 초기 문제였던 세션 중 조용한 거부 현상을 방지합니다.
  • 지시하지 않아도 스스로 작업 결과를 검증하며, 대화 도중 도구 변경(베타)이 있어도 프롬프트 캐시를 깨뜨리지 않고 처리합니다. 출시 첫날부터 Claude.ai, API, Bedrock, Vertex, Microsoft Foundry에서 이용할 수 있습니다.
  • 눈에 띄게 느리고 매우 장황합니다. Artificial Analysis 측정에서 출력 속도는 초당 52.6 토큰, 첫 토큰까지 68초가 걸렸으며, 평가 중 소비한 출력 토큰 수는 약 1억 개로 중앙값 6300만 개를 크게 웃돌았습니다.
  • 이러한 장황함은 실제 비용 문제로 이어집니다. CodeRabbit의 측정에 따르면 코드 리뷰 1건당 읽는 양이 기준 프런티어 모델 대비 약 50% 많고, 쓰는 양은 약 65% 많았습니다.
  • '비용 효율적'이라는 홍보와 달리 실질적인 가격 인하는 없습니다. 가격은 Opus 4.8과 동일(5달러/25달러)하며, GPT-5.6(5달러/30달러)에 거의 근접하고, 비슷한 등급의 Gemini나 Grok보다 2배 이상 비쌉니다.
  • 리뷰어들은 '뛰어나지만 성가신' 성격이라고 평합니다. 과도한 검증, 완곡한 유보적 표현, 그리고 머지 충돌 해결 같은 일상적 작업조차 이따금 거부하는 모습이 나타납니다(Lenny's Newsletter의 현장 리뷰 참고).
  • Opus 4.8에서 이전하는 사용자에게는 API 사양이 크게 바뀝니다. 사고 기능이 기본적으로 켜져 있고 xhigh나 max 노력 수준에서는 비활성화할 수 없으며(400 오류 반환), Fast 모드(10달러/50달러, 약 2.5배 빠름)는 API 전용으로 Bedrock이나 Vertex에서는 지원되지 않습니다.

Claude Opus 4.7

  • 출시 시점 SWE-bench Verified 87.6%(Opus 4.6의 80.8%에서 상승), SWE-bench Pro 64.3%로 GPT-5.4(57.7%)와 Gemini 3.1 Pro(54.2%)를 앞섰습니다
  • 1M 토큰 컨텍스트 윈도우와 128K 최대 출력을 장문 컨텍스트 할증 없이 균일가 $5/$25에 제공합니다(Batch API 베타로 300K 출력 가능)
  • 고해상도 비전을 갖춘 최초의 Claude: 긴 변 기준 최대 2576px 이미지를 픽셀 단위 좌표로 처리하며, 기존 대비 약 3배 세밀합니다
  • 코드 리뷰가 발군입니다: 독립 테스트에서 경쟁 모델보다 파일 간 추론이 강해 실제 버그를 더 많이 찾아내고, 문서 추론 오류가 Opus 4.6보다 21% 적습니다
  • 새로운 xhigh effort 레벨과 Task Budgets(베타)로 세밀한 비용 제어가 가능합니다: 4.7의 low effort가 4.6의 medium effort 출력 품질과 대략 맞먹습니다
  • 최신 지식: 신뢰 가능한 컷오프가 2026년 1월로, 출시 시점 기준 모든 Claude 모델 중 가장 최신이었습니다
  • 새 토크나이저가 같은 텍스트에서 토큰 수를 약 30% 부풀립니다(Anthropic 자체 문서 기준). 표시 가격은 그대로지만 요청당 실질 비용이 올라갑니다
  • 에이전트 사용 시 매우 장황합니다: 한 벤치마크에서 GPT-5.5가 동등한 코딩 작업에 출력 토큰을 72% 덜 썼고, 리뷰어들은 진행 상황 중계가 과하다고 지적합니다
  • 이전 버전에서 넘어오면 파괴적 API 변경에 부딪힙니다: temperature/top_p/top_k와 thinking budget_tokens가 이제 400 오류를 반환하고, thinking 텍스트는 기본적으로 숨겨집니다
  • 지연 시간이 중간 수준이며 high effort에서는 한 턴이 수 분 걸리기도 합니다. fast mode는 프리미엄 리서치 프리뷰였으나 4.7에서는 이미 지원 종료되었습니다
  • 약 3개월 만에 동일한 $5/$25의 Opus 4.8에 자리를 내줬고, 실시간 사이버 보안 안전장치가 정상적인 보안 작업을 오탐할 수 있습니다

평결을 내리세요

검투사 한 명당 툴별 추천 한 번. 모두가 보는 대중 점수가 바뀝니다.

Claude Opus 5$25/1M out
63%대중 점수 · 4
Claude Opus 4.7$25/1M out
57%대중 점수 · 3

Claude Opus 5에 대한 아레나의 평결

Claude Opus 5는 Series 5 라인업 중 가장 무난한 기본 선택지입니다. Fable 5의 지능을 거의 그대로 갖췄으면서도(Frontier-Bench와 GDPval에서는 오히려 Fable 5를 앞서면서) 토큰 가격은 정확히 절반이고, 분류기 오작동도 85% 적습니다. 성능 때문에 워크로드를 Fable 5로 옮겼지만 비용이나 오탐으로 인한 거부에 불만이 있다면 이쪽으로 옮길 만합니다. 아직 Opus 4.8을 쓰고 있다면 추가 비용 없이 SWE-bench Pro 기준 10포인트의 성능 향상을 얻는 셈입니다. 다른 선택지를 고려해야 할 솔직한 이유는 두 가지입니다. 지연 시간과 장황함입니다. 초당 52.6 토큰, 첫 토큰까지 68초라는 속도는 대화형 UX에는 적합하지 않으며, 토큰 소비량이 많아 표시 가격 이상으로 실제 비용이 늘어나므로 예산에 민감한 대량 처리 파이프라인에는 여전히 Sonnet 5, Gemini, DeepSeek이 더 적합합니다. Fable 5는 SWE-bench Pro에서의 근소한 우위가 누적되는 가장 긴 자율 실행 작업에만 남겨두는 것이 좋습니다.

Claude Opus 4.7에 대한 아레나의 평결

재현성 때문에 이미 이 모델에 고정되어 있는 경우에만 Opus 4.7을 선택하십시오: Opus 4.8이 동일한 $5/$25에 동일한 API 구조를 유지하면서 성능은 더 뛰어나므로 새 프로젝트의 기본값으로 더 낫습니다. 에이전트 코딩, 코드 리뷰, 1M 컨텍스트 문서 작업에는 여전히 매우 강력하며 Opus 4.6 대비 확실한 업그레이드입니다. 4.6에서 이전하는 팀은 파괴적 API 변경과 프롬프트당 토큰을 약 30% 더 소비하는 토크나이저를 예산에 반영해야 합니다. 비용에 민감한 사용자는 $3/$15(2026년 8월 31일까지 프로모션 $2/$10)에 Opus급에 근접한 품질을 내는 Sonnet 5를 검토하십시오.

대중의 목소리

Claude Opus 5에 대해

엄지 다운니쿠스

The sticker price is unchanged but my invoice is not: it writes essays where Opus 4.8 wrote answers. 68 seconds to first token killed it for our support chat, we went back to Sonnet 5.

공정한 리뷰어

Fed it a 40-tab financial model with cross-sheet formulas and asked for a scenario deck. It got the edge cases the analysts missed. For document-heavy enterprise work this is the best model I have used.

출시왕 경

We moved off Fable 5 because the bio classifier kept flagging our genomics tooling. Opus 5 does the same work at half the price and I have not seen a single silent reroute since.

저장소의 수호자

Migrated our agents from Opus 4.8 the day it dropped. Same bill, and tasks that used to stall at the planning stage now just finish. The 10-point SWE-bench jump is not marketing, our merge queue feels it.

Claude Opus 4.7에 대해

엄지 다운니쿠스

Watch your invoices. New tokenizer counts ~30% more tokens for the same text, and it narrates every tiny step. Sticker price unchanged, effective cost definitely not.

공정한 리뷰어

Came from 4.6 and stopped chunking repos entirely. 1M context, 128K output, flat $5/$25 with no long-context premium. That pricing decision alone won me over.

출시왕 경

87.6 SWE-bench Verified is not just marketing, it closes tickets GPT-5.4 fumbles. And the hi-res vision with pixel-accurate coords finally makes screenshot debugging useful.

자주 묻는 질문

Claude Opus 5가 Claude Opus 4.7보다 나은가요?

현재 대중은 Claude Opus 5의 편입니다: 추천율 63%, Claude Opus 4.7는 57%입니다(투표 7건). 추론 항목에서는 Claude Opus 5가 더 높은 평가를 받았습니다(5/5 vs 4.5/5). 정답은 용도에 따라 다릅니다. 이 페이지의 항목별 비교에서 가격, 핵심 스펙, 아레나 평점을 자세히 다룹니다.

Claude Opus 5와 Claude Opus 4.7 중 어느 쪽이 더 저렴한가요?

시작 가격은 같습니다: 둘 다 $25/1M out부터입니다.

Claude Opus 5와 Claude Opus 4.7의 1M 토큰당 비용은 얼마인가요?

Claude Opus 5: 입력 토큰 1M당 $5/1M in, 출력 토큰 1M당 $25/1M out. Claude Opus 4.7: 입력 토큰 1M당 $5/1M in, 출력 토큰 1M당 $25/1M out.