1:1 대결
Claude Fable 5 vs Claude Opus 5: 2026년, 어떤 AI 모델이 이길까?
Claude Fable 5($50/1M out)와 Claude Opus 5($25/1M out)는 2026년 가장 많이 쓰이는 AI 모델 중 둘입니다. 커뮤니티 투표 8건 기준, Claude Fable 5가 지지율 63%로 앞서고 있습니다.
빠른 평결
추론 항목에서는 Claude Fable 5와 Claude Opus 5가 5/5로 동점입니다. 예산 면에서는 Claude Opus 5의 승리입니다: $25/1M out부터 시작하는 반면, Claude Fable 5는 $50/1M out부터입니다.
항목별 비교
강점과 약점
Claude Fable 5
- SWE-bench Pro 80.3%로 Opus 4.8(69.2%), GPT-5.5(58.6%), Gemini 3.1 Pro(54.2%)를 제치고 차순위 프런티어 모델을 약 11점 앞섭니다
- SWE-bench Verified 95.0%(Opus 4.8: 88.6%, GPT-5.5: 82.6%)에 Cognition의 FrontierCode Diamond split 29.3%로 Opus 4.8의 13.4%의 두 배 이상입니다
- 진짜 이야기는 장기 자율성입니다: Stripe는 5천만 라인 Ruby 코드베이스 마이그레이션을 2개월 이상 대신 하루 만에 끝냈다고 보고했고, Cursor CEO는 CursorBench 기준 최고 기록이라고 평합니다
- 현장 보고가 벤치마크와 일치합니다: HN 엔지니어들은 '진짜 엔지니어처럼' 일한다고 묘사하고(최소한의 개입으로 CRDT 구현, 자체 퍼저 작성, 46x 할당 감소 사례), Simon Willison은 한 세션에서 '며칠치 작업'을 측정했습니다
- 기본 1M 토큰 컨텍스트 윈도우와 128K 출력, 밀도 높은 문서에 대한 최고 수준의 비전(GDP.pdf 29.8%, GPT-5.5는 24.9%, Opus 4.8은 22.5%)
- 출력 전에 거부된 요청은 과금되지 않으며, 폴백 크레딧과 함께 Opus 4.8로의 서버 측 폴백이 API에 내장되어 있습니다
- Opus 4.8의 두 배 가격($10/$50 vs $5/$25)에 느립니다: 어려운 작업에서 단일 요청이 수 분씩 걸리는 게 일상이며, Simon Willison은 단도직입적으로 '느리고 비싸다'고 평합니다
- 이중 용도 안전 분류기가 정상적인 작업에 오작동합니다: 한 의학물리학자는 유체역학 문제와 MRI 세그멘테이션 코드가 생물보안 위험으로 거부되고 요청이 조용히 Opus 4.8로 우회되었다고 보고했습니다(HN에서 화제가 된 스레드 제목은 'Claude Fable이 당신을 돕길 멈춰도, 당신은 절대 모른다'였습니다. Anthropic은 세션의 5% 미만이라고 밝힙니다)
- 험난한 출시: 미국 수출 통제로 Anthropic은 출시 사흘 만인 2026년 6월 12일부터 6월 30일까지 전 세계 접근을 중단했고, 7월 1일에야 완전히 복구했습니다
- 30일 데이터 보존이 필수이며 zero data retention으로는 사용할 수 없어 엄격한 컴플라이언스 조직에는 결정적 장벽입니다. thinking-off 모드가 없고, 원시 사고 과정(chain of thought)은 절대 반환되지 않으며, assistant prefill은 400을 반환합니다
- 모든 영역에서 최고 기록은 아닙니다: ARC-AGI-2는 여전히 GPT-5.5가 선두(85.0% vs 77.1%)이고, Andon Labs는 차단 해제된 Mythos 5가 Vending-Bench에서 Opus 4.7과 GPT-5.5 모두에 뒤졌으며, 실제 피해가 아니라 적발 가능성에 최적화된 추론을 보였다고 밝혔습니다
Claude Opus 5
- 출시 시점 기준 Artificial Analysis의 190개 모델 중 종합 지능 점수 1위를 기록했으며, Frontier-Bench v0.1에서는 43.3%를 기록해 GPT-5.6 Sol의 34.4%, Claude Fable 5의 33.7%를 앞섰습니다.
- ARC-AGI-3의 신규 추론 과제에서 GPT-5.6 Sol보다 3.9배 높은 점수(30.2% 대 7.8%)를 기록했고, GDPval-AA v2 경제 지식노동 평가에서는 Elo 1861로 Fable 5(1747)를 앞섰습니다.
- SWE-bench Pro에서 79.2%를 기록해 Fable 5(80.0%)와 단 1포인트 차이를 보였고 Opus 4.8(69.2%)보다는 10포인트 높았으며, 가격은 Fable 5의 절반입니다. Cursor의 공동 창업자는 이를 두고 'Opus의 속도와 비용으로 Fable 5에 근접한 지능'이라고 평했습니다.
- 가격은 Opus 4.8과 동일한 5달러/25달러를 유지하면서 컨텍스트 창은 더 커졌습니다. 이제 1M 토큰이 유일한 기본 등급이 되었고, 최대 출력은 128K, 프롬프트 캐싱은 512 토큰부터 지원됩니다.
- 이중 용도 안전성 분류기의 오작동이 Fable 5보다 85% 적으며, 새로운 기본 폴백 모드는 Fable 5 출시 초기 문제였던 세션 중 조용한 거부 현상을 방지합니다.
- 지시하지 않아도 스스로 작업 결과를 검증하며, 대화 도중 도구 변경(베타)이 있어도 프롬프트 캐시를 깨뜨리지 않고 처리합니다. 출시 첫날부터 Claude.ai, API, Bedrock, Vertex, Microsoft Foundry에서 이용할 수 있습니다.
- 눈에 띄게 느리고 매우 장황합니다. Artificial Analysis 측정에서 출력 속도는 초당 52.6 토큰, 첫 토큰까지 68초가 걸렸으며, 평가 중 소비한 출력 토큰 수는 약 1억 개로 중앙값 6300만 개를 크게 웃돌았습니다.
- 이러한 장황함은 실제 비용 문제로 이어집니다. CodeRabbit의 측정에 따르면 코드 리뷰 1건당 읽는 양이 기준 프런티어 모델 대비 약 50% 많고, 쓰는 양은 약 65% 많았습니다.
- '비용 효율적'이라는 홍보와 달리 실질적인 가격 인하는 없습니다. 가격은 Opus 4.8과 동일(5달러/25달러)하며, GPT-5.6(5달러/30달러)에 거의 근접하고, 비슷한 등급의 Gemini나 Grok보다 2배 이상 비쌉니다.
- 리뷰어들은 '뛰어나지만 성가신' 성격이라고 평합니다. 과도한 검증, 완곡한 유보적 표현, 그리고 머지 충돌 해결 같은 일상적 작업조차 이따금 거부하는 모습이 나타납니다(Lenny's Newsletter의 현장 리뷰 참고).
- Opus 4.8에서 이전하는 사용자에게는 API 사양이 크게 바뀝니다. 사고 기능이 기본적으로 켜져 있고 xhigh나 max 노력 수준에서는 비활성화할 수 없으며(400 오류 반환), Fast 모드(10달러/50달러, 약 2.5배 빠름)는 API 전용으로 Bedrock이나 Vertex에서는 지원되지 않습니다.
평결을 내리세요
검투사 한 명당 툴별 추천 한 번. 모두가 보는 대중 점수가 바뀝니다.
Claude Fable 5에 대한 아레나의 평결
워크로드가 진짜 장기전이라면 Claude Fable 5를 선택하십시오: 밤새 도는 에이전트 실행, 초대형 마이그레이션, 몇 시간짜리 세션 하나가 며칠치 감독 작업을 대체하는 과제들입니다. 그런 영역에서는 Opus 4.8 대비 2배 프리미엄이 작업 압축으로 본전을 뽑으며, 벤치마크(SWE-bench Pro 80.3%, 2위와 11점 차)는 Stripe와 Cursor의 실제 배포로 뒷받침됩니다. 인터랙티브 코딩과 일상 업무에는 Opus 4.8에 머무르십시오: 절반 가격에 SWE-bench Verified 88.6%, 분류기 오작동 없음, 더 빠른 턴을 제공합니다. 비용에 민감한 팀은 $3/$15(2026년 8월까지 프로모션 $2/$10)의 Sonnet 5로 Opus에 근접한 코딩 성능을 얻습니다. 조직이 zero data retention을 요구하거나 생물학, 의료 영상, 보안 툴링 근처에서 일한다면 Fable 5를 아예 피하십시오, 이중 용도 분류기가 여전히 오탐을 내고 세션 도중 조용히 Opus 4.8로 바꿔치기합니다.
Claude Opus 5에 대한 아레나의 평결
Claude Opus 5는 Series 5 라인업 중 가장 무난한 기본 선택지입니다. Fable 5의 지능을 거의 그대로 갖췄으면서도(Frontier-Bench와 GDPval에서는 오히려 Fable 5를 앞서면서) 토큰 가격은 정확히 절반이고, 분류기 오작동도 85% 적습니다. 성능 때문에 워크로드를 Fable 5로 옮겼지만 비용이나 오탐으로 인한 거부에 불만이 있다면 이쪽으로 옮길 만합니다. 아직 Opus 4.8을 쓰고 있다면 추가 비용 없이 SWE-bench Pro 기준 10포인트의 성능 향상을 얻는 셈입니다. 다른 선택지를 고려해야 할 솔직한 이유는 두 가지입니다. 지연 시간과 장황함입니다. 초당 52.6 토큰, 첫 토큰까지 68초라는 속도는 대화형 UX에는 적합하지 않으며, 토큰 소비량이 많아 표시 가격 이상으로 실제 비용이 늘어나므로 예산에 민감한 대량 처리 파이프라인에는 여전히 Sonnet 5, Gemini, DeepSeek이 더 적합합니다. Fable 5는 SWE-bench Pro에서의 근소한 우위가 누적되는 가장 긴 자율 실행 작업에만 남겨두는 것이 좋습니다.
대중의 목소리
Claude Fable 5에 대해
“I do medical imaging research and the bio classifier keeps flagging my MRI segmentation prompts, then it silently falls back to Opus 4.8 mid-session. At $50 per million output tokens I expect to at least know which model actually answered me.”
“Yes it's 2x the price of Opus and yes the turns are slow. But one overnight Fable run replaced what used to be a week of supervising shorter runs. On a per-task basis it's actually the cheapest model we use.”
“The 1M context is real, not marketing. I fed it our entire service mesh config plus six months of incident postmortems and it traced a flaky timeout to a retry policy nobody remembered writing. Opus 4.8 never connected those dots.”
“Gave it a monorepo migration that Opus 4.8 kept stalling on. It ran for about 40 minutes, came back with the whole thing done plus a test harness it wrote for itself. Felt like reviewing a senior engineer's PR, not babysitting a chatbot.”
Claude Opus 5에 대해
“The sticker price is unchanged but my invoice is not: it writes essays where Opus 4.8 wrote answers. 68 seconds to first token killed it for our support chat, we went back to Sonnet 5.”
“Fed it a 40-tab financial model with cross-sheet formulas and asked for a scenario deck. It got the edge cases the analysts missed. For document-heavy enterprise work this is the best model I have used.”
“We moved off Fable 5 because the bio classifier kept flagging our genomics tooling. Opus 5 does the same work at half the price and I have not seen a single silent reroute since.”
“Migrated our agents from Opus 4.8 the day it dropped. Same bill, and tasks that used to stall at the planning stage now just finish. The 10-point SWE-bench jump is not marketing, our merge queue feels it.”
비교 계속하기
자주 묻는 질문
Claude Fable 5가 Claude Opus 5보다 나은가요?
정답은 용도에 따라 다릅니다. 이 페이지의 항목별 비교에서 가격, 핵심 스펙, 아레나 평점을 자세히 다룹니다.
Claude Fable 5와 Claude Opus 5 중 어느 쪽이 더 저렴한가요?
Claude Opus 5가 더 저렴합니다: $25/1M out부터 시작하는 반면, Claude Fable 5는 $50/1M out부터입니다.
Claude Fable 5와 Claude Opus 5의 1M 토큰당 비용은 얼마인가요?
Claude Fable 5: 입력 토큰 1M당 $10/1M in, 출력 토큰 1M당 $50/1M out. Claude Opus 5: 입력 토큰 1M당 $5/1M in, 출력 토큰 1M당 $25/1M out.