아레나 · AI 모델 리뷰
Claude Haiku 4.5
제공: Anthropic
Anthropic의 최고속 모델: Sonnet 4.5 코딩 실력의 약 90%를 1M 토큰당 $1/$5에, 200K 컨텍스트.
$5/1M out
단일 요금제: 입력 $1/1M, 출력 $5/1M. 프롬프트 캐시 읽기 $0.10/1M(5분 쓰기 $1.25/1M), Batch API 50% 할인($0.50/$2.50). 장문 컨텍스트 할증 없음(최대 200K).
Anthropic
200K tokens
$1/1M in
$5/1M out
text, vision (input); text output
없음
Claude Haiku 4.5은(는) 어떤 툴인가?
2025년 10월 15일에 출시된 속도 중심의 소형 Claude 모델입니다. SWE-bench Verified 73.3%로 Sonnet 4.5의 에이전트 코딩 성능의 약 90%를 3분의 1 비용에 제공합니다. 비전 입력과 확장 사고를 지원하며, 200K 컨텍스트 윈도우와 64K 최대 출력을 갖췄습니다.
Claude Haiku 4.5의 장단점
장점
- SWE-bench Verified 73.3%, Sonnet 4.5 에이전트 코딩의 약 90%를 3분의 1 가격에 제공합니다
- 빠릅니다: Anthropic 기준 Sonnet 4의 2배 이상, 출시 고객들은 Sonnet 4.5보다 4-5배 빠르다고 보고했으며, Artificial Analysis 측정 출력 속도는 약 92-110 tok/s입니다
- 개발자들은 무관한 코드를 건드리지 않는 정밀하고 국소적인 코드 수정을 보고하며, 초기 테스트에서 GPT-5 mini급보다 낫다는 평입니다
- 비전 입력과 확장 사고를 모두 지원합니다, 출시 시점 이 가격대에서는 드문 조합입니다
- 멀티 에이전트 구성의 워커 모델로 잘 맞습니다(Sonnet/Opus가 계획하고 병렬 Haiku 서브에이전트가 실행)
- 프롬프트 캐시 읽기 $0.10/1M과 Batch API 50% 할인으로 실질 비용을 더 낮출 수 있습니다
단점
- 소형 모델치고 출력 $5/1M은 비쌉니다: 출력이 많은 작업에서는 Gemini Flash와 GPT mini 티어가 몇 배 더 저렴합니다
- 200K 컨텍스트(Sonnet 5/Opus 형제 모델의 1M 대비)와 64K 최대 출력이 대규모 코드베이스와 장문 출력 작업을 제약합니다
- 범용 추론이 평범합니다: GPQA, MedQA, MMMU류 지식 과제에서 약하다는 사용자 보고가 있습니다
- 실사용 처리량 편차가 큽니다(82-208 tok/s 보고). 7-8분 이상 이어지는 긴 에이전트 세션에서는 품질이 저하됩니다
- 지식 컷오프(신뢰 가능 기준 2025년 2월)가 2026년 중반 기준으로는 낡았습니다
아레나의 평결
Anthropic 스택을 쓰면서 Sonnet에 근접한 코딩 품질을 낮은 지연 시간과 3분의 1 가격에 원한다면 Haiku 4.5를 선택하십시오: Haiku 3.5에서 크게 도약했으며 멀티 에이전트 파이프라인의 워커 모델로 탁월합니다. 2026년 7월 기준 Anthropic의 현행 소형 모델이므로 Claude 기반 제품의 기본 저가 티어입니다. 깊은 범용 추론, 초대형 코드베이스(200K 컨텍스트 상한), 순수 토큰당 비용 비교 구매에는 피하십시오, 그 영역에서는 이제 Gemini Flash와 GPT mini 티어가 더 저렴하며, 속도보다 품질이 중요해지면 Sonnet 5로 올라가십시오.
엄지 위인가, 엄지 아래인가
평결을 내리세요
Claude Haiku 4.5을(를) 추천하시겠습니까, 아니면 대중에게 경고하시겠습니까?
Claude Haiku 4.5 대안 베스트
모든 대안 보기Anthropic의 2026년 6월 Mythos급 플래그십: SWE-bench Pro 80.3%, 다른 모든 프런티어 모델을 11점 차로 앞섬
Anthropic의 2026년 4월 Opus: SWE-bench Verified 87.6%, 1M 컨텍스트, 고해상도 비전, 현재는 Opus 4.8에 뒤처짐
Anthropic의 가장 에이전트다운 Sonnet: 코딩과 에이전트에서 Opus 4.8에 근접한 품질을 $3/$15와 1M 컨텍스트로 제공
Claude Haiku 4.5 1:1 비교
대중의 목소리
“The precise localized edits are the underrated feature. It fixes the line that needs fixing and leaves the rest alone. GPT mini class models keep rewriting half my file.”
“Haiku 4.5 gives me about 90% of Sonnet agentic coding at a third of the price, and it is fast enough that edit loops feel instant. My default for quick fixes now.”
Claude Haiku 4.5: 자주 묻는 질문
Claude Haiku 4.5의 1M 토큰당 비용은 얼마인가요?
Claude Haiku 4.5은(는) 입력 토큰 1M당 $1/1M in, 출력 토큰 1M당 $5/1M out입니다. 단일 요금제: 입력 $1/1M, 출력 $5/1M. 프롬프트 캐시 읽기 $0.10/1M(5분 쓰기 $1.25/1M), Batch API 50% 할인($0.50/$2.50). 장문 컨텍스트 할증 없음(최대 200K).