아레나 · AI 모델 리뷰
DeepSeek-V4
제공: DeepSeek
1M 토큰 컨텍스트와 프런티어급에 근접한 에이전트 코딩을 출력 1M 토큰당 $0.87에 제공하는 오픈 웨이트 1.6T MoE
$0.87/1M out
V4-Pro 요금제: 입력 $0.435/1M(캐시 히트 $0.003625), 출력 $0.87/1M. 더 저렴한 V4-Flash 요금제는 $0.14/$0.28(캐시 히트 $0.0028). 출시 기념 75% 할인은 2026-05-22에 정식 가격이 되었습니다. 2026년 7월 중순 정식 출시에서 피크/오프피크 요금제가 도입되어 베이징 피크 시간대에는 표기 요율이 두 배가 됩니다.
DeepSeek
1M tokens (384K max output)
$0.435/1M in (cache hit $0.003625)
$0.87/1M out
text only
있음
DeepSeek-V4은(는) 어떤 툴인가?
2026년 4월 24일에 프리뷰로 공개된 DeepSeek의 플래그십 오픈 웨이트 MoE 패밀리입니다(V4-Pro 1.6T 파라미터/활성 49B, V4-Flash 284B/13B). 희소 어텐션 기반 1M 토큰 컨텍스트 윈도우, thinking/non-thinking 모드, Hugging Face의 MIT 라이선스 가중치를 제공합니다. 프런티어 API 가격의 몇 분의 1로 에이전트 코딩 벤치마크의 오픈소스 SOTA를 표방합니다.
DeepSeek-V4의 장단점
장점
- 1M 토큰 컨텍스트 윈도우(V3.2의 128K 대비 8배)와 최대 384K 출력 토큰을 공식 API에서 기본 제공합니다
- 공격적인 가격: 1M 토큰당 $0.435/$0.87(V4-Pro)로 출력 토큰 기준 Claude Opus 4.8보다 약 28.7배 저렴하며, 캐시 히트 입력은 $0.003625/1M까지 떨어집니다(99% 이상 할인)
- V4-Pro와 V4-Flash 모두 Hugging Face에 MIT 라이선스 오픈 웨이트로 공개: 상업적 사용, 파인튜닝, 재배포가 허용됩니다
- 에이전트 코딩의 오픈소스 SOTA: SWE-bench Verified 80.6(Think Max 구성)으로 Gemini 3.1 Pro와 동률, Codeforces 레이팅 3206(인간 대비 약 23위)
- Artificial Analysis Intelligence Index에서 93개 모델 중 3위(점수 44)로 평균 25를 크게 웃돕니다
- 희소 어텐션 스택이 1M 컨텍스트 추론을 V3.2 대비 FLOPs 27%, KV 캐시 10% 수준으로 줄입니다
단점
- 간헐적인 툴 호출 형식 오류: 함수 호출이 tool_calls 필드 대신 content에 일반 텍스트로 출력되는 경우가 있습니다(GitHub 이슈 deepseek-ai #1244)
- thinking 모드가 에이전트 프레임워크에서 긴 멀티턴 툴 호출 체인을 400 오류로 끊습니다(OpenClaw 이슈 #72044, 수정 미완)
- 커스텀 코드베이스에서 존재하지 않는 API를 지어내고, 에이전트 루프에서 환각된 사용자 입력에 따라 행동한다는 개발자 보고가 있습니다
- 매우 장황하고(평가 출력 토큰 180M vs 중앙값 95M) 속도도 중위권인 54.6 tok/s(93개 중 39위)라, 낮은 토큰당 가격이 실전에서는 상당 부분 상쇄됩니다
- 텍스트 전용(비전, 오디오 없음)이며 아직 프리뷰입니다: 2026년 7월 중순 예정인 정식 출시에서 베이징 업무 시간대에 표기 API 요율이 두 배가 되는 피크 요금제가 도입됩니다
아레나의 평결
Claude Opus나 GPT-5.5 가격의 3배에서 거의 30배 낮은 비용으로 프런티어급에 근접한 추론과 에이전트 코딩을 원하거나, 자체 호스팅과 파인튜닝을 위한 MIT 라이선스 가중치가 중요하다면 DeepSeek-V4를 선택하십시오. V3.2 대비 결정적인 업그레이드입니다: 8배 긴 컨텍스트, 훨씬 저렴한 장문 컨텍스트 추론, 더 강한 코딩, 게다가 레거시 deepseek-chat/reasoner 엔드포인트는 어차피 2026년 7월 24일에 지원이 종료됩니다. 형식 오류가 난 툴 호출과 지어낸 API 보고가 여전한 만큼 견고한 멀티턴 툴 호출에 의존하는 프로덕션 에이전트에는 피하고, 텍스트 전용이므로 비전이나 오디오 작업에도 피하십시오. 장황함과 중위권 54.6 tok/s 출력 속도가 비용 우위를 일부 상쇄하니 지연 시간에 민감한 앱은 먼저 테스트하고, 7월 중순 정식 출시와 함께 오는 피크 시간대 가격 2배도 예산에 반영하십시오.
엄지 위인가, 엄지 아래인가
평결을 내리세요
DeepSeek-V4을(를) 추천하시겠습니까, 아니면 대중에게 경고하시겠습니까?
DeepSeek-V4 대안 베스트
모든 대안 보기Anthropic의 최고속 모델: Sonnet 4.5 코딩 실력의 약 90%를 1M 토큰당 $1/$5에, 200K 컨텍스트.
Anthropic의 2026년 6월 Mythos급 플래그십: SWE-bench Pro 80.3%, 다른 모든 프런티어 모델을 11점 차로 앞섬
Anthropic의 2026년 4월 Opus: SWE-bench Verified 87.6%, 1M 컨텍스트, 고해상도 비전, 현재는 Opus 4.8에 뒤처짐
DeepSeek-V4 1:1 비교
대중의 목소리
“Tool calling is flaky. Function calls sometimes land as plain text instead of the tool_calls field, and thinking mode 400s on long multi-turn chains. Not agent-ready yet.”
“MIT license on both Pro and Flash weights is the real story. Fine-tune, redistribute, ship commercially, no lawyer needed. Plus 384K output tokens for long-doc generation.”
“MIT weights, 1M context, and output tokens roughly 29x cheaper than Opus 4.8. Cache hits make input basically free. Moved my bulk pipelines over and the bill collapsed.”
DeepSeek-V4: 자주 묻는 질문
DeepSeek-V4의 1M 토큰당 비용은 얼마인가요?
DeepSeek-V4은(는) 입력 토큰 1M당 $0.435/1M in (cache hit $0.003625), 출력 토큰 1M당 $0.87/1M out입니다. V4-Pro 요금제: 입력 $0.435/1M(캐시 히트 $0.003625), 출력 $0.87/1M. 더 저렴한 V4-Flash 요금제는 $0.14/$0.28(캐시 히트 $0.0028). 출시 기념 75% 할인은 2026-05-22에 정식 가격이 되었습니다. 2026년 7월 중순 정식 출시에서 피크/오프피크 요금제가 도입되어 베이징 피크 시간대에는 표기 요율이 두 배가 됩니다.