아레나 · AI 모델 리뷰

DeepSeek-V4

제공: DeepSeek

1M 토큰 컨텍스트와 프런티어급에 근접한 에이전트 코딩을 출력 1M 토큰당 $0.87에 제공하는 오픈 웨이트 1.6T MoE

아레나 점수 4.1/557% 추천 · 투표 3건
추론4.5
코딩4.5
글쓰기3.5
속도3.0
가성비5.0
DeepSeek-V4 방문저예산 에이전트 코딩장문 컨텍스트 코드베이스 분석자체 호스팅 및 파인튜닝 배포대용량 API 워크로드
가격

$0.87/1M out

V4-Pro 요금제: 입력 $0.435/1M(캐시 히트 $0.003625), 출력 $0.87/1M. 더 저렴한 V4-Flash 요금제는 $0.14/$0.28(캐시 히트 $0.0028). 출시 기념 75% 할인은 2026-05-22에 정식 가격이 되었습니다. 2026년 7월 중순 정식 출시에서 피크/오프피크 요금제가 도입되어 베이징 피크 시간대에는 표기 요율이 두 배가 됩니다.

제공사

DeepSeek

컨텍스트 윈도우

1M tokens (384K max output)

입력 가격

$0.435/1M in (cache hit $0.003625)

출력 가격

$0.87/1M out

모달리티

text only

오픈 웨이트

있음

DeepSeek-V4은(는) 어떤 툴인가?

2026년 4월 24일에 프리뷰로 공개된 DeepSeek의 플래그십 오픈 웨이트 MoE 패밀리입니다(V4-Pro 1.6T 파라미터/활성 49B, V4-Flash 284B/13B). 희소 어텐션 기반 1M 토큰 컨텍스트 윈도우, thinking/non-thinking 모드, Hugging Face의 MIT 라이선스 가중치를 제공합니다. 프런티어 API 가격의 몇 분의 1로 에이전트 코딩 벤치마크의 오픈소스 SOTA를 표방합니다.

DeepSeek-V4의 장단점

장점

  • 1M 토큰 컨텍스트 윈도우(V3.2의 128K 대비 8배)와 최대 384K 출력 토큰을 공식 API에서 기본 제공합니다
  • 공격적인 가격: 1M 토큰당 $0.435/$0.87(V4-Pro)로 출력 토큰 기준 Claude Opus 4.8보다 약 28.7배 저렴하며, 캐시 히트 입력은 $0.003625/1M까지 떨어집니다(99% 이상 할인)
  • V4-Pro와 V4-Flash 모두 Hugging Face에 MIT 라이선스 오픈 웨이트로 공개: 상업적 사용, 파인튜닝, 재배포가 허용됩니다
  • 에이전트 코딩의 오픈소스 SOTA: SWE-bench Verified 80.6(Think Max 구성)으로 Gemini 3.1 Pro와 동률, Codeforces 레이팅 3206(인간 대비 약 23위)
  • Artificial Analysis Intelligence Index에서 93개 모델 중 3위(점수 44)로 평균 25를 크게 웃돕니다
  • 희소 어텐션 스택이 1M 컨텍스트 추론을 V3.2 대비 FLOPs 27%, KV 캐시 10% 수준으로 줄입니다

단점

  • 간헐적인 툴 호출 형식 오류: 함수 호출이 tool_calls 필드 대신 content에 일반 텍스트로 출력되는 경우가 있습니다(GitHub 이슈 deepseek-ai #1244)
  • thinking 모드가 에이전트 프레임워크에서 긴 멀티턴 툴 호출 체인을 400 오류로 끊습니다(OpenClaw 이슈 #72044, 수정 미완)
  • 커스텀 코드베이스에서 존재하지 않는 API를 지어내고, 에이전트 루프에서 환각된 사용자 입력에 따라 행동한다는 개발자 보고가 있습니다
  • 매우 장황하고(평가 출력 토큰 180M vs 중앙값 95M) 속도도 중위권인 54.6 tok/s(93개 중 39위)라, 낮은 토큰당 가격이 실전에서는 상당 부분 상쇄됩니다
  • 텍스트 전용(비전, 오디오 없음)이며 아직 프리뷰입니다: 2026년 7월 중순 예정인 정식 출시에서 베이징 업무 시간대에 표기 API 요율이 두 배가 되는 피크 요금제가 도입됩니다

아레나의 평결

Claude Opus나 GPT-5.5 가격의 3배에서 거의 30배 낮은 비용으로 프런티어급에 근접한 추론과 에이전트 코딩을 원하거나, 자체 호스팅과 파인튜닝을 위한 MIT 라이선스 가중치가 중요하다면 DeepSeek-V4를 선택하십시오. V3.2 대비 결정적인 업그레이드입니다: 8배 긴 컨텍스트, 훨씬 저렴한 장문 컨텍스트 추론, 더 강한 코딩, 게다가 레거시 deepseek-chat/reasoner 엔드포인트는 어차피 2026년 7월 24일에 지원이 종료됩니다. 형식 오류가 난 툴 호출과 지어낸 API 보고가 여전한 만큼 견고한 멀티턴 툴 호출에 의존하는 프로덕션 에이전트에는 피하고, 텍스트 전용이므로 비전이나 오디오 작업에도 피하십시오. 장황함과 중위권 54.6 tok/s 출력 속도가 비용 우위를 일부 상쇄하니 지연 시간에 민감한 앱은 먼저 테스트하고, 7월 중순 정식 출시와 함께 오는 피크 시간대 가격 2배도 예산에 반영하십시오.

엄지 위인가, 엄지 아래인가

평결을 내리세요

DeepSeek-V4을(를) 추천하시겠습니까, 아니면 대중에게 경고하시겠습니까?

57%대중 점수 · 3

DeepSeek-V4 대안 베스트

모든 대안 보기
1
Claude Haiku 4.5

Anthropic의 최고속 모델: Sonnet 4.5 코딩 실력의 약 90%를 1M 토큰당 $1/$5에, 200K 컨텍스트.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropic의 2026년 6월 Mythos급 플래그십: SWE-bench Pro 80.3%, 다른 모든 프런티어 모델을 11점 차로 앞섬

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropic의 2026년 4월 Opus: SWE-bench Verified 87.6%, 1M 컨텍스트, 고해상도 비전, 현재는 Opus 4.8에 뒤처짐

$25/1M out57%(3)
Visit

DeepSeek-V4 1:1 비교

대중의 목소리

엄지 다운니쿠스

Tool calling is flaky. Function calls sometimes land as plain text instead of the tool_calls field, and thinking mode 400s on long multi-turn chains. Not agent-ready yet.

공정한 리뷰어

MIT license on both Pro and Flash weights is the real story. Fine-tune, redistribute, ship commercially, no lawyer needed. Plus 384K output tokens for long-doc generation.

출시왕 경

MIT weights, 1M context, and output tokens roughly 29x cheaper than Opus 4.8. Cache hits make input basically free. Moved my bulk pipelines over and the bill collapsed.

DeepSeek-V4: 자주 묻는 질문

DeepSeek-V4의 1M 토큰당 비용은 얼마인가요?

DeepSeek-V4은(는) 입력 토큰 1M당 $0.435/1M in (cache hit $0.003625), 출력 토큰 1M당 $0.87/1M out입니다. V4-Pro 요금제: 입력 $0.435/1M(캐시 히트 $0.003625), 출력 $0.87/1M. 더 저렴한 V4-Flash 요금제는 $0.14/$0.28(캐시 히트 $0.0028). 출시 기념 75% 할인은 2026-05-22에 정식 가격이 되었습니다. 2026년 7월 중순 정식 출시에서 피크/오프피크 요금제가 도입되어 베이징 피크 시간대에는 표기 요율이 두 배가 됩니다.