Die Arena · KI-Modell im Test

DeepSeek-V4

von DeepSeek

Open-Weights-MoE mit 1.6T Parametern, 1M Token Kontext und fast Frontier-Niveau beim agentischen Coding für $0.87 pro 1M Output-Tokens

Arena-Score 4.1/557% empfehlen es · 3 Stimmen
Reasoning4.5
Coding4.5
Schreiben3.5
Tempo3.0
Preis-Leistung5.0
DeepSeek-V4 besuchenagentisches Coding mit kleinem BudgetLong-Context-Analyse von Codebasenselbst gehostete und feingetunte DeploymentsAPI-Workloads mit hohem Volumen
Preis

$0.87/1M out

V4-Pro-Tarif: $0.435/1M Input ($0.003625 bei Cache-Treffer), $0.87/1M Output; günstigerer V4-Flash-Tarif für $0.14/$0.28 ($0.0028 bei Cache-Treffer); der Launch-Rabatt von 75% wurde am 2026-05-22 zum dauerhaften Preis. Das offizielle Release Mitte Juli 2026 führt Stoßzeiten-/Nebenzeiten-Preise ein, die gelisteten Tarife verdoppeln sich während der Pekinger Stoßzeiten.

Anbieter

DeepSeek

Kontextfenster

1M tokens (384K max output)

Input-Preis

$0.435/1M in (cache hit $0.003625)

Output-Preis

$0.87/1M out

Modalitäten

text only

Open Weights

Ja

Was ist DeepSeek-V4?

Flaggschiff-MoE-Familie mit offenen Gewichten von DeepSeek (V4-Pro 1.6T Parameter/49B aktiv, V4-Flash 284B/13B), veröffentlicht als Preview am 24. April 2026. Bringt ein 1M-Token-Kontextfenster per Sparse Attention, Thinking- und Non-Thinking-Modi und MIT-lizenzierte Gewichte auf Hugging Face. Positioniert als Open-Source-SOTA auf agentischen Coding-Benchmarks, zu einem Bruchteil der Frontier-API-Preise.

DeepSeek-V4: Vor- und Nachteile

Vorteile

  • 1M-Token-Kontextfenster (8x die 128K von V3.2) mit bis zu 384K Output-Tokens, Standard auf der offiziellen API
  • Aggressive Preise: $0.435/$0.87 pro 1M Tokens (V4-Pro), pro Output-Token rund 28.7x günstiger als Claude Opus 4.8; Input mit Cache-Treffer fällt auf $0.003625/1M (über 99% Rabatt)
  • MIT-lizenzierte offene Gewichte für V4-Pro und V4-Flash auf Hugging Face: kommerzielle Nutzung, Fine-Tuning und Weiterverbreitung erlaubt
  • Open-Source-SOTA beim agentischen Coding: 80.6 auf SWE-bench Verified (Konfiguration Think Max), gleichauf mit Gemini 3.1 Pro, dazu Codeforces-Rating 3206 (~Rang 23 gegenüber Menschen)
  • Platz #3 von 93 im Artificial Analysis Intelligence Index (Score 44), deutlich über dem Durchschnitt von 25
  • Der Sparse-Attention-Stack senkt die 1M-Kontext-Inferenz auf 27% der FLOPs von V3.2 und 10% von dessen KV-Cache

Nachteile

  • Zeitweise fehlerhafte Tool-Calls: Funktionsaufrufe landen manchmal als Klartext im Content statt im tool_calls-Feld (GitHub-Issue deepseek-ai #1244)
  • Der Thinking-Modus bricht lange Multi-Turn-Tool-Call-Ketten in Agent-Frameworks mit 400-Fehlern ab (OpenClaw-Issue #72044, Fix noch unvollständig)
  • Entwickler berichten, dass es in eigenen Codebasen nicht existierende APIs erfindet und in Agent-Schleifen auf halluzinierte Nutzereingaben reagiert
  • Sehr wortreich (180M Eval-Output-Tokens gegenüber 95M im Median) und Mittelfeld-Tempo mit 54.6 Tokens/s (#39/93), was den niedrigen Preis pro Token in der Praxis aufzehrt
  • Nur Text (keine Vision, kein Audio) und weiterhin eine Preview: Das für Mitte Juli 2026 geplante offizielle Release bringt Stoßzeiten-Preise, die die gelisteten API-Tarife während der Pekinger Geschäftszeiten verdoppeln

Das Urteil der Arena

Wählen Sie DeepSeek-V4, wenn Sie Reasoning und agentisches Coding fast auf Frontier-Niveau zum 3-fach bis knapp 30-fach niedrigeren Preis als Claude Opus oder GPT-5.5 wollen, oder wenn Ihnen MIT-lizenzierte Gewichte für Self-Hosting und Fine-Tuning wichtig sind. Es ist ein entschiedenes Upgrade gegenüber V3.2: 8x längerer Kontext, deutlich günstigere Long-Context-Inferenz und stärkeres Coding, und die alten deepseek-chat/reasoner-Endpunkte werden ohnehin am 24. Juli 2026 abgeschaltet. Meiden Sie es für Produktions-Agents, die auf absolut zuverlässiges Multi-Turn-Tool-Calling angewiesen sind, wo Nutzer weiterhin fehlerhafte Tool-Calls und erfundene APIs melden, sowie für jede Vision- oder Audio-Arbeit, da es reiner Text ist. Latenzsensible Apps sollten zuerst testen, denn seine Wortfülle und das Mittelfeld-Tempo von 54.6 Tokens/s fressen einen Teil des Kostenvorteils auf, und kalkulieren Sie die Verdopplung der Preise zu Stoßzeiten ein, die mit dem offiziellen Release Mitte Juli kommt.

Daumen hoch oder Daumen runter

Fällen Sie Ihr Urteil

Würden Sie DeepSeek-V4 empfehlen oder die Menge davor warnen?

57%Crowd-Score · 3

Top-Alternativen zu DeepSeek-V4

Alle Alternativen
1
Claude Haiku 4.5

Anthropics schnellstes Modell: etwa 90% der Coding-Stärke von Sonnet 4.5 für $1/$5 pro 1M Tokens, 200K Kontext.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropics Mythos-Klasse-Flaggschiff vom Juni 2026: 80.3% auf SWE-bench Pro, 11 Punkte vor jedem anderen Frontier-Modell

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropics Opus vom April 2026: 87.6% SWE-bench Verified, 1M Kontext, hochauflösende Vision, inzwischen hinter Opus 4.8

$25/1M out57%(3)
Visit

DeepSeek-V4 im direkten Vergleich

Was die Menge sagt

Daumen Runtericus

Tool calling is flaky. Function calls sometimes land as plain text instead of the tool_calls field, and thinking mode 400s on long multi-turn chains. Not agent-ready yet.

Der Faire Richter

MIT license on both Pro and Flash weights is the real story. Fine-tune, redistribute, ship commercially, no lawyer needed. Plus 384K output tokens for long-doc generation.

Sir Shipt-Viel

MIT weights, 1M context, and output tokens roughly 29x cheaper than Opus 4.8. Cache hits make input basically free. Moved my bulk pipelines over and the bill collapsed.

DeepSeek-V4: häufige Fragen

Was kostet DeepSeek-V4 pro 1M Tokens?

DeepSeek-V4 kostet $0.435/1M in (cache hit $0.003625) pro 1M Input-Tokens und $0.87/1M out pro 1M Output-Tokens. V4-Pro-Tarif: $0.435/1M Input ($0.003625 bei Cache-Treffer), $0.87/1M Output; günstigerer V4-Flash-Tarif für $0.14/$0.28 ($0.0028 bei Cache-Treffer); der Launch-Rabatt von 75% wurde am 2026-05-22 zum dauerhaften Preis. Das offizielle Release Mitte Juli 2026 führt Stoßzeiten-/Nebenzeiten-Preise ein, die gelisteten Tarife verdoppeln sich während der Pekinger Stoßzeiten.