L'arena · recensione di modello IA

DeepSeek-V4

di DeepSeek

MoE open weights da 1.6T con contesto da 1M di tokens e coding agentico quasi di frontiera a $0.87 per 1M di output tokens

Punteggio dell'arena 4.1/557% lo consiglia · 3 voti
Ragionamento4.5
Coding4.5
Scrittura3.5
Velocità3.0
Rapporto qualità-prezzo5.0
Visita DeepSeek-V4coding agentico con budget ridottoanalisi di codebase long-contextdeployment self-hosted e con fine-tuningcarichi API ad alto volume
Prezzo

$0.87/1M out

Tier V4-Pro: $0.435/1M in input ($0.003625 in cache hit), $0.87/1M in output; tier V4-Flash più economico a $0.14/$0.28 ($0.0028 in cache hit); lo sconto lancio del 75% è diventato prezzo permanente il 2026-05-22. La release ufficiale di metà luglio 2026 introduce prezzi picco/fuori picco, con le tariffe di listino raddoppiate durante le ore di punta di Pechino.

Fornitore

DeepSeek

Finestra di contesto

1M tokens (384K max output)

Prezzo in input

$0.435/1M in (cache hit $0.003625)

Prezzo in output

$0.87/1M out

Modalità

text only

Open weights

Che cos'è DeepSeek-V4?

Famiglia MoE open weights di punta di DeepSeek (V4-Pro 1.6T parametri/49B attivi, V4-Flash 284B/13B), rilasciata in preview il 24 aprile 2026. Porta una finestra di contesto da 1M di tokens via sparse attention, modalità thinking e non-thinking, e pesi con licenza MIT su Hugging Face. Si posiziona come SOTA open source sui benchmark di coding agentico a una frazione dei prezzi delle API di frontiera.

DeepSeek-V4: pro e contro

Pro

  • Finestra di contesto da 1M di tokens (8x i 128K di V3.2) con fino a 384K di output tokens, standard sull'API ufficiale
  • Prezzi aggressivi: $0.435/$0.87 per 1M di tokens (V4-Pro), circa 28.7x più economico per output token di Claude Opus 4.8; l'input in cache-hit scende a $0.003625/1M (oltre il 99% di sconto)
  • Pesi open con licenza MIT sia per V4-Pro che per V4-Flash su Hugging Face: uso commerciale, fine-tuning e redistribuzione consentiti
  • SOTA open source sul coding agentico: 80.6 su SWE-bench Verified (config Think Max), alla pari con Gemini 3.1 Pro, più rating Codeforces 3206 (~23° posto contro gli umani)
  • Al 3° posto su 93 nell'Artificial Analysis Intelligence Index (punteggio 44), ben sopra la media di 25
  • Lo stack a sparse attention riduce l'inferenza con contesto 1M al 27% dei FLOPs di V3.2 e al 10% della sua KV cache

Contro

  • Tool call malformati a intermittenza: le function call a volte escono come testo semplice nel content invece che nel campo tool_calls (issue GitHub deepseek-ai #1244)
  • La modalità thinking rompe le catene lunghe di tool call multi-turn con errori 400 nei framework agentici (issue OpenClaw #72044, fix ancora incompleto)
  • Gli sviluppatori riportano che si inventa API inesistenti nelle codebase custom e agisce su input utente allucinati nei loop agentici
  • Molto prolisso (180M di output tokens in valutazione contro una mediana di 95M) e velocità nella media a 54.6 tok/s (39°/93), che erode il basso prezzo per token in pratica
  • Solo testo (niente visione né audio) e ancora in preview: la release ufficiale prevista per metà luglio 2026 introduce prezzi di picco che raddoppiano le tariffe API di listino durante gli orari lavorativi di Pechino

Il verdetto dell'arena

Scegli DeepSeek-V4 se vuoi ragionamento e coding agentico quasi di frontiera a un prezzo da 3x fino a quasi 30x sotto Claude Opus o GPT-5.5, o se i pesi con licenza MIT per self-hosting e fine-tuning contano per te. È un upgrade decisivo rispetto a V3.2: contesto 8x più lungo, inferenza long-context molto più economica e coding più forte, e comunque i vecchi endpoint deepseek-chat/reasoner sono deprecati dal 24 luglio 2026. Evitalo per gli agenti in produzione che dipendono da un tool calling multi-turn a prova di bomba, dove gli utenti segnalano ancora tool call malformati e API inventate, e per qualsiasi lavoro con visione o audio visto che è solo testo. Anche le app sensibili alla latenza dovrebbero testarlo prima, perché la sua prolissità e la velocità di output nella media a 54.6 tok/s erodono parte del vantaggio di costo, e metti in conto il raddoppio dei prezzi in ore di picco in arrivo con la release ufficiale di metà luglio.

Pollice su o pollice verso

Emetti il tuo verdetto

Consiglieresti DeepSeek-V4, o metteresti in guardia la folla?

57%punteggio della folla · 3

Migliori alternative a DeepSeek-V4

Tutte le alternative
1
Claude Haiku 4.5

Il modello più veloce di Anthropic: circa il 90% delle capacità di coding di Sonnet 4.5 a $1/$5 per 1M di tokens, contesto 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Il flagship di classe Mythos di Anthropic di giugno 2026: 80.3% su SWE-bench Pro, 11 punti sopra ogni altro modello di frontiera

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

L'Opus di Anthropic di aprile 2026: 87.6% su SWE-bench Verified, contesto 1M, visione ad alta risoluzione, ormai dietro a Opus 4.8

$25/1M out57%(3)
Visit

Confronta DeepSeek-V4 testa a testa

Cosa dice la folla

Pollice Versicus

Tool calling is flaky. Function calls sometimes land as plain text instead of the tool_calls field, and thinking mode 400s on long multi-turn chains. Not agent-ready yet.

Il Recensore Imparziale

MIT license on both Pro and Flash weights is the real story. Fine-tune, redistribute, ship commercially, no lawyer needed. Plus 384K output tokens for long-doc generation.

Ser Shippa-Tanto

MIT weights, 1M context, and output tokens roughly 29x cheaper than Opus 4.8. Cache hits make input basically free. Moved my bulk pipelines over and the bill collapsed.

DeepSeek-V4: domande frequenti

Quanto costa DeepSeek-V4 per 1M di token?

DeepSeek-V4 costa $0.435/1M in (cache hit $0.003625) per 1M di token in input e $0.87/1M out per 1M di token in output. Tier V4-Pro: $0.435/1M in input ($0.003625 in cache hit), $0.87/1M in output; tier V4-Flash più economico a $0.14/$0.28 ($0.0028 in cache hit); lo sconto lancio del 75% è diventato prezzo permanente il 2026-05-22. La release ufficiale di metà luglio 2026 introduce prezzi picco/fuori picco, con le tariffe di listino raddoppiate durante le ore di punta di Pechino.