Арена · огляд: ШІ-модель

DeepSeek-V4

від DeepSeek

Open weights MoE на 1.6T із контекстом 1M токенів і майже флагманським агентним кодуванням за $0.87 за 1M вихідних токенів

Оцінка арени 4.1/557% рекомендують · 3 голоси
Міркування4.5
Код4.5
Тексти3.5
Швидкість3.0
Ціна-якість5.0
Відвідати DeepSeek-V4агентне кодування з обмеженим бюджетоманаліз кодових баз із довгим контекстомсамостійно хостовані й дотреновані розгортаннямасові API-навантаження
Ціна

$0.87/1M out

Тариф V4-Pro: $0.435/1M за вхід ($0.003625 при кеш-хіті), $0.87/1M за вихід; дешевший тариф V4-Flash за $0.14/$0.28 ($0.0028 при кеш-хіті); стартова знижка 75% стала постійною ціною 2026-05-22. Офіційний реліз у середині липня 2026 запроваджує пікові/позапікові ціни, з подвоєнням оголошених ставок у пікові години Пекіна.

Провайдер

DeepSeek

Контекстне вікно

1M tokens (384K max output)

Ціна за вхід

$0.435/1M in (cache hit $0.003625)

Ціна за вихід

$0.87/1M out

Модальності

text only

Open weights

Так

Що таке DeepSeek-V4?

Флагманська open weights родина MoE від DeepSeek (V4-Pro 1.6T параметрів/49B активних, V4-Flash 284B/13B), випущена як прев'ю 24 квітня 2026 року. Приносить контекстне вікно на 1M токенів завдяки розрідженій увазі, режими з мисленням і без та ваги під ліцензією MIT на Hugging Face. Позиціюється як open source SOTA в бенчмарках агентного кодування за частку цін флагманських API.

DeepSeek-V4: плюси й мінуси

Плюси

  • Контекстне вікно 1M токенів (8x проти 128K у V3.2) із виходом до 384K токенів, стандартно в офіційному API
  • Агресивні ціни: $0.435/$0.87 за 1M токенів (V4-Pro), приблизно в 28.7 раза дешевше за вихідний токен, ніж Claude Opus 4.8; вхід із кеш-хітом падає до $0.003625/1M (знижка понад 99%)
  • Open weights під MIT для V4-Pro і V4-Flash на Hugging Face: дозволені комерційне використання, fine-tuning і поширення
  • Open source SOTA в агентному кодуванні: 80.6 на SWE-bench Verified (конфігурація Think Max), нарівні з Gemini 3.1 Pro, плюс рейтинг Codeforces 3206 (~23-тє місце проти людей)
  • Місце #3 із 93 в Artificial Analysis Intelligence Index (бал 44), значно вище за середні 25
  • Стек розрідженої уваги зрізає інференс на контексті 1M до 27% FLOPs V3.2 і 10% її KV-кешу

Мінуси

  • Періодично зіпсовані виклики інструментів: виклики функцій часом виводяться простим текстом у content замість поля tool_calls (issue deepseek-ai #1244 на GitHub)
  • Режим мислення ламає довгі багатоходові ланцюжки викликів інструментів помилками 400 в агентних фреймворках (issue OpenClaw #72044, виправлення досі неповне)
  • Розробники повідомляють, що вона вигадує неіснуючі API в кастомних кодових базах і діє на основі галюцинованого користувацького вводу в агентних циклах
  • Дуже багатослівна (180M вихідних токенів в оцінках проти медіани 95M) і середня за швидкістю з 54.6 ток/с (#39/93), що на практиці з'їдає низьку ціну за токен
  • Лише текст (без зору чи аудіо) і поки що прев'ю: офіційний реліз, запланований на середину липня 2026, додає пікові ціни, які подвоюють оголошені ставки API в робочі години Пекіна

Вердикт арени

Обирайте DeepSeek-V4, якщо хочете майже флагманське міркування й агентне кодування за ціною від 3x до майже 30x нижчою за Claude Opus чи GPT-5.5, або якщо для вас важливі ваги під MIT для самостійного хостингу й fine-tuning. Це рішуче оновлення після V3.2: у 8 разів довший контекст, значно дешевший інференс на довгому контексті й сильніше кодування, а застарілі ендпоінти deepseek-chat/reasoner і так вимикаються 24 липня 2026. Уникайте її для продакшн-агентів, що залежать від бездоганного багатоходового виклику інструментів, де користувачі досі повідомляють про зіпсовані виклики й вигадані API, а також для будь-якої роботи із зором чи аудіо, адже вона працює лише з текстом. Чутливим до затримки застосункам також варто спершу протестувати, бо її багатослівність і середня вихідна швидкість 54.6 ток/с з'їдають частину цінової переваги, і закладіть бюджет на подвоєння цін у пікові години, що прийде з офіційним релізом у середині липня.

Палець угору чи палець униз

Винесіть свій вердикт

Ви б порекомендували DeepSeek-V4 чи застерегли натовп?

57%оцінка натовпу · 3

Найкращі альтернативи DeepSeek-V4

Усі альтернативи
1
Claude Haiku 4.5

Найшвидша модель Anthropic: близько 90% навичок кодування Sonnet 4.5 за $1/$5 за 1M токенів, контекст 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Флагман Anthropic класу Mythos від червня 2026: 80.3% на SWE-bench Pro, на 11 пунктів попереду кожної іншої флагманської моделі

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Opus від Anthropic, квітень 2026: 87.6% SWE-bench Verified, контекст 1M, зір високої роздільності, нині позаду Opus 4.8

$25/1M out57%(3)
Visit

Порівняйте DeepSeek-V4 віч-на-віч

Що каже натовп

Палець Донизус

Tool calling is flaky. Function calls sometimes land as plain text instead of the tool_calls field, and thinking mode 400s on long multi-turn chains. Not agent-ready yet.

Справедливий Суддя

MIT license on both Pro and Flash weights is the real story. Fine-tune, redistribute, ship commercially, no lawyer needed. Plus 384K output tokens for long-doc generation.

Сер Релізус Щодня

MIT weights, 1M context, and output tokens roughly 29x cheaper than Opus 4.8. Cache hits make input basically free. Moved my bulk pipelines over and the bill collapsed.

DeepSeek-V4: поширені запитання

Скільки коштує DeepSeek-V4 за 1M токенів?

DeepSeek-V4 коштує $0.435/1M in (cache hit $0.003625) за 1M вхідних токенів і $0.87/1M out за 1M вихідних токенів. Тариф V4-Pro: $0.435/1M за вхід ($0.003625 при кеш-хіті), $0.87/1M за вихід; дешевший тариф V4-Flash за $0.14/$0.28 ($0.0028 при кеш-хіті); стартова знижка 75% стала постійною ціною 2026-05-22. Офіційний реліз у середині липня 2026 запроваджує пікові/позапікові ціни, з подвоєнням оголошених ставок у пікові години Пекіна.