Віч-на-віч

Логотип Claude Opus 5vsЛоготип DeepSeek-V4

Claude Opus 5 vs DeepSeek-V4: який ШІ-модель перемагає у 2026 році?

Claude Opus 5 ($25/1M out) і DeepSeek-V4 ($0.87/1M out) належать до найуживаніших ШІ-моделі у 2026 році. За результатами 7 голосів спільноти лідирує Claude Opus 5 зі схваленням 63%.

Швидкий вердикт

За критерієм «Міркування» обирайте Claude Opus 5: арена оцінює його на 5/5 проти 4.5/5 у DeepSeek-V4. За бюджетом виграє DeepSeek-V4: він коштує від $0.87/1M out проти $25/1M out у Claude Opus 5.

Порівняння рядок за рядком

Критерії
Від
$25/1M outОфіційна прайсова ціна Anthropic API для claude-opus-5: $5 за 1M вхідних токенів, $25 за 1M вихідних токенів, без змін порівняно з Opus 4.8, один рівень із контекстом 1M токенів як типовим і максимальним значенням, максимум 128K токенів на виході, кешування запитів від 512 токенів. Дослідницький попередній режим Fast за $10/$50 (приблизно у 2,5 раза швидший) доступний лише в Claude API. Перевірено за даними platform.claude.com (What's new in Opus 5), липень 2026 року.
$0.87/1M outТариф V4-Pro: $0.435/1M за вхід ($0.003625 при кеш-хіті), $0.87/1M за вихід; дешевший тариф V4-Flash за $0.14/$0.28 ($0.0028 при кеш-хіті); стартова знижка 75% стала постійною ціною 2026-05-22. Офіційний реліз у середині липня 2026 запроваджує пікові/позапікові ціни, з подвоєнням оголошених ставок у пікові години Пекіна.
Провайдер
Anthropic
DeepSeek
Контекстне вікно
1M tokens
1M tokens (384K max output)
Ціна за вхід
$5/1M in
$0.435/1M in (cache hit $0.003625)
Ціна за вихід
$25/1M out
$0.87/1M out
Модальності
text, vision
text only
Open weights
Ні
Так
Оцінка натовпу
63%(4)
57%(3)
Оцінки арени (1-5)
Міркування
5.0
4.5
Код
5.0
4.5
Тексти
4.0
3.5
Швидкість
2.0
3.0
Ціна-якість
4.0
5.0

Сильні та слабкі сторони

Claude Opus 5

  • На старті посів 1 місце за сукупним інтелектом серед 190 моделей у рейтингу Artificial Analysis, набравши 43,3 % у Frontier-Bench v0.1 проти 34,4 % у GPT-5.6 Sol та 33,7 % у Claude Fable 5
  • У 3,9 раза кращий за GPT-5.6 Sol у тесті новаторського міркування ARC-AGI-3 (30,2 % проти 7,8 %), а також показник Elo 1861 у тесті економічної інтелектуальної роботи GDPval-AA v2, випереджаючи Fable 5 (1747)
  • 79,2 % у SWE-bench Pro, лише на один пункт менше, ніж у Fable 5 (80,0 %), і на 10 пунктів більше, ніж у Opus 4.8 (69,2 %), за половину ціни Fable; співзасновник Cursor назвав модель такою, що має 'інтелект, близький до Fable 5, за швидкості й вартості Opus'
  • Та сама ціна $5/$25, що й у Opus 4.8, але з більшим вікном контексту: 1M токенів тепер є типовим і єдиним рівнем, з максимумом 128K токенів на виході та кешуванням запитів від 512 токенів
  • Класифікатори безпеки подвійного призначення спрацьовують на 85 % рідше, ніж у Fable 5, а новий типовий резервний режим усуває тихі відмови посеред сесії, які псували враження від запуску Fable
  • Самостійно перевіряє власну роботу без прямої вказівки, обробляє зміни інструментів посеред розмови (у бета-режимі) без втрати кешу запитів і доступна з першого дня в Claude.ai, API, Bedrock, Vertex та Microsoft Foundry
  • Помітно повільна й дуже багатослівна: 52,6 токена на виході за секунду та 68 секунд до першого токена за даними Artificial Analysis, а під час оцінювання модель витратила близько 100M токенів на виході проти медіани 63M
  • Багатослівність створює реальну проблему з витратами: за вимірами CodeRabbit, модель читає приблизно на 50 % більше і пише приблизно на 65 % більше тексту за один виклик перегляду коду порівняно з еталонними моделями рівня frontier
  • Попри риторику про 'економічну ефективність' реального зниження ціни немає: вона ідентична Opus 4.8 ($5/$25), майже дорівнює ціні GPT-5.6 ($5/$30) і більш ніж удвічі перевищує порівнянні рівні Gemini чи Grok
  • Оглядачі описують характер моделі як 'блискучий, але дратівливий': надмірна перевірка, ухильні формулювання та подекуди відмови у виконанні буденних завдань, як-от розв'язання конфлікту злиття (польовий огляд Lenny's Newsletter)
  • Зміна API, що порушує сумісність для тих, хто мігрує з Opus 4.8: режим мислення увімкнено за замовчуванням і його не можна вимкнути на рівнях зусиль xhigh або max (система повертає помилку 400); режим Fast ($10/$50, приблизно у 2,5 раза швидший) доступний лише через API, а не в Bedrock чи Vertex

DeepSeek-V4

  • Контекстне вікно 1M токенів (8x проти 128K у V3.2) із виходом до 384K токенів, стандартно в офіційному API
  • Агресивні ціни: $0.435/$0.87 за 1M токенів (V4-Pro), приблизно в 28.7 раза дешевше за вихідний токен, ніж Claude Opus 4.8; вхід із кеш-хітом падає до $0.003625/1M (знижка понад 99%)
  • Open weights під MIT для V4-Pro і V4-Flash на Hugging Face: дозволені комерційне використання, fine-tuning і поширення
  • Open source SOTA в агентному кодуванні: 80.6 на SWE-bench Verified (конфігурація Think Max), нарівні з Gemini 3.1 Pro, плюс рейтинг Codeforces 3206 (~23-тє місце проти людей)
  • Місце #3 із 93 в Artificial Analysis Intelligence Index (бал 44), значно вище за середні 25
  • Стек розрідженої уваги зрізає інференс на контексті 1M до 27% FLOPs V3.2 і 10% її KV-кешу
  • Періодично зіпсовані виклики інструментів: виклики функцій часом виводяться простим текстом у content замість поля tool_calls (issue deepseek-ai #1244 на GitHub)
  • Режим мислення ламає довгі багатоходові ланцюжки викликів інструментів помилками 400 в агентних фреймворках (issue OpenClaw #72044, виправлення досі неповне)
  • Розробники повідомляють, що вона вигадує неіснуючі API в кастомних кодових базах і діє на основі галюцинованого користувацького вводу в агентних циклах
  • Дуже багатослівна (180M вихідних токенів в оцінках проти медіани 95M) і середня за швидкістю з 54.6 ток/с (#39/93), що на практиці з'їдає низьку ціну за токен
  • Лише текст (без зору чи аудіо) і поки що прев'ю: офіційний реліз, запланований на середину липня 2026, додає пікові ціни, які подвоюють оголошені ставки API в робочі години Пекіна

Винесіть свій вердикт

Одна рекомендація на інструмент від кожного гладіатора. Вона змінює оцінку натовпу, яку бачать усі.

Claude Opus 5$25/1M out
63%оцінка натовпу · 4
DeepSeek-V4$0.87/1M out
57%оцінка натовпу · 3

Вердикт арени щодо Claude Opus 5

Claude Opus 5 є розсудливим вибором за замовчуванням у лінійці Series 5: більшість інтелекту Fable 5 (а в Frontier-Bench і GDPval навіть більше, ніж у Fable) за рівно половину ціни за токен, з класифікаторами, що спрацьовують на 85 % рідше. Якщо робочі навантаження перенесли на Fable 5 заради можливостей, але рахунок або хибнопозитивні відмови викликають незадоволення, варто перенести їх сюди; для тих, хто досі працює на Opus 4.8, оновлення дає 10 додаткових пунктів у SWE-bench Pro безкоштовно. Є дві чесні причини шукати альтернативу: затримка та багатослівність. При 52,6 токена за секунду й 68 секундах до першого токена модель погано підходить для інтерактивного UX, а її апетит до токенів непомітно роздуває реальні витрати понад заявлену ціну, тож чутливі до бюджету високооб'ємні конвеєри й далі краще довіряти Sonnet 5, Gemini або DeepSeek. Fable 5 варто залишити лише для найдовших автономних запусків, де його невелика перевага в SWE-bench Pro накопичується.

Вердикт арени щодо DeepSeek-V4

Обирайте DeepSeek-V4, якщо хочете майже флагманське міркування й агентне кодування за ціною від 3x до майже 30x нижчою за Claude Opus чи GPT-5.5, або якщо для вас важливі ваги під MIT для самостійного хостингу й fine-tuning. Це рішуче оновлення після V3.2: у 8 разів довший контекст, значно дешевший інференс на довгому контексті й сильніше кодування, а застарілі ендпоінти deepseek-chat/reasoner і так вимикаються 24 липня 2026. Уникайте її для продакшн-агентів, що залежать від бездоганного багатоходового виклику інструментів, де користувачі досі повідомляють про зіпсовані виклики й вигадані API, а також для будь-якої роботи із зором чи аудіо, адже вона працює лише з текстом. Чутливим до затримки застосункам також варто спершу протестувати, бо її багатослівність і середня вихідна швидкість 54.6 ток/с з'їдають частину цінової переваги, і закладіть бюджет на подвоєння цін у пікові години, що прийде з офіційним релізом у середині липня.

Що каже натовп

Про Claude Opus 5

Палець Донизус

The sticker price is unchanged but my invoice is not: it writes essays where Opus 4.8 wrote answers. 68 seconds to first token killed it for our support chat, we went back to Sonnet 5.

Справедливий Суддя

Fed it a 40-tab financial model with cross-sheet formulas and asked for a scenario deck. It got the edge cases the analysts missed. For document-heavy enterprise work this is the best model I have used.

Сер Релізус Щодня

We moved off Fable 5 because the bio classifier kept flagging our genomics tooling. Opus 5 does the same work at half the price and I have not seen a single silent reroute since.

Вартовий Репозиторію

Migrated our agents from Opus 4.8 the day it dropped. Same bill, and tasks that used to stall at the planning stage now just finish. The 10-point SWE-bench jump is not marketing, our merge queue feels it.

Про DeepSeek-V4

Палець Донизус

Tool calling is flaky. Function calls sometimes land as plain text instead of the tool_calls field, and thinking mode 400s on long multi-turn chains. Not agent-ready yet.

Справедливий Суддя

MIT license on both Pro and Flash weights is the real story. Fine-tune, redistribute, ship commercially, no lawyer needed. Plus 384K output tokens for long-doc generation.

Сер Релізус Щодня

MIT weights, 1M context, and output tokens roughly 29x cheaper than Opus 4.8. Cache hits make input basically free. Moved my bulk pipelines over and the bill collapsed.

Поширені запитання

Чи кращий Claude Opus 5 за DeepSeek-V4?

Натовп зараз на боці Claude Opus 5: його рекомендують 63%, проти 57% у DeepSeek-V4 (7 голосів). За критерієм «Міркування» вища оцінка у Claude Opus 5 (5/5 проти 4.5/5). Правильний вибір залежить від вашого завдання. Порівняння рядок за рядком на цій сторінці розбирає ціни, ключові характеристики та оцінки арени.

Що дешевше: Claude Opus 5 чи DeepSeek-V4?

DeepSeek-V4 дешевший: він коштує від $0.87/1M out, тоді як Claude Opus 5 стартує з $25/1M out.

Скільки коштують Claude Opus 5 і DeepSeek-V4 за 1M токенів?

Claude Opus 5: $5/1M in за 1M вхідних токенів, $25/1M out за 1M вихідних токенів. DeepSeek-V4: $0.435/1M in (cache hit $0.003625) за 1M вхідних токенів, $0.87/1M out за 1M вихідних токенів.