Віч-на-віч

Логотип Claude Opus 4.6vsЛоготип Gemini 3 Pro

Claude Opus 4.6 vs Gemini 3 Pro: який ШІ-модель перемагає у 2026 році?

Claude Opus 4.6 ($25/1M out) і Gemini 3 Pro ($12/1M out (prompts ≤200K)) належать до найуживаніших ШІ-моделі у 2026 році. За результатами 3 голосів спільноти лідирує Gemini 3 Pro зі схваленням 57%.

Швидкий вердикт

За критерієм «Міркування» обирайте Gemini 3 Pro: арена оцінює його на 4.5/5 проти 4/5 у Claude Opus 4.6. За бюджетом виграє Gemini 3 Pro: він коштує від $12/1M out (prompts ≤200K) проти $25/1M out у Claude Opus 4.6.

Порівняння рядок за рядком

Від
$25/1M outСтандартний тариф $5/$25 за 1M токенів; повний контекст 1M тепер за стандартними ставками (стартову надбавку $10/$37.50 понад 200K токенів згодом скасували), Batch API зі знижкою 50% ($2.50/$12.50), інференс лише в США (inference_geo) з множником 1.1x.
$12/1M out (prompts ≤200K)Стандартний тариф: $2/$12 за 1M токенів для промтів ≤200K, $4/$18 понад 200K; batch зі знижкою 50%. Виведена з експлуатації 9 березня 2026, наступник Gemini 3.1 Pro зберігає ідентичні ціни.
Провайдер
Anthropic
Google (DeepMind)
Контекстне вікно
1M tokens (128K max output)
1M tokens (64K output)
Ціна за вхід
$5/1M in
$2/1M in (prompts ≤200K)
Ціна за вихід
$25/1M out
$12/1M out (prompts ≤200K)
Модальності
text, vision (image input), text output
text, image, audio, video in; text out
Open weights
Ні
Ні
Оцінка натовпу
50%(0)
57%(3)
Оцінки арени (1-5)
Міркування
4.0
4.5
Код
4.0
4.5
Тексти
4.0
3.5
Швидкість
2.5
3.5
Ціна-якість
3.0
4.0

Сильні та слабкі сторони

Claude Opus 4.6

  • 80.8% SWE-bench Verified (середнє за 25 спроб) і найвищий результат Terminal-Bench 2.0 на старті, провідна модель агентного кодування свого покоління (лютий 2026)
  • Перший Opus із контекстним вікном на 1M токенів: 76% на MRCR v2 8-needle при 1M токенів проти 18.5% у Sonnet 4.5
  • Великий стрибок у міркуваннях проти Opus 4.5: ARC-AGI-2 68.8% проти 37.6%, +190 Elo на задачах економічної цінності GDPval-AA (~144 Elo понад GPT-5.2)
  • Зберіг ціни Opus 4.5 ($5/$25 за 1M токенів) попри приріст; повний контекст 1M тепер тарифікується за стандартними ставками, знижка 50% на Batch
  • Адаптивне мислення плюс параметр effort (low/medium/high/max) для балансу інтелекту, затримки й вартості на кожен запит
  • Сильна автономна агентна поведінка: розпаралелює роботу і потребує менше нагляду, ніж Opus 4.5 (Every.to Vibe Check)
  • Повільніший і багатослівніший за Opus 4.5; оглядачі пишуть, що темп 'пливе під навантаженням' у довгих агентних сесіях (Every.to)
  • Письмо регресувало: у сліпих тестах команда Every.to віддала перевагу прозі Opus 4.5, а 4.6 частіше видає ШІ-штампи на кшталт конструкцій 'X, а не Y'
  • Іноді вносить неочікувані зміни і 'не завжди знає власні навички', тому, за словами оглядачів, потребує пильнішого нагляду, ніж GPT-5.x Codex
  • За кілька місяців витіснений Opus 4.7 і 4.8 за тією самою ціною $5/$25, а швидкий режим недоступний на 4.6 з червня 2026 (запити виконуються зі стандартною швидкістю)
  • Частина розробників скаржиться на втому від бенчмарків: щоденний приріст у кодуванні проти 4.5 відчути важче, ніж обіцяють цифри, а сам SWE-bench лишився на рівні 4.5 (80.8% проти 80.9%)

Gemini 3 Pro

  • Очолила LMArena на старті з рекордними 1501 Elo і набрала 91.9% на GPQA Diamond, найкращий результат на момент релізу
  • ARC-AGI-2 на рівні 31.1%, приблизно в 6 разів більше за Gemini 2.5 Pro (4.9%) і майже вдвічі за тодішній GPT-5.1 (17.6%)
  • Найкраще у класі мультимодальне розуміння: 81% MMMU-Pro, 87.6% Video-MMMU, із контекстним вікном на 1M токенів
  • Сильне агентне кодування: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, 1487 Elo на WebDev Arena
  • Підрізала конкурентів ціною $2/$12 за 1M токенів, нижче цін класу Claude Sonnet ($3/$15)
  • Налаштовуваний thinking_level (low/medium/high) дає розробникам балансувати глибину міркувань, затримку й вартість
  • Самовпевнені галюцинації: на AA-Omniscience давала хибну відповідь у 88% випадків замість відмови, проти 48% у Claude Sonnet 4.5 (the-decoder)
  • Оглядачі масово скаржилися на підлабузництво (Zvi Mowshowitz: 'величезний інтелект без хребта'); потребує жорстких системних промтів
  • Проблеми з надійністю виклику інструментів в агентних стеках: розробники повідомляли, що виводи інструментів вивалюються в тред чату, і потрібно більше обв'язки, ніж у моделей OpenAI/Anthropic
  • Повільна на високому рівні мислення: час до першого токена вимірювали близько 30-60с на AI Studio попри вихідну швидкість ~130 ток/с
  • Виведена з експлуатації: вимкнена в Gemini API та AI Studio 9 березня 2026, а gemini-3-pro-preview тепер вказує на Gemini 3.1 Pro

Винесіть свій вердикт

Одна рекомендація на інструмент від кожного гладіатора. Вона змінює оцінку натовпу, яку бачать усі.

Claude Opus 4.6$25/1M out
50%оцінка натовпу · 0
Gemini 3 Pro$12/1M out (prompts ≤200K)
57%оцінка натовпу · 3

Вердикт арени щодо Claude Opus 4.6

Очевидне оновлення після Opus 4.5 для агентного кодування й роботи з довгим контекстом за ідентичною ціною, і на старті він тримав перші місця в бенчмарках агентного кодування. Утім, у середині 2026 немає особливих причин починати на ньому нові проєкти: Opus 4.8 коштує ті самі $5/$25 і перевершує його всюди, тож 4.6 варто брати переважно для закріплення вже перевіреної поведінки. Авторам текстів краще його уникати, адже в сліпих тестах перевагу віддали прозі Opus 4.5, а чутливим до затримки користувачам слід врахувати, що він повільніший за 4.5 і без опції швидкого режиму.

Вердикт арени щодо Gemini 3 Pro

Знаковий реліз, що наприкінці 2025 повернув Google на вершину, з величезним стрибком у міркуваннях проти Gemini 2.5 Pro і найкращими мультимодальними результатами свого покоління. Станом на середину 2026 обирати її немає сенсу: Google вимкнув її в API 9 березня 2026, а Gemini 3.1 Pro коштує точнісінько стільки ж, більш ніж подвоюючи результат на ARC-AGI-2 (77.1% проти 31.1%). Командам на застарілих розгортаннях варто мігрувати на 3.1 Pro, на який старий ідентифікатор моделі тепер і так вказує. Уникайте її для чутливих до галюцинацій навантажень без додаткового заземлення: цю слабкість оглядачі відзначали неодноразово.

Що каже натовп

Про Claude Opus 4.6

Вердиктів поки немає. Станьте першим, хто висловиться.

Про Gemini 3 Pro

Суддя Грізний

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Чемпіон Вайбів

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Глоріус Максимус

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Поширені запитання

Чи кращий Claude Opus 4.6 за Gemini 3 Pro?

Натовп зараз на боці Gemini 3 Pro: його рекомендують 57%, проти 50% у Claude Opus 4.6 (3 голоси). За критерієм «Міркування» вища оцінка у Gemini 3 Pro (4.5/5 проти 4/5). Правильний вибір залежить від вашого завдання. Порівняння рядок за рядком на цій сторінці розбирає ціни, ключові характеристики та оцінки арени.

Що дешевше: Claude Opus 4.6 чи Gemini 3 Pro?

Gemini 3 Pro дешевший: він коштує від $12/1M out (prompts ≤200K), тоді як Claude Opus 4.6 стартує з $25/1M out.

Скільки коштують Claude Opus 4.6 і Gemini 3 Pro за 1M токенів?

Claude Opus 4.6: $5/1M in за 1M вхідних токенів, $25/1M out за 1M вихідних токенів. Gemini 3 Pro: $2/1M in (prompts ≤200K) за 1M вхідних токенів, $12/1M out (prompts ≤200K) за 1M вихідних токенів.