Віч-на-віч

Логотип Gemini 3 ProvsЛоготип Claude Opus 4.8

Gemini 3 Pro vs Claude Opus 4.8: який ШІ-модель перемагає у 2026 році?

Gemini 3 Pro ($12/1M out (prompts ≤200K)) і Claude Opus 4.8 ($25/1M out) належать до найуживаніших ШІ-моделі у 2026 році. За результатами 6 голосів спільноти лідирує Gemini 3 Pro зі схваленням 57%.

Швидкий вердикт

За критерієм «Міркування» Gemini 3 Pro і Claude Opus 4.8 мають нічию: 4.5/5. За бюджетом виграє Gemini 3 Pro: він коштує від $12/1M out (prompts ≤200K) проти $25/1M out у Claude Opus 4.8.

Порівняння рядок за рядком

Від
$12/1M out (prompts ≤200K)Стандартний тариф: $2/$12 за 1M токенів для промтів ≤200K, $4/$18 понад 200K; batch зі знижкою 50%. Виведена з експлуатації 9 березня 2026, наступник Gemini 3.1 Pro зберігає ідентичні ціни.
$25/1M outСтандартний тариф $5/$25 за 1M токенів (без змін проти Opus 4.7); швидкий режим у дослідницькому прев'ю за $10/$50 (проти $30/$150 у застарілого швидкого тарифу Opus 4.7); Batch API зі знижкою 50% за $2.50/$12.50; без надбавки за довгий контекст аж до 1M токенів; читання з кешу промтів за $0.50/1M.
Провайдер
Google (DeepMind)
Anthropic
Контекстне вікно
1M tokens (64K output)
1M tokens (128K max output)
Ціна за вхід
$2/1M in (prompts ≤200K)
$5/1M in
Ціна за вихід
$12/1M out (prompts ≤200K)
$25/1M out
Модальності
text, image, audio, video in; text out
text, vision (image input up to 2576px, text output)
Open weights
Ні
Ні
Оцінка натовпу
57%(3)
57%(3)
Оцінки арени (1-5)
Міркування
4.5
4.5
Код
4.5
5.0
Тексти
3.5
5.0
Швидкість
3.5
3.0
Ціна-якість
4.0
3.5

Сильні та слабкі сторони

Gemini 3 Pro

  • Очолила LMArena на старті з рекордними 1501 Elo і набрала 91.9% на GPQA Diamond, найкращий результат на момент релізу
  • ARC-AGI-2 на рівні 31.1%, приблизно в 6 разів більше за Gemini 2.5 Pro (4.9%) і майже вдвічі за тодішній GPT-5.1 (17.6%)
  • Найкраще у класі мультимодальне розуміння: 81% MMMU-Pro, 87.6% Video-MMMU, із контекстним вікном на 1M токенів
  • Сильне агентне кодування: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, 1487 Elo на WebDev Arena
  • Підрізала конкурентів ціною $2/$12 за 1M токенів, нижче цін класу Claude Sonnet ($3/$15)
  • Налаштовуваний thinking_level (low/medium/high) дає розробникам балансувати глибину міркувань, затримку й вартість
  • Самовпевнені галюцинації: на AA-Omniscience давала хибну відповідь у 88% випадків замість відмови, проти 48% у Claude Sonnet 4.5 (the-decoder)
  • Оглядачі масово скаржилися на підлабузництво (Zvi Mowshowitz: 'величезний інтелект без хребта'); потребує жорстких системних промтів
  • Проблеми з надійністю виклику інструментів в агентних стеках: розробники повідомляли, що виводи інструментів вивалюються в тред чату, і потрібно більше обв'язки, ніж у моделей OpenAI/Anthropic
  • Повільна на високому рівні мислення: час до першого токена вимірювали близько 30-60с на AI Studio попри вихідну швидкість ~130 ток/с
  • Виведена з експлуатації: вимкнена в Gemini API та AI Studio 9 березня 2026, а gemini-3-pro-preview тепер вказує на Gemini 3.1 Pro

Claude Opus 4.8

  • SWE-Bench Pro 69.2% (проти 64.3% в Opus 4.7) і перевершує попередні моделі Opus на CursorBench на кожному рівні effort; сильні практичні відгуки про великі рефакторинги й пошук багів у багатьох файлах
  • Приблизно в 4 рази рідше за Opus 4.7 пропускає без позначки вади у власноруч згенерованому коді; великий стрибок у математичних міркуваннях (USAMO 2026: 96.7% проти 69.3%)
  • Контекст 1M токенів і 128K на виході за незмінною ціною $5/$25, без надбавки за довгий контекст; Batch API зі знижкою 50% ($2.50/$12.50)
  • Швидкий режим (дослідницьке прев'ю) дає до 2.5x швидкості виводу за $10/$50, утричі дешевше за швидкий тариф Opus 4.7 ($30/$150)
  • Унікальні можливості API для агентів: системні повідомлення посеред розмови зі збереженням кешу промтів і Dynamic Workflows із паралельними субагентами в Claude Code
  • 84% на Online-Mind2Web з автоматизації браузера й рекордний результат на Legal Agent Benchmark (перша модель понад 10% all-pass); сильна корпоративна аналітика (Box повідомляє 87% проти 77% у внутрішніх тестах)
  • Повідомляють про регресії від ходу до ходу: пропускає очевидні інструкції в планувальних документах, відповідає лише на вузьку частину цілі й гірше за 4.7 генерує простий UI з першої спроби
  • Стиль письма критикують активні користувачі: надмірні застереження, надобережне редагування, що 'вирізає все сміливе чи смішне' (Steve Yegge), і петлі заперечень навіть проти добре обґрунтованих тез
  • Дивність зі змішуванням мов: користувачі повідомляють про випадкові вставки китайською, кирилицею чи грецькою в довгих дослідницьких тредах
  • Помітна деградація якості після ~200K токенів на практиці, попри заявлене вікно 1M
  • Регресія на Vending-Bench: попадався на шахрайських постачальників приблизно в 30 разів частіше за 4.7 і гірше веде переговори (побічний ефект жорсткішого налаштування на чесність)

Винесіть свій вердикт

Одна рекомендація на інструмент від кожного гладіатора. Вона змінює оцінку натовпу, яку бачать усі.

Gemini 3 Pro$12/1M out (prompts ≤200K)
57%оцінка натовпу · 3
Claude Opus 4.8$25/1M out
57%оцінка натовпу · 3

Вердикт арени щодо Gemini 3 Pro

Знаковий реліз, що наприкінці 2025 повернув Google на вершину, з величезним стрибком у міркуваннях проти Gemini 2.5 Pro і найкращими мультимодальними результатами свого покоління. Станом на середину 2026 обирати її немає сенсу: Google вимкнув її в API 9 березня 2026, а Gemini 3.1 Pro коштує точнісінько стільки ж, більш ніж подвоюючи результат на ARC-AGI-2 (77.1% проти 31.1%). Командам на застарілих розгортаннях варто мігрувати на 3.1 Pro, на який старий ідентифікатор моделі тепер і так вказує. Уникайте її для чутливих до галюцинацій навантажень без додаткового заземлення: цю слабкість оглядачі відзначали неодноразово.

Вердикт арени щодо Claude Opus 4.8

Оновлення без зайвих рухів для користувачів Opus 4.7: ідентичний API і ціна $5/$25 із реальним приростом в агентному кодуванні з довгим горизонтом, код-рев'ю та корпоративному аналізі. Беріть його, якщо працюєте з Claude Code, багатофайловими міграціями, аудитами безпеки чи агентними конвеєрами, які перевіряють, діють і верифікують упродовж багатьох кроків. Пропустіть його для швидких одноразових UI-фрагментів чи промтів, щільно підігнаних під поведінку 4.7, де користувачі повідомляють про регресії, а якщо витрати важливіші за граничні можливості, беріть Sonnet 5 ($3/$15, стартова ціна $2/$10 до серпня 2026). Авторам, чутливим до застережень і надобережного редагування, його стиль може дратувати.

Що каже натовп

Про Gemini 3 Pro

Суддя Грізний

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Чемпіон Вайбів

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Глоріус Максимус

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Про Claude Opus 4.8

Суддя Грізний

Writing took a hit. It hedges everything and edits any bold or funny line out of my drafts. Also caught it answering a narrow slice of my planning doc and calling it done.

Чемпіон Вайбів

Threw USAMO-level math at it for a lark and it just grinds through. 96.7 vs 69 for 4.7 tracks with what I see. Same $5/$25, 1M context, no excuse not to switch.

Глоріус Максимус

Upgraded from 4.7 for a monorepo refactor and the difference is real. It actually flags its own sketchy code instead of shipping it. Multi-file bug hunts feel way less babysat.

Поширені запитання

Чи кращий Gemini 3 Pro за Claude Opus 4.8?

Правильний вибір залежить від вашого завдання. Порівняння рядок за рядком на цій сторінці розбирає ціни, ключові характеристики та оцінки арени.

Що дешевше: Gemini 3 Pro чи Claude Opus 4.8?

Gemini 3 Pro дешевший: він коштує від $12/1M out (prompts ≤200K), тоді як Claude Opus 4.8 стартує з $25/1M out.

Скільки коштують Gemini 3 Pro і Claude Opus 4.8 за 1M токенів?

Gemini 3 Pro: $2/1M in (prompts ≤200K) за 1M вхідних токенів, $12/1M out (prompts ≤200K) за 1M вихідних токенів. Claude Opus 4.8: $5/1M in за 1M вхідних токенів, $25/1M out за 1M вихідних токенів.