Віч-на-віч
Gemini 3 Pro vs Claude Sonnet 5: який ШІ-модель перемагає у 2026 році?
Gemini 3 Pro ($12/1M out (prompts ≤200K)) і Claude Sonnet 5 ($15/1M out ($10 intro until 2026-08-31)) належать до найуживаніших ШІ-моделі у 2026 році. За результатами 6 голосів спільноти лідирує Gemini 3 Pro зі схваленням 57%.
Швидкий вердикт
За критерієм «Міркування» Gemini 3 Pro і Claude Sonnet 5 мають нічию: 4.5/5. За бюджетом виграє Gemini 3 Pro: він коштує від $12/1M out (prompts ≤200K) проти $15/1M out ($10 intro until 2026-08-31) у Claude Sonnet 5.
Порівняння рядок за рядком
Сильні та слабкі сторони
Gemini 3 Pro
- Очолила LMArena на старті з рекордними 1501 Elo і набрала 91.9% на GPQA Diamond, найкращий результат на момент релізу
- ARC-AGI-2 на рівні 31.1%, приблизно в 6 разів більше за Gemini 2.5 Pro (4.9%) і майже вдвічі за тодішній GPT-5.1 (17.6%)
- Найкраще у класі мультимодальне розуміння: 81% MMMU-Pro, 87.6% Video-MMMU, із контекстним вікном на 1M токенів
- Сильне агентне кодування: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, 1487 Elo на WebDev Arena
- Підрізала конкурентів ціною $2/$12 за 1M токенів, нижче цін класу Claude Sonnet ($3/$15)
- Налаштовуваний thinking_level (low/medium/high) дає розробникам балансувати глибину міркувань, затримку й вартість
- Самовпевнені галюцинації: на AA-Omniscience давала хибну відповідь у 88% випадків замість відмови, проти 48% у Claude Sonnet 4.5 (the-decoder)
- Оглядачі масово скаржилися на підлабузництво (Zvi Mowshowitz: 'величезний інтелект без хребта'); потребує жорстких системних промтів
- Проблеми з надійністю виклику інструментів в агентних стеках: розробники повідомляли, що виводи інструментів вивалюються в тред чату, і потрібно більше обв'язки, ніж у моделей OpenAI/Anthropic
- Повільна на високому рівні мислення: час до першого токена вимірювали близько 30-60с на AI Studio попри вихідну швидкість ~130 ток/с
- Виведена з експлуатації: вимкнена в Gemini API та AI Studio 9 березня 2026, а gemini-3-pro-preview тепер вказує на Gemini 3.1 Pro
Claude Sonnet 5
- Великий агентний приріст проти Sonnet 4.6: Terminal-Bench 2.1 80.4% проти 67.0%, OSWorld-Verified 81.2% проти 78.5%, SWE-bench Pro 63.2% проти 58.1%
- Дорівнює Opus 4.8 в аналітичній роботі (GDPval-AA v2: 1,618 проти 1,615) і майже наздоганяє його на Humanity's Last Exam з інструментами (57.4% проти 57.9%) за 60% ціни Opus 4.8 (40% упродовж стартового вікна)
- Контекстне вікно 1M токенів і максимум 128K на виході; стартова ціна $2/$10 за 1M токенів до 31 серпня 2026
- Наполеглива самоперевірна агентна поведінка: практичні огляди відзначають, що він тестує власний код і ітерує над складними задачами до розв'язання, на відміну від Sonnet 4.6
- Перший Sonnet із рівнем effort xhigh і зором високої роздільності (зображення 2576px); адаптивне мислення типово ввімкнене
- Вища точність код-рев'ю, ніж у Sonnet 4.6 (38-40% проти 29%), із меншою кількістю хибнопозитивних знахідок
- Новий токенізатор роздуває кількість токенів приблизно на 30% для того самого тексту (1.0-1.35x за Anthropic; ~1.4x англійська, ~1.28x Python за вимірами Simon Willison), підвищуючи фактичну вартість попри незмінну офіційну ціну
- Багатослівний і ненажерливий до токенів: ~$2.29 за задачу проти ~$1.20 у Sonnet 4.6 у незалежних тестах (101-ше місце зі 161 за ефективністю витрат); на високому effort вартість задачі може перевищити Opus 4.8
- Помітно повільніший за Sonnet 4.6 на дрібних рутинних правках і схильний до переускладнення простих задач (практичний огляд CodeRabbit)
- Параметри семплінгу (temperature, top_p, top_k) прибрано; нетипові значення повертають помилку 400, ламаючи наявні конвеєри
- Настрої на HN/Reddit після запуску були змішані: позначку '5' сприйняли як завищену обіцянку, а жорсткіші захисні механізми кібербезпеки можуть відмовляти в безневинній роботі, дотичній до безпеки
Винесіть свій вердикт
Одна рекомендація на інструмент від кожного гладіатора. Вона змінює оцінку натовпу, яку бачать усі.
Вердикт арени щодо Gemini 3 Pro
Знаковий реліз, що наприкінці 2025 повернув Google на вершину, з величезним стрибком у міркуваннях проти Gemini 2.5 Pro і найкращими мультимодальними результатами свого покоління. Станом на середину 2026 обирати її немає сенсу: Google вимкнув її в API 9 березня 2026, а Gemini 3.1 Pro коштує точнісінько стільки ж, більш ніж подвоюючи результат на ARC-AGI-2 (77.1% проти 31.1%). Командам на застарілих розгортаннях варто мігрувати на 3.1 Pro, на який старий ідентифікатор моделі тепер і так вказує. Уникайте її для чутливих до галюцинацій навантажень без додаткового заземлення: цю слабкість оглядачі відзначали неодноразово.
Вердикт арени щодо Claude Sonnet 5
Обирайте Sonnet 5, якщо запускаєте агентів для кодування, термінала чи комп'ютера й хочете майже якість Opus 4.8 за цінами Sonnet, особливо впродовж стартового вікна $2/$10; це беззастережне оновлення після Sonnet 4.6 на низькому й середньому effort. Закладіть бюджет на новий токенізатор і його багатослівність: реальні витрати на задачу помітно вищі, ніж у Sonnet 4.6, а на найвищих рівнях effort Opus 4.8 може виявитися вигіднішим у перерахунку на розв'язану задачу. Уникайте його для чутливих до затримки дрібних правок або конвеєрів, що покладаються на temperature і top_p, які тепер видають помилку. Sonnet 4.6 лишається прагматичним вибором для масових навантажень із крихітними diff.
Що каже натовп
Про Gemini 3 Pro
“Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.”
“ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.”
“1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.”
Про Claude Sonnet 5
“Cheap per token, pricey per task. Independent tests had it near $2.29 a task vs $1.20 on 4.6, and at high effort it can out-cost Opus 4.8. It will not stop talking.”
“Terminal-Bench going 67 to 80 over Sonnet 4.6 matches what I see. My CI-fix agent went from constant babysitting to mostly hands-off overnight.”
“Matches Opus 4.8 on knowledge work at 60% of the price, and the intro $2/$10 window makes it silly value. My research agent runs on Sonnet 5 now, zero regrets.”
Порівнюйте далі
Поширені запитання
Чи кращий Gemini 3 Pro за Claude Sonnet 5?
Правильний вибір залежить від вашого завдання. Порівняння рядок за рядком на цій сторінці розбирає ціни, ключові характеристики та оцінки арени.
Що дешевше: Gemini 3 Pro чи Claude Sonnet 5?
Gemini 3 Pro дешевший: він коштує від $12/1M out (prompts ≤200K), тоді як Claude Sonnet 5 стартує з $15/1M out ($10 intro until 2026-08-31).
Скільки коштують Gemini 3 Pro і Claude Sonnet 5 за 1M токенів?
Gemini 3 Pro: $2/1M in (prompts ≤200K) за 1M вхідних токенів, $12/1M out (prompts ≤200K) за 1M вихідних токенів. Claude Sonnet 5: $3/1M in ($2 intro until 2026-08-31) за 1M вхідних токенів, $15/1M out ($10 intro until 2026-08-31) за 1M вихідних токенів.