Віч-на-віч

Логотип Gemini 3.5 FlashvsЛоготип Claude Sonnet 5

Gemini 3.5 Flash vs Claude Sonnet 5: який ШІ-модель перемагає у 2026 році?

Gemini 3.5 Flash ($9.00/1M out) і Claude Sonnet 5 ($15/1M out ($10 intro until 2026-08-31)) належать до найуживаніших ШІ-моделі у 2026 році. За результатами 3 голосів спільноти лідирує Claude Sonnet 5 зі схваленням 57%.

Швидкий вердикт

За критерієм «Міркування» обирайте Claude Sonnet 5: арена оцінює його на 4.5/5 проти 3.5/5 у Gemini 3.5 Flash. За бюджетом виграє Gemini 3.5 Flash: він коштує від $9.00/1M out проти $15/1M out ($10 intro until 2026-08-31) у Claude Sonnet 5.

Порівняння рядок за рядком

Від
$9.00/1M outПлатний тариф із фіксованою ставкою $1.50/$9.00 за 1M; Batch API зі знижкою 50% ($0.75/$4.50), кешування контексту $0.15/1M плюс $1.00/1M за годину зберігання, доступний безкоштовний план
$15/1M out ($10 intro until 2026-08-31)Єдиний тариф: $3/$15 за 1M токенів стандартно, стартова ціна $2/$10 до 31 серпня 2026; Batch API -50%; новий токенізатор дає приблизно на 30% більше токенів на текст (1.0-1.35x за Anthropic), підвищуючи фактичну вартість.
Провайдер
Google
Anthropic
Контекстне вікно
1M tokens (1,048,576 in / 65,536 out)
1M tokens (128K max output)
Ціна за вхід
$1.50/1M in
$3/1M in ($2 intro until 2026-08-31)
Ціна за вихід
$9.00/1M out
$15/1M out ($10 intro until 2026-08-31)
Модальності
text, vision, audio, video, PDF in; text out
text, vision (image input, text output)
Open weights
Ні
Ні
Оцінка натовпу
50%(0)
57%(3)
Оцінки арени (1-5)
Міркування
3.5
4.5
Код
4.0
4.5
Тексти
3.0
4.5
Швидкість
5.0
4.0
Ціна-якість
4.5
4.5

Сильні та слабкі сторони

Gemini 3.5 Flash

  • Обходить Gemini 3.1 Pro в агентних бенчмарках: 76.2% Terminal-Bench 2.1, 1656 Elo GDPval-AA (проти 1314 у 3.1 Pro), 83.6% MCP Atlas
  • Artificial Analysis Intelligence Index 50 на високому рівні мислення, місце #10 зі 170 відстежуваних моделей
  • Дуже швидка генерація (~185 вихідних токенів/с за Artificial Analysis); Google заявляє про вивід у 4 рази швидший за інші флагманські моделі
  • Контекстне вікно 1M токенів (1,048,576) із мультимодальним входом: текст, зображення, аудіо, відео, PDF
  • На 25% дешевший за Gemini 3.1 Pro ($1.50/$9 проти $2/$12), водночас перевершуючи його в продакшн-агентних навантаженнях
  • Регульований рівень мислення (minimal/low/medium/high) плюс знижка 50% на batch і кешування контексту за $0.15/1M
  • Утричі дорожчий за Gemini 3 Flash ($0.50/$3.00) і в 5-6 разів за 2.5 Flash; розробники на HN сприйняли це як промацування Google цінової терпимості
  • Надміру завзятий і багатослівний: розробники повідомляють, що він ігнорує критерії завершення й прикрашає понад інструкції (порівнюють із 'моментом Sonnet 3.7' у Claude)
  • Скарги на надійність обслуговування Flash: розробники повідомляють про часті помилки 503 у пікові періоди
  • Слабший на агентних задачах із довгим горизонтом і довільним набором інструментів, повторювана тема відгуків розробників про моделі Google
  • Довгий час до першого токена (~23с на високому рівні мислення за Artificial Analysis), погано пасує до чутливого до затримки чату

Claude Sonnet 5

  • Великий агентний приріст проти Sonnet 4.6: Terminal-Bench 2.1 80.4% проти 67.0%, OSWorld-Verified 81.2% проти 78.5%, SWE-bench Pro 63.2% проти 58.1%
  • Дорівнює Opus 4.8 в аналітичній роботі (GDPval-AA v2: 1,618 проти 1,615) і майже наздоганяє його на Humanity's Last Exam з інструментами (57.4% проти 57.9%) за 60% ціни Opus 4.8 (40% упродовж стартового вікна)
  • Контекстне вікно 1M токенів і максимум 128K на виході; стартова ціна $2/$10 за 1M токенів до 31 серпня 2026
  • Наполеглива самоперевірна агентна поведінка: практичні огляди відзначають, що він тестує власний код і ітерує над складними задачами до розв'язання, на відміну від Sonnet 4.6
  • Перший Sonnet із рівнем effort xhigh і зором високої роздільності (зображення 2576px); адаптивне мислення типово ввімкнене
  • Вища точність код-рев'ю, ніж у Sonnet 4.6 (38-40% проти 29%), із меншою кількістю хибнопозитивних знахідок
  • Новий токенізатор роздуває кількість токенів приблизно на 30% для того самого тексту (1.0-1.35x за Anthropic; ~1.4x англійська, ~1.28x Python за вимірами Simon Willison), підвищуючи фактичну вартість попри незмінну офіційну ціну
  • Багатослівний і ненажерливий до токенів: ~$2.29 за задачу проти ~$1.20 у Sonnet 4.6 у незалежних тестах (101-ше місце зі 161 за ефективністю витрат); на високому effort вартість задачі може перевищити Opus 4.8
  • Помітно повільніший за Sonnet 4.6 на дрібних рутинних правках і схильний до переускладнення простих задач (практичний огляд CodeRabbit)
  • Параметри семплінгу (temperature, top_p, top_k) прибрано; нетипові значення повертають помилку 400, ламаючи наявні конвеєри
  • Настрої на HN/Reddit після запуску були змішані: позначку '5' сприйняли як завищену обіцянку, а жорсткіші захисні механізми кібербезпеки можуть відмовляти в безневинній роботі, дотичній до безпеки

Винесіть свій вердикт

Одна рекомендація на інструмент від кожного гладіатора. Вона змінює оцінку натовпу, яку бачать усі.

Gemini 3.5 Flash$9.00/1M out
50%оцінка натовпу · 0
Claude Sonnet 5$15/1M out ($10 intro until 2026-08-31)
57%оцінка натовпу · 3

Вердикт арени щодо Gemini 3.5 Flash

Беріть Gemini 3.5 Flash, якщо запускаєте агентне кодування чи масові мультимодальні конвеєри і хочете майже Pro-якість на 4x швидкості: він реально обходить Gemini 3.1 Pro на Terminal-Bench і GDPval, коштуючи на 25% менше. Уникайте його, якщо лінійка Flash була для вас бюджетним рівнем, адже він утричі дорожчий за попередника Gemini 3 Flash, який лишається дешевим варіантом за $0.50/$3.00. Також пропустіть його для чутливого до затримки чату на високому рівні мислення (~23с до першого токена) чи строгого виводу без прикрас, де його багатослівність грає проти вас.

Вердикт арени щодо Claude Sonnet 5

Обирайте Sonnet 5, якщо запускаєте агентів для кодування, термінала чи комп'ютера й хочете майже якість Opus 4.8 за цінами Sonnet, особливо впродовж стартового вікна $2/$10; це беззастережне оновлення після Sonnet 4.6 на низькому й середньому effort. Закладіть бюджет на новий токенізатор і його багатослівність: реальні витрати на задачу помітно вищі, ніж у Sonnet 4.6, а на найвищих рівнях effort Opus 4.8 може виявитися вигіднішим у перерахунку на розв'язану задачу. Уникайте його для чутливих до затримки дрібних правок або конвеєрів, що покладаються на temperature і top_p, які тепер видають помилку. Sonnet 4.6 лишається прагматичним вибором для масових навантажень із крихітними diff.

Що каже натовп

Про Gemini 3.5 Flash

Вердиктів поки немає. Станьте першим, хто висловиться.

Про Claude Sonnet 5

Капітан Відтік

Cheap per token, pricey per task. Independent tests had it near $2.29 a task vs $1.20 on 4.6, and at high effort it can out-cost Opus 4.8. It will not stop talking.

Золотий Пальцикус

Terminal-Bench going 67 to 80 over Sonnet 4.6 matches what I see. My CI-fix agent went from constant babysitting to mostly hands-off overnight.

Святий Деплоюс

Matches Opus 4.8 on knowledge work at 60% of the price, and the intro $2/$10 window makes it silly value. My research agent runs on Sonnet 5 now, zero regrets.

Поширені запитання

Чи кращий Gemini 3.5 Flash за Claude Sonnet 5?

Натовп зараз на боці Claude Sonnet 5: його рекомендують 57%, проти 50% у Gemini 3.5 Flash (3 голоси). За критерієм «Міркування» вища оцінка у Claude Sonnet 5 (4.5/5 проти 3.5/5). Правильний вибір залежить від вашого завдання. Порівняння рядок за рядком на цій сторінці розбирає ціни, ключові характеристики та оцінки арени.

Що дешевше: Gemini 3.5 Flash чи Claude Sonnet 5?

Gemini 3.5 Flash дешевший: він коштує від $9.00/1M out, тоді як Claude Sonnet 5 стартує з $15/1M out ($10 intro until 2026-08-31).

Скільки коштують Gemini 3.5 Flash і Claude Sonnet 5 за 1M токенів?

Gemini 3.5 Flash: $1.50/1M in за 1M вхідних токенів, $9.00/1M out за 1M вихідних токенів. Claude Sonnet 5: $3/1M in ($2 intro until 2026-08-31) за 1M вхідних токенів, $15/1M out ($10 intro until 2026-08-31) за 1M вихідних токенів.