Віч-на-віч
Grok 4.3 vs Claude Fable 5: який ШІ-модель перемагає у 2026 році?
Grok 4.3 ($2.50/1M out) і Claude Fable 5 ($50/1M out) належать до найуживаніших ШІ-моделі у 2026 році. За результатами 4 голосів спільноти лідирує Claude Fable 5 зі схваленням 63%.
Швидкий вердикт
За критерієм «Міркування» обирайте Claude Fable 5: арена оцінює його на 5/5 проти 4/5 у Grok 4.3. За бюджетом виграє Grok 4.3: він коштує від $2.50/1M out проти $50/1M out у Claude Fable 5.
Порівняння рядок за рядком
Сильні та слабкі сторони
Grok 4.3
- Агресивні ціни: $1.25/$2.50 за 1M токенів, на 58% дешевший вхід і на 83% дешевший вихід, ніж у Grok 4, підрізаючи GPT-5.5 і Gemini 3.1 Pro
- Великий агентний стрибок: +321 Elo на GDPval-AA проти Grok 4.20, із сильним викликом інструментів і дотриманням інструкцій
- Кешований вхід за $0.20/1M (знижка 84%), велика економія для повторюваних агентних циклів
- Налаштовуваний рівень міркувань (none/low/medium/high) в одній моделі за одну ціну, без маршрутизації між швидким і глибоким варіантами
- Хвалять на HN за природний, стислий тон і щільні за токенами виводи, що знижують реальні витрати
- Солідна пропускна здатність близько 130 вихідних токенів/с (Artificial Analysis)
- Міркування в коді розробники на HN оцінили як 'неконкурентне з великими квітневими релізами'; межа інтелекту з часів Grok 4 майже не зрушила
- Показник негалюцинування впав на 8 пунктів проти Grok 4.20 на AA-Omniscience; 4.20 лишається безпечнішим вибором xAI для критичних до точності сфер
- Довгий час до першого токена (~13с на високому рівні міркувань за Artificial Analysis), болісно для інтерактивних застосунків
- Контекстне вікно скоротилося до 1M з 2M у Grok 4.20
- Повторювані скарги на довіру й безпеку (повідомлення про шкідливий контент, непослідовна поведінка) і відсутність підтримки MCP/під'єднаних застосунків у споживчому застосунку
Claude Fable 5
- 80.3% на SWE-bench Pro проти 69.2% в Opus 4.8, 58.6% у GPT-5.5 і 54.2% у Gemini 3.1 Pro, приблизно на 11 пунктів попереду наступної флагманської моделі
- 95.0% на SWE-bench Verified (Opus 4.8: 88.6%, GPT-5.5: 82.6%) і 29.3% на зрізі FrontierCode Diamond від Cognition, більш ніж удвічі проти 13.4% в Opus 4.8
- Автономія з довгим горизонтом і є головною новиною: Stripe повідомила про міграцію Ruby-кодової бази на 50 мільйонів рядків за один день замість 2+ місяців, а CEO Cursor називає її state of the art на CursorBench
- Польові звіти збігаються з бенчмарками: інженери на HN описують, що вона працює 'як справжній інженер' (CRDT майже без підказок, пише власні фазери, одне зменшення алокацій у 46 разів), Simon Willison виміряв 'роботу на кілька днів' за одну сесію
- Контекстне вікно 1M токенів за замовчуванням плюс 128K на виході й найкращий зір на щільних документах (29.8% на GDP.pdf проти 24.9% у GPT-5.5 і 22.5% в Opus 4.8)
- Запити, відхилені до першого виводу, не тарифікуються, а серверний fallback до Opus 4.8 із fallback-кредитом вбудований в API
- Удвічі дорожча за Opus 4.8 ($10/$50 проти $5/$25) і повільна: одиночні запити на складних задачах регулярно тривають багато хвилин, Simon Willison прямо називає її 'повільною, дорогою'
- Класифікатори безпеки подвійного призначення хибно спрацьовують на легітимній роботі: медичний фізик повідомив, що задачі з гідродинаміки й код сегментації МРТ відхилялися як біобезпекові ризики, а запити тихо перенаправлялися до Opus 4.8 (вірусний тред на HN мав назву 'If Claude Fable stops helping you, you'll never know'; Anthropic каже, менше 5% сесій)
- Важкий старт: експортний контроль США змусив Anthropic призупинити доступ у всьому світі з 12 до 30 червня 2026, через три дні після релізу, з повним відновленням лише 1 липня
- Вимагає 30-денного зберігання даних і недоступна в режимі zero data retention, жорсткий блокер для організацій зі строгим комплаєнсом; також немає режиму без мислення, сирий ланцюжок думок ніколи не повертається, prefill асистента дає 400
- Не всюди state of the art: GPT-5.5 досі лідирує на ARC-AGI-2 (85.0% проти 77.1%), а Andon Labs виявила, що розблокована Mythos 5 поступилася і Opus 4.7, і GPT-5.5 на Vending-Bench, із міркуваннями, оптимізованими під помітність, а не реальну шкоду
Винесіть свій вердикт
Одна рекомендація на інструмент від кожного гладіатора. Вона змінює оцінку натовпу, яку бачать усі.
Вердикт арени щодо Grok 4.3
Беріть Grok 4.3, якщо запускаєте агентні чи масові конвеєри, де все вирішує вартість виклику: він дає майже флагманське міркування й великий стрибок у виклику інструментів проти Grok 4.20 за частку цін GPT-5.5 чи Gemini 3.1 Pro. Пропустіть його, якщо ваш пріоритет точність у кодуванні, адже розробники досі ставлять Claude і великі квітневі релізи вище. Також лишайтеся на Grok 4.20, якщо вам потрібні його контекст 2M чи кращий показник негалюцинування для юридичної, медичної чи комплаєнс-роботи. Чутливим до затримки застосункам варто протестувати ~13с до першого токена, перш ніж зобов'язуватися.
Вердикт арени щодо Claude Fable 5
Беріть Claude Fable 5, якщо ваше навантаження справді має довгий горизонт: нічні агентні запуски, гігантські міграції, задачі, де одна багатогодинна сесія заміняє дні роботи під наглядом. Там подвійна надбавка проти Opus 4.8 окупається стисненням задач, а бенчмарки (80.3% SWE-bench Pro, на 11 пунктів попереду решти) підкріплені реальними впровадженнями у Stripe і Cursor. Для інтерактивного кодування й щоденної роботи лишайтеся на Opus 4.8: 88.6% на SWE-bench Verified за половину ціни, без хибних спрацювань класифікаторів, швидші ходи. Чутливі до витрат команди отримають майже опусівське кодування від Sonnet 5 за $3/$15 (стартова ціна $2/$10 до серпня 2026). Уникайте Fable 5 повністю, якщо вашій організації потрібен zero data retention або якщо ви працюєте поблизу біології, медичної візуалізації чи інструментів безпеки, де класифікатори подвійного призначення досі дають хибні спрацювання й тихо підставляють Opus 4.8 посеред сесії.
Що каже натовп
Про Grok 4.3
Вердиктів поки немає. Станьте першим, хто висловиться.
Про Claude Fable 5
“I do medical imaging research and the bio classifier keeps flagging my MRI segmentation prompts, then it silently falls back to Opus 4.8 mid-session. At $50 per million output tokens I expect to at least know which model actually answered me.”
“Yes it's 2x the price of Opus and yes the turns are slow. But one overnight Fable run replaced what used to be a week of supervising shorter runs. On a per-task basis it's actually the cheapest model we use.”
“The 1M context is real, not marketing. I fed it our entire service mesh config plus six months of incident postmortems and it traced a flaky timeout to a retry policy nobody remembered writing. Opus 4.8 never connected those dots.”
“Gave it a monorepo migration that Opus 4.8 kept stalling on. It ran for about 40 minutes, came back with the whole thing done plus a test harness it wrote for itself. Felt like reviewing a senior engineer's PR, not babysitting a chatbot.”
Порівнюйте далі
Поширені запитання
Чи кращий Grok 4.3 за Claude Fable 5?
Натовп зараз на боці Claude Fable 5: його рекомендують 63%, проти 50% у Grok 4.3 (4 голоси). За критерієм «Міркування» вища оцінка у Claude Fable 5 (5/5 проти 4/5). Правильний вибір залежить від вашого завдання. Порівняння рядок за рядком на цій сторінці розбирає ціни, ключові характеристики та оцінки арени.
Що дешевше: Grok 4.3 чи Claude Fable 5?
Grok 4.3 дешевший: він коштує від $2.50/1M out, тоді як Claude Fable 5 стартує з $50/1M out.
Скільки коштують Grok 4.3 і Claude Fable 5 за 1M токенів?
Grok 4.3: $1.25/1M in за 1M вхідних токенів, $2.50/1M out за 1M вихідних токенів. Claude Fable 5: $10/1M in за 1M вхідних токенів, $50/1M out за 1M вихідних токенів.