Арена · огляд: ШІ-модель

Llama 4 (Scout / Maverick)

від Meta

Пара open-weight MoE від Meta: 17B активних параметрів, нативний вхід зображеннями, контекст 10M токенів на папері

Оцінка арени 3/5
Міркування2.5
Код2.0
Тексти2.5
Швидкість4.5
Ціна-якість3.5
Відвідати Llama 4 (Scout / Maverick)масовий дешевий інференссамостійно хостовані мультимодальні застосункибагатомовний чат у масштабістислий переказ довгих документів
Ціна

$0.60/1M out (Maverick, hosted)

Платного API від самої Meta немає; наведено типові ставки сторонніх хостингів для Maverick (Scout приблизно від $0.10/$0.30 за 1M на DeepInfra, $0.11/$0.34 на Groq). Хостований контекст Scout обмежений значно нижче номінальних 10M (наприклад, ~320K на DeepInfra).

Провайдер

Meta

Контекстне вікно

10M tokens (Scout) / 1M (Maverick)

Ціна за вхід

$0.15/1M in (Maverick, hosted)

Ціна за вихід

$0.60/1M out (Maverick, hosted)

Модальності

text, vision (image input)

Open weights

Так

Що таке Llama 4 (Scout / Maverick)?

Перші нативно мультимодальні open-weight моделі Meta з архітектурою mixture-of-experts, випущені 5 квітня 2025 року. Scout (109B параметрів загалом, 16 експертів) націлений на розгортання на одному GPU з номінальним контекстом 10M токенів; Maverick (400B загалом, 128 експертів) є флагманською чат-моделлю з вікном на 1M токенів.

Llama 4 (Scout / Maverick): плюси й мінуси

Плюси

  • Ефективність MoE: лише 17B активних параметрів на токен (Scout 109B/16 експертів, Maverick 400B/128 експертів), що дає чат майже класу GPT-4o за частку обчислень
  • Дуже дешевий хостований інференс: Maverick приблизно від $0.15/1M за вхід і $0.60/1M за вихід; Scout приблизно від $0.10/$0.30 на DeepInfra або $0.11/$0.34 на Groq
  • Нативна мультимодальність з early fusion (текст плюс зображення, протестовано до 8 зображень) в open-weight моделі
  • Найбільший номінальний контекст серед open-weight моделей на момент релізу: 10M токенів у Scout, 1M у Maverick
  • Scout вміщується на одному GPU H100 із квантуванням Int4; попередньо навчений на 200 мовах
  • Висока пропускна здатність: 17B активних параметрів досягають 500+ токенів/с у швидких провайдерів (Groq заявляє для Scout 594 TPS)

Мінуси

  • Підірвана довіра до бенчмарків: Meta подала на LMArena неопублікований чат-оптимізований варіант Maverick (ELO 1417), що розробники назвали оманливим, оскільки публічні ваги набирають менше
  • Заяви про довгий контекст розсипаються на практиці: Scout набрав ~15.6% на 128K у Fiction.LiveBench проти 90.6% у Gemini 2.5 Pro, а хостинг-провайдери обмежують Scout значно нижче 10M (наприклад, ~320K на DeepInfra)
  • Кодування масово розкритикували на r/LocalLlama і HN: програє порівнянному за ціною DeepSeek V3 на реальних задачах розробки
  • Не open source за OSI: ліцензія виключає компанії з юрисдикцією в ЄС, вимагає окремої ліцензії понад 700M MAU і зобов'язує до брендингу Llama
  • 109B/400B загальних параметрів завеликі для споживчих GPU, а лінійка застигла: варіант із міркуваннями так і не вийшов, а Behemoth так і не випустили

Вердикт арени

Беріть Llama 4, якщо вам потрібна дешева, швидка мультимодальна модель для самостійного хостингу під масовий чат, витяг даних чи багатомовні навантаження поза ЄС; Maverick виходить майже на якість GPT-4o приблизно за десяту частину ціни. Уникайте її для кодування, складних міркувань чи справжнього пошуку в мільйонних контекстах, де DeepSeek, Qwen 3 і Gemini явно кращі. Проти Llama 3.3 70B вона додає нативний зір і довше вікно, але багато розробників вважали стару щільну модель або Qwen надійнішими за чистою якістю тексту, а контекст 10M здебільшого лишається цифрою на папері.

Палець угору чи палець униз

Винесіть свій вердикт

Ви б порекомендували Llama 4 (Scout / Maverick) чи застерегли натовп?

50%оцінка натовпу · 0

Найкращі альтернативи Llama 4 (Scout / Maverick)

Усі альтернативи
1
Claude Haiku 4.5

Найшвидша модель Anthropic: близько 90% навичок кодування Sonnet 4.5 за $1/$5 за 1M токенів, контекст 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Флагман Anthropic класу Mythos від червня 2026: 80.3% на SWE-bench Pro, на 11 пунктів попереду кожної іншої флагманської моделі

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Opus від Anthropic, квітень 2026: 87.6% SWE-bench Verified, контекст 1M, зір високої роздільності, нині позаду Opus 4.8

$25/1M out57%(3)
Visit

Порівняйте Llama 4 (Scout / Maverick) віч-на-віч

Llama 4 (Scout / Maverick): поширені запитання

Скільки коштує Llama 4 (Scout / Maverick) за 1M токенів?

Llama 4 (Scout / Maverick) коштує $0.15/1M in (Maverick, hosted) за 1M вхідних токенів і $0.60/1M out (Maverick, hosted) за 1M вихідних токенів. Платного API від самої Meta немає; наведено типові ставки сторонніх хостингів для Maverick (Scout приблизно від $0.10/$0.30 за 1M на DeepInfra, $0.11/$0.34 на Groq). Хостований контекст Scout обмежений значно нижче номінальних 10M (наприклад, ~320K на DeepInfra).