Арена · огляд: ШІ-модель
Llama 4 (Scout / Maverick)
від Meta
Пара open-weight MoE від Meta: 17B активних параметрів, нативний вхід зображеннями, контекст 10M токенів на папері
$0.60/1M out (Maverick, hosted)
Платного API від самої Meta немає; наведено типові ставки сторонніх хостингів для Maverick (Scout приблизно від $0.10/$0.30 за 1M на DeepInfra, $0.11/$0.34 на Groq). Хостований контекст Scout обмежений значно нижче номінальних 10M (наприклад, ~320K на DeepInfra).
Meta
10M tokens (Scout) / 1M (Maverick)
$0.15/1M in (Maverick, hosted)
$0.60/1M out (Maverick, hosted)
text, vision (image input)
Так
Що таке Llama 4 (Scout / Maverick)?
Перші нативно мультимодальні open-weight моделі Meta з архітектурою mixture-of-experts, випущені 5 квітня 2025 року. Scout (109B параметрів загалом, 16 експертів) націлений на розгортання на одному GPU з номінальним контекстом 10M токенів; Maverick (400B загалом, 128 експертів) є флагманською чат-моделлю з вікном на 1M токенів.
Llama 4 (Scout / Maverick): плюси й мінуси
Плюси
- Ефективність MoE: лише 17B активних параметрів на токен (Scout 109B/16 експертів, Maverick 400B/128 експертів), що дає чат майже класу GPT-4o за частку обчислень
- Дуже дешевий хостований інференс: Maverick приблизно від $0.15/1M за вхід і $0.60/1M за вихід; Scout приблизно від $0.10/$0.30 на DeepInfra або $0.11/$0.34 на Groq
- Нативна мультимодальність з early fusion (текст плюс зображення, протестовано до 8 зображень) в open-weight моделі
- Найбільший номінальний контекст серед open-weight моделей на момент релізу: 10M токенів у Scout, 1M у Maverick
- Scout вміщується на одному GPU H100 із квантуванням Int4; попередньо навчений на 200 мовах
- Висока пропускна здатність: 17B активних параметрів досягають 500+ токенів/с у швидких провайдерів (Groq заявляє для Scout 594 TPS)
Мінуси
- Підірвана довіра до бенчмарків: Meta подала на LMArena неопублікований чат-оптимізований варіант Maverick (ELO 1417), що розробники назвали оманливим, оскільки публічні ваги набирають менше
- Заяви про довгий контекст розсипаються на практиці: Scout набрав ~15.6% на 128K у Fiction.LiveBench проти 90.6% у Gemini 2.5 Pro, а хостинг-провайдери обмежують Scout значно нижче 10M (наприклад, ~320K на DeepInfra)
- Кодування масово розкритикували на r/LocalLlama і HN: програє порівнянному за ціною DeepSeek V3 на реальних задачах розробки
- Не open source за OSI: ліцензія виключає компанії з юрисдикцією в ЄС, вимагає окремої ліцензії понад 700M MAU і зобов'язує до брендингу Llama
- 109B/400B загальних параметрів завеликі для споживчих GPU, а лінійка застигла: варіант із міркуваннями так і не вийшов, а Behemoth так і не випустили
Вердикт арени
Беріть Llama 4, якщо вам потрібна дешева, швидка мультимодальна модель для самостійного хостингу під масовий чат, витяг даних чи багатомовні навантаження поза ЄС; Maverick виходить майже на якість GPT-4o приблизно за десяту частину ціни. Уникайте її для кодування, складних міркувань чи справжнього пошуку в мільйонних контекстах, де DeepSeek, Qwen 3 і Gemini явно кращі. Проти Llama 3.3 70B вона додає нативний зір і довше вікно, але багато розробників вважали стару щільну модель або Qwen надійнішими за чистою якістю тексту, а контекст 10M здебільшого лишається цифрою на папері.
Палець угору чи палець униз
Винесіть свій вердикт
Ви б порекомендували Llama 4 (Scout / Maverick) чи застерегли натовп?
Найкращі альтернативи Llama 4 (Scout / Maverick)
Усі альтернативиНайшвидша модель Anthropic: близько 90% навичок кодування Sonnet 4.5 за $1/$5 за 1M токенів, контекст 200K.
Флагман Anthropic класу Mythos від червня 2026: 80.3% на SWE-bench Pro, на 11 пунктів попереду кожної іншої флагманської моделі
Opus від Anthropic, квітень 2026: 87.6% SWE-bench Verified, контекст 1M, зір високої роздільності, нині позаду Opus 4.8
Порівняйте Llama 4 (Scout / Maverick) віч-на-віч
Llama 4 (Scout / Maverick): поширені запитання
Скільки коштує Llama 4 (Scout / Maverick) за 1M токенів?
Llama 4 (Scout / Maverick) коштує $0.15/1M in (Maverick, hosted) за 1M вхідних токенів і $0.60/1M out (Maverick, hosted) за 1M вихідних токенів. Платного API від самої Meta немає; наведено типові ставки сторонніх хостингів для Maverick (Scout приблизно від $0.10/$0.30 за 1M на DeepInfra, $0.11/$0.34 на Groq). Хостований контекст Scout обмежений значно нижче номінальних 10M (наприклад, ~320K на DeepInfra).