Arena · yapay zeka modeli incelemesi

Llama 4 (Scout / Maverick)

Meta tarafından

Meta'nın open weights MoE ikilisi: 17B aktif parametre, yerleşik görsel girdi, kağıt üzerinde 10M token bağlam

Arena puanı 3/5
Akıl yürütme2.5
Kodlama2.0
Yazarlık2.5
Hız4.5
Fiyat/performans3.5
Llama 4 (Scout / Maverick) sitesini ziyaret etyüksek hacimli ucuz çıkarımkendi sunucusunda barındırılan çok modlu uygulamalarölçekli çok dilli sohbetuzun belge özetleme
Fiyat

$0.60/1M out (Maverick, hosted)

Meta'nın birinci taraf ücretli API'si yok; Maverick için tipik üçüncü taraf barındırma tarifeleri gösteriliyor (Scout, DeepInfra'da 1M başına ~$0.10/$0.30'dan, Groq'ta $0.11/$0.34'ten başlıyor). Barındırılan Scout bağlamı, nominal 10M spesifikasyonunun çok altında sınırlanıyor (ör. DeepInfra'da ~320K).

Sağlayıcı

Meta

Bağlam penceresi

10M tokens (Scout) / 1M (Maverick)

Girdi fiyatı

$0.15/1M in (Maverick, hosted)

Çıktı fiyatı

$0.60/1M out (Maverick, hosted)

Modaliteler

text, vision (image input)

Open weights

Evet

Llama 4 (Scout / Maverick) nedir?

Meta'nın 5 Nisan 2025'te yayımlanan, doğuştan çok modlu ilk mixture-of-experts open weights modelleri. Scout (toplam 109B parametre, 16 uzman) nominal 10M token bağlamla tek GPU dağıtımını hedefliyor; Maverick (toplam 400B, 128 uzman) 1M token pencereli amiral gemisi sohbet modeli.

Llama 4 (Scout / Maverick) artıları ve eksileri

Artılar

  • MoE verimliliği: token başına yalnızca 17B aktif parametre (Scout 109B/16 uzman, Maverick 400B/128 uzman), hesaplama gücünün küçük bir bölümüyle GPT-4o sınıfına yakın sohbet
  • Çok ucuz barındırılan çıkarım: Maverick yaklaşık $0.15/1M girdi ve $0.60/1M çıktıdan başlıyor; Scout DeepInfra'da yaklaşık $0.10/$0.30, Groq'ta $0.11/$0.34
  • Open weights bir modelde yerleşik erken füzyon çok modluluk (metin artı görseller, 8 görsele kadar test edildi)
  • Çıkışında open weights modeller arasında en büyük nominal bağlam: Scout'ta 10M token, Maverick'te 1M
  • Scout, Int4 nicemlemeyle tek bir H100 GPU'ya sığıyor; 200 dilde ön eğitildi
  • Yüksek iş hacmi: 17B aktif parametre hızlı sağlayıcılarda 500+ token/sn'ye ulaşıyor (Groq, Scout'u 594 TPS ile listeliyor)

Eksiler

  • Benchmark güveni zedelendi: Meta, LMArena'ya yayımlanmamış sohbet için optimize edilmiş bir Maverick varyantı gönderdi (ELO 1417); halka açık ağırlıklar daha düşük puan aldığı için geliştiriciler bunu yanıltıcı buldu
  • Uzun bağlam iddiaları pratikte çöküyor: Scout, Fiction.LiveBench'te 128K'da ~%15.6 aldı, Gemini 2.5 Pro'nun %90.6'sına karşı; barındıran sağlayıcılar Scout'u 10M'nin çok altında sınırlıyor (ör. DeepInfra'da ~320K)
  • Kodlama r/LocalLlama ve HN'de sert eleştirildi; gerçek geliştirme görevlerinde benzer fiyatlı DeepSeek V3'e kaybediyor
  • OSI anlamında açık kaynak değil: lisans AB merkezli şirketleri dışlıyor, 700M MAU üzerinde özel lisans istiyor ve Llama markalamasını zorunlu kılıyor
  • Toplam 109B/400B parametre tüketici GPU'ları için fazla büyük ve seri durdu: reasoning varyantı hiç çıkmadı, Behemoth hiç yayımlanmadı

Arenanın hükmü

AB dışında yüksek hacimli sohbet, veri çıkarma veya çok dilli iş yükleri için ucuz, hızlı, kendi sunucunuzda barındırılabilir çok modlu bir model gerekiyorsa Llama 4'ü seçin; Maverick, kabaca onda bir fiyata GPT-4o kalitesine yaklaşıyor. Kodlama, zorlu akıl yürütme veya gerçek milyon tokenlik getirim için uzak durun; DeepSeek, Qwen 3 ve Gemini oralarda açık ara daha iyi. Llama 3.3 70B'ye göre yerleşik görü ve daha uzun pencere ekliyor ama birçok geliştirici salt metin kalitesi için eski yoğun modeli veya Qwen'i daha güvenilir buldu ve 10M bağlam büyük ölçüde kağıt üzerinde bir rakam.

Başparmak yukarı ya da aşağı

Hükmünüzü verin

Llama 4 (Scout / Maverick) aracını tavsiye eder misiniz, yoksa kalabalığı uyarır mısınız?

50%kalabalık puanı · 0

En iyi Llama 4 (Scout / Maverick) alternatifleri

Tüm alternatifler
1
Claude Haiku 4.5

Anthropic'in en hızlı modeli: Sonnet 4.5'in kodlama becerisinin yaklaşık %90'ı, 1M token başına $1/$5, 200K bağlam.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropic'in Haziran 2026 Mythos sınıfı amiral gemisi: SWE-bench Pro'da 80.3%, diğer tüm sınır modellerden 11 puan önde

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropic'in Nisan 2026 Opus modeli: 87.6% SWE-bench Verified, 1M bağlam, yüksek çözünürlüklü görü, artık Opus 4.8'in gerisinde

$25/1M out57%(3)
Visit

Llama 4 (Scout / Maverick) birebir karşılaştırmaları

Llama 4 (Scout / Maverick): sık sorulan sorular

Llama 4 (Scout / Maverick) 1M token başına ne kadar tutuyor?

Llama 4 (Scout / Maverick), 1M girdi tokeni başına $0.15/1M in (Maverick, hosted) ve 1M çıktı tokeni başına $0.60/1M out (Maverick, hosted) tutuyor. Meta'nın birinci taraf ücretli API'si yok; Maverick için tipik üçüncü taraf barındırma tarifeleri gösteriliyor (Scout, DeepInfra'da 1M başına ~$0.10/$0.30'dan, Groq'ta $0.11/$0.34'ten başlıyor). Barındırılan Scout bağlamı, nominal 10M spesifikasyonunun çok altında sınırlanıyor (ör. DeepInfra'da ~320K).