Birebir düello

Llama 4 (Scout / Maverick) logosuvsClaude Haiku 4.5 logosu

Llama 4 (Scout / Maverick) vs Claude Haiku 4.5: 2026'da hangi yapay zeka modeli kazanıyor?

Llama 4 (Scout / Maverick) ($0.60/1M out (Maverick, hosted)) ve Claude Haiku 4.5 ($5/1M out), 2026'nın en çok kullanılan yapay zeka modelleri arasında. 2 topluluk oyunda Claude Haiku 4.5, %67 onayla önde.

Hızlı hüküm

Akıl yürütme tarafında Claude Haiku 4.5 seçin: arena onu Llama 4 (Scout / Maverick) için 2.5/5 puana karşı 3/5 olarak değerlendiriyor. Bütçe tarafında Llama 4 (Scout / Maverick) kazanıyor: Claude Haiku 4.5 için $5/1M out yerine $0.60/1M out (Maverick, hosted) seviyesinden başlıyor.

Satır satır karşılaştırma

Başlangıç
$0.60/1M out (Maverick, hosted)Meta'nın birinci taraf ücretli API'si yok; Maverick için tipik üçüncü taraf barındırma tarifeleri gösteriliyor (Scout, DeepInfra'da 1M başına ~$0.10/$0.30'dan, Groq'ta $0.11/$0.34'ten başlıyor). Barındırılan Scout bağlamı, nominal 10M spesifikasyonunun çok altında sınırlanıyor (ör. DeepInfra'da ~320K).
$5/1M outTek katman: $1/1M girdi, $5/1M çıktı; prompt önbellek okumaları $0.10/1M (5 dk yazmaları $1.25/1M), Batch API %50 keser ($0.50/$2.50); uzun bağlam ek ücreti yok (maks. 200K).
Sağlayıcı
Meta
Anthropic
Bağlam penceresi
10M tokens (Scout) / 1M (Maverick)
200K tokens
Girdi fiyatı
$0.15/1M in (Maverick, hosted)
$1/1M in
Çıktı fiyatı
$0.60/1M out (Maverick, hosted)
$5/1M out
Modaliteler
text, vision (image input)
text, vision (input); text output
Open weights
Evet
Hayır
Kalabalık puanı
50%(0)
67%(2)
Arena puanları (1-5)
Akıl yürütme
2.5
3.0
Kodlama
2.0
3.5
Yazarlık
2.5
3.0
Hız
4.5
4.5
Fiyat/performans
3.5
4.0

Güçlü ve zayıf yönler

Llama 4 (Scout / Maverick)

  • MoE verimliliği: token başına yalnızca 17B aktif parametre (Scout 109B/16 uzman, Maverick 400B/128 uzman), hesaplama gücünün küçük bir bölümüyle GPT-4o sınıfına yakın sohbet
  • Çok ucuz barındırılan çıkarım: Maverick yaklaşık $0.15/1M girdi ve $0.60/1M çıktıdan başlıyor; Scout DeepInfra'da yaklaşık $0.10/$0.30, Groq'ta $0.11/$0.34
  • Open weights bir modelde yerleşik erken füzyon çok modluluk (metin artı görseller, 8 görsele kadar test edildi)
  • Çıkışında open weights modeller arasında en büyük nominal bağlam: Scout'ta 10M token, Maverick'te 1M
  • Scout, Int4 nicemlemeyle tek bir H100 GPU'ya sığıyor; 200 dilde ön eğitildi
  • Yüksek iş hacmi: 17B aktif parametre hızlı sağlayıcılarda 500+ token/sn'ye ulaşıyor (Groq, Scout'u 594 TPS ile listeliyor)
  • Benchmark güveni zedelendi: Meta, LMArena'ya yayımlanmamış sohbet için optimize edilmiş bir Maverick varyantı gönderdi (ELO 1417); halka açık ağırlıklar daha düşük puan aldığı için geliştiriciler bunu yanıltıcı buldu
  • Uzun bağlam iddiaları pratikte çöküyor: Scout, Fiction.LiveBench'te 128K'da ~%15.6 aldı, Gemini 2.5 Pro'nun %90.6'sına karşı; barındıran sağlayıcılar Scout'u 10M'nin çok altında sınırlıyor (ör. DeepInfra'da ~320K)
  • Kodlama r/LocalLlama ve HN'de sert eleştirildi; gerçek geliştirme görevlerinde benzer fiyatlı DeepSeek V3'e kaybediyor
  • OSI anlamında açık kaynak değil: lisans AB merkezli şirketleri dışlıyor, 700M MAU üzerinde özel lisans istiyor ve Llama markalamasını zorunlu kılıyor
  • Toplam 109B/400B parametre tüketici GPU'ları için fazla büyük ve seri durdu: reasoning varyantı hiç çıkmadı, Behemoth hiç yayımlanmadı

Claude Haiku 4.5

  • SWE-bench Verified'da 73.3%, üçte bir fiyata Sonnet 4.5'in ajan kodlamasının yaklaşık %90'ı
  • Hızlı: Anthropic'e göre Sonnet 4 hızının 2 katından fazla, çıkış müşterileri Sonnet 4.5'ten 4-5 kat hızlı bildiriyor; Artificial Analysis ölçümüyle ~92-110 çıktı tokeni/sn
  • Geliştiriciler, ilgisiz koda dokunmayan isabetli ve yerelleşmiş kod düzenlemeleri bildiriyor; erken testlerde GPT-5 mini sınıfından daha iyi
  • Hem görsel girdiyi hem genişletilmiş düşünmeyi destekliyor, çıkışta bu fiyat katmanında ender
  • Çoklu ajan kurulumlarında işçi model olarak çok uygun (Sonnet/Opus planlar, paralel Haiku alt ajanları uygular)
  • $0.10/1M prompt önbellek okumaları ve %50 Batch API indirimi efektif maliyeti daha da düşürüyor
  • $5/1M çıktı, küçük bir model için pahalı: Gemini Flash ve GPT mini katmanları çıktı ağırlıklı görevlerde onu birkaç kat geride bırakıyor
  • 200K bağlam (Sonnet 5/Opus kardeşlerinin 1M'sine karşı) ve 64K maks. çıktı, büyük kod tabanı ve uzun çıktı işlerini sınırlıyor
  • Vasat alanlar arası akıl yürütme: kullanıcılar GPQA, MedQA, MMMU tarzı bilgi görevlerinde zayıf sonuçlar bildiriyor
  • Pratikte iş hacmi çok değişken (82-208 token/sn bildiriliyor) ve 7-8+ dakikalık uzun ajan oturumlarında kalite düşüyor
  • Bilgi kesim tarihi (Şubat 2025'e kadar güvenilir) 2026 ortası standartlarına göre eski

Hükmünüzü verin

Gladyatör başına, araç başına bir tavsiye. Herkesin gördüğü kalabalık puanını yeniden şekillendirir.

Llama 4 (Scout / Maverick)$0.60/1M out (Maverick, hosted)
50%kalabalık puanı · 0
67%kalabalık puanı · 2

Arenanın Llama 4 (Scout / Maverick) hakkındaki hükmü

AB dışında yüksek hacimli sohbet, veri çıkarma veya çok dilli iş yükleri için ucuz, hızlı, kendi sunucunuzda barındırılabilir çok modlu bir model gerekiyorsa Llama 4'ü seçin; Maverick, kabaca onda bir fiyata GPT-4o kalitesine yaklaşıyor. Kodlama, zorlu akıl yürütme veya gerçek milyon tokenlik getirim için uzak durun; DeepSeek, Qwen 3 ve Gemini oralarda açık ara daha iyi. Llama 3.3 70B'ye göre yerleşik görü ve daha uzun pencere ekliyor ama birçok geliştirici salt metin kalitesi için eski yoğun modeli veya Qwen'i daha güvenilir buldu ve 10M bağlam büyük ölçüde kağıt üzerinde bir rakam.

Arenanın Claude Haiku 4.5 hakkındaki hükmü

Anthropic yığınındaysanız ve düşük gecikmeyle, üçte bir fiyata Sonnet'e yakın kodlama kalitesi gerekiyorsa Haiku 4.5'i seçin: Haiku 3.5'e göre devasa bir sıçrama ve çoklu ajan hatlarında işçi model olarak mükemmel. Temmuz 2026 itibarıyla hala Anthropic'in güncel küçük modeli, dolayısıyla Claude tabanlı ürünler için varsayılan ucuz katman. Derin alanlar arası akıl yürütme, çok büyük kod tabanları (200K bağlam tavanı) veya salt token başına maliyet avcılığı için uzak durun; oralarda Gemini Flash ve GPT mini katmanları artık daha ucuz. Kalite hızdan önemli olduğunda Sonnet 5'e yükselin.

Kalabalık ne diyor

Llama 4 (Scout / Maverick) hakkında

Henüz hüküm yok. İlk konuşan siz olun.

Claude Haiku 4.5 hakkında

Repo Muhafızı

The precise localized edits are the underrated feature. It fixes the line that needs fixing and leaves the rest alone. GPT mini class models keep rewriting half my file.

Vibe Şampiyonu

Haiku 4.5 gives me about 90% of Sonnet agentic coding at a third of the price, and it is fast enough that edit loops feel instant. My default for quick fixes now.

Sık sorulan sorular

Llama 4 (Scout / Maverick), Claude Haiku 4.5 aracından daha mı iyi?

Kalabalık şu anda Claude Haiku 4.5 tarafında: %67 tavsiye ediyor, Llama 4 (Scout / Maverick) için bu oran %50 (2 oy). Akıl yürütme tarafında Claude Haiku 4.5 daha yüksek puan alıyor (3/5 vs 2.5/5). Doğru seçim kullanım amacınıza bağlı. Bu sayfadaki satır satır karşılaştırma; fiyatlandırmayı, temel özellikleri ve arena puanlarını ayrıntılarıyla ele alıyor.

Hangisi daha ucuz, Llama 4 (Scout / Maverick) mı Claude Haiku 4.5 mi?

Llama 4 (Scout / Maverick) daha ucuz: $0.60/1M out (Maverick, hosted) seviyesinden başlıyor, Claude Haiku 4.5 ise $5/1M out seviyesinden başlıyor.

Llama 4 (Scout / Maverick) ve Claude Haiku 4.5 1M token başına ne kadar tutuyor?

Llama 4 (Scout / Maverick): 1M girdi tokeni başına $0.15/1M in (Maverick, hosted), 1M çıktı tokeni başına $0.60/1M out (Maverick, hosted). Claude Haiku 4.5: 1M girdi tokeni başına $1/1M in, 1M çıktı tokeni başına $5/1M out.