Birebir düello

Llama 4 (Scout / Maverick) logosuvsGPT-5.5 logosu

Llama 4 (Scout / Maverick) vs GPT-5.5: 2026'da hangi yapay zeka modeli kazanıyor?

Llama 4 (Scout / Maverick) ($0.60/1M out (Maverick, hosted)) ve GPT-5.5 ($30/1M out), 2026'nın en çok kullanılan yapay zeka modelleri arasında. 3 topluluk oyunda GPT-5.5, %57 onayla önde.

Hızlı hüküm

Akıl yürütme tarafında GPT-5.5 seçin: arena onu Llama 4 (Scout / Maverick) için 2.5/5 puana karşı 5/5 olarak değerlendiriyor. Bütçe tarafında Llama 4 (Scout / Maverick) kazanıyor: GPT-5.5 için $30/1M out yerine $0.60/1M out (Maverick, hosted) seviyesinden başlıyor.

Satır satır karşılaştırma

Başlangıç
$0.60/1M out (Maverick, hosted)Meta'nın birinci taraf ücretli API'si yok; Maverick için tipik üçüncü taraf barındırma tarifeleri gösteriliyor (Scout, DeepInfra'da 1M başına ~$0.10/$0.30'dan, Groq'ta $0.11/$0.34'ten başlıyor). Barındırılan Scout bağlamı, nominal 10M spesifikasyonunun çok altında sınırlanıyor (ör. DeepInfra'da ~320K).
$30/1M outStandart katman 1M token başına $5/$30 (önbellekli girdi $0.50), GPT-5.4'ün $2.50/$15'inin iki katı; Batch/Flex $2.50/$15; Priority $12.50/$75; GPT-5.5 Pro $30/$180; 272K girdi tokenini aşan prompt'lar 2x girdi / 1.5x çıktı faturalanır.
Sağlayıcı
Meta
OpenAI
Bağlam penceresi
10M tokens (Scout) / 1M (Maverick)
1M tokens (1,050,000)
Girdi fiyatı
$0.15/1M in (Maverick, hosted)
$5/1M in
Çıktı fiyatı
$0.60/1M out (Maverick, hosted)
$30/1M out
Modaliteler
text, vision (image input)
text, vision (image input, text output)
Open weights
Evet
Hayır
Kalabalık puanı
50%(0)
57%(3)
Arena puanları (1-5)
Akıl yürütme
2.5
5.0
Kodlama
2.0
4.5
Yazarlık
2.5
4.0
Hız
4.5
3.5
Fiyat/performans
3.5
3.0

Güçlü ve zayıf yönler

Llama 4 (Scout / Maverick)

  • MoE verimliliği: token başına yalnızca 17B aktif parametre (Scout 109B/16 uzman, Maverick 400B/128 uzman), hesaplama gücünün küçük bir bölümüyle GPT-4o sınıfına yakın sohbet
  • Çok ucuz barındırılan çıkarım: Maverick yaklaşık $0.15/1M girdi ve $0.60/1M çıktıdan başlıyor; Scout DeepInfra'da yaklaşık $0.10/$0.30, Groq'ta $0.11/$0.34
  • Open weights bir modelde yerleşik erken füzyon çok modluluk (metin artı görseller, 8 görsele kadar test edildi)
  • Çıkışında open weights modeller arasında en büyük nominal bağlam: Scout'ta 10M token, Maverick'te 1M
  • Scout, Int4 nicemlemeyle tek bir H100 GPU'ya sığıyor; 200 dilde ön eğitildi
  • Yüksek iş hacmi: 17B aktif parametre hızlı sağlayıcılarda 500+ token/sn'ye ulaşıyor (Groq, Scout'u 594 TPS ile listeliyor)
  • Benchmark güveni zedelendi: Meta, LMArena'ya yayımlanmamış sohbet için optimize edilmiş bir Maverick varyantı gönderdi (ELO 1417); halka açık ağırlıklar daha düşük puan aldığı için geliştiriciler bunu yanıltıcı buldu
  • Uzun bağlam iddiaları pratikte çöküyor: Scout, Fiction.LiveBench'te 128K'da ~%15.6 aldı, Gemini 2.5 Pro'nun %90.6'sına karşı; barındıran sağlayıcılar Scout'u 10M'nin çok altında sınırlıyor (ör. DeepInfra'da ~320K)
  • Kodlama r/LocalLlama ve HN'de sert eleştirildi; gerçek geliştirme görevlerinde benzer fiyatlı DeepSeek V3'e kaybediyor
  • OSI anlamında açık kaynak değil: lisans AB merkezli şirketleri dışlıyor, 700M MAU üzerinde özel lisans istiyor ve Llama markalamasını zorunlu kılıyor
  • Toplam 109B/400B parametre tüketici GPU'ları için fazla büyük ve seri durdu: reasoning varyantı hiç çıkmadı, Behemoth hiç yayımlanmadı

GPT-5.5

  • 1M token bağlam penceresi (1,050,000), 128K maks. çıktı ve none'dan xhigh'a ayarlanabilir akıl yürütme effort'u
  • ARC-AGI-2'de son teknoloji: 85.0% (GPT-5.4'te 73.3%) ve Terminal-Bench 2.0'da 82.7%
  • Güçlü ajan kodlama otonomisi: geliştiriciler GPT-5.4'ün birden çok turda yaptığı işleri tek seferde bitirdiğini ve kendi hatalarını düzelttiğini bildiriyor; Code Arena'da GPT-5.4'e göre +50 puan
  • Agresif indirimler: önbellekli girdide %90 indirim ($0.50/1M) ve Batch veya Flex ile %50 indirim ($2.50/$15)
  • Bir sınır akıl yürütücüsü için hızlı: geliştiriciler, orta veya düşük düşünme effort'unda rahatça çalıştırılabilen ilk GPT modeli olduğunu söylüyor
  • Liste fiyatı aynı 1M token bağlam penceresi için GPT-5.4'e göre ikiye katlandı ($5/$30 vs $2.50/$15)
  • Aşırı harfiyen talimat takibi: geliştiriciler, Claude'un başardığı bariz yerlerde niyeti çıkarsayamadığını bildiriyor
  • SWE-bench Pro'da Claude Opus 4.8'in gerisinde (58.6% vs 69.2%); HN geliştiricileri kodlama için Claude'u hala kabaca 2:1 tercih ediyor
  • Bazen kod değişikliklerinde fazla temkinli ya da derin akıl yürütmeyi tamamen atlayıp karmaşık prompt'lara anında yanıt veriyor
  • Uzun bağlam ek ücreti: 272K girdi tokenini aşan prompt'lar tüm oturum için 2x girdi ve 1.5x çıktı üzerinden faturalanıyor

Hükmünüzü verin

Gladyatör başına, araç başına bir tavsiye. Herkesin gördüğü kalabalık puanını yeniden şekillendirir.

Llama 4 (Scout / Maverick)$0.60/1M out (Maverick, hosted)
50%kalabalık puanı · 0
GPT-5.5$30/1M out
57%kalabalık puanı · 3

Arenanın Llama 4 (Scout / Maverick) hakkındaki hükmü

AB dışında yüksek hacimli sohbet, veri çıkarma veya çok dilli iş yükleri için ucuz, hızlı, kendi sunucunuzda barındırılabilir çok modlu bir model gerekiyorsa Llama 4'ü seçin; Maverick, kabaca onda bir fiyata GPT-4o kalitesine yaklaşıyor. Kodlama, zorlu akıl yürütme veya gerçek milyon tokenlik getirim için uzak durun; DeepSeek, Qwen 3 ve Gemini oralarda açık ara daha iyi. Llama 3.3 70B'ye göre yerleşik görü ve daha uzun pencere ekliyor ama birçok geliştirici salt metin kalitesi için eski yoğun modeli veya Qwen'i daha güvenilir buldu ve 10M bağlam büyük ölçüde kağıt üzerinde bir rakam.

Arenanın GPT-5.5 hakkındaki hükmü

Daha güçlü ajan otonomisi, terminal ağırlıklı iş akışları veya SOTA soyut akıl yürütme gerekiyorsa GPT-5.5'i GPT-5.4'e tercih edin; ancak liste fiyatının GPT-5.4'ün $2.50/$15'inden $5/$30'a katlandığını ve 1M token bağlamın aynı kaldığını bilin. Yüksek riskli çoklu dosya refaktörleri yapan ekipler, SWE-bench Pro'da önde olan (69.2% vs 58.6%) ve gevşek prompt'lardan niyeti daha iyi çıkarsayan Claude Opus'u yine tercih edebilir. Bütçeye duyarlı kullanıcılar 272K token ek ücretine ve daha hızlı limit tükenmesi raporlarına dikkat etmeli; maliyeti yarıya indirmek için önbellekleme, Batch veya Flex'e yaslanmalı.

Kalabalık ne diyor

Llama 4 (Scout / Maverick) hakkında

Henüz hüküm yok. İlk konuşan siz olun.

GPT-5.5 hakkında

Başparmak Aşağıcus

It is painfully literal. Where Claude infers intent in obvious places, 5.5 wants everything spelled out. And the price doubled vs 5.4 for the same 1M context.

Adil Yorumcu

85 on ARC-AGI-2 and you can feel it. Stuff that used to stall my agent just resolves now. 1M context with 128K output covers every workflow I have.

Sör Durmadan Yayınlar

5.5 one-shots tasks that took 5.4 three turns, and it fixes its own mistakes mid-run instead of doubling down. The reasoning effort dial from none to xhigh is genuinely useful.

Sık sorulan sorular

Llama 4 (Scout / Maverick), GPT-5.5 aracından daha mı iyi?

Kalabalık şu anda GPT-5.5 tarafında: %57 tavsiye ediyor, Llama 4 (Scout / Maverick) için bu oran %50 (3 oy). Akıl yürütme tarafında GPT-5.5 daha yüksek puan alıyor (5/5 vs 2.5/5). Doğru seçim kullanım amacınıza bağlı. Bu sayfadaki satır satır karşılaştırma; fiyatlandırmayı, temel özellikleri ve arena puanlarını ayrıntılarıyla ele alıyor.

Hangisi daha ucuz, Llama 4 (Scout / Maverick) mı GPT-5.5 mi?

Llama 4 (Scout / Maverick) daha ucuz: $0.60/1M out (Maverick, hosted) seviyesinden başlıyor, GPT-5.5 ise $30/1M out seviyesinden başlıyor.

Llama 4 (Scout / Maverick) ve GPT-5.5 1M token başına ne kadar tutuyor?

Llama 4 (Scout / Maverick): 1M girdi tokeni başına $0.15/1M in (Maverick, hosted), 1M çıktı tokeni başına $0.60/1M out (Maverick, hosted). GPT-5.5: 1M girdi tokeni başına $5/1M in, 1M çıktı tokeni başına $30/1M out.