Birebir düello
Llama 4 (Scout / Maverick) vs GPT-5.2: 2026'da hangi yapay zeka modeli kazanıyor?
Llama 4 (Scout / Maverick) ($0.60/1M out (Maverick, hosted)) ve GPT-5.2 ($14/1M out), 2026'nın en çok kullanılan yapay zeka modelleri arasında. 2 topluluk oyunda Llama 4 (Scout / Maverick), %50 onayla önde.
Hızlı hüküm
Akıl yürütme tarafında GPT-5.2 seçin: arena onu Llama 4 (Scout / Maverick) için 2.5/5 puana karşı 4/5 olarak değerlendiriyor. Bütçe tarafında Llama 4 (Scout / Maverick) kazanıyor: GPT-5.2 için $14/1M out yerine $0.60/1M out (Maverick, hosted) seviyesinden başlıyor.
Satır satır karşılaştırma
Güçlü ve zayıf yönler
Llama 4 (Scout / Maverick)
- MoE verimliliği: token başına yalnızca 17B aktif parametre (Scout 109B/16 uzman, Maverick 400B/128 uzman), hesaplama gücünün küçük bir bölümüyle GPT-4o sınıfına yakın sohbet
- Çok ucuz barındırılan çıkarım: Maverick yaklaşık $0.15/1M girdi ve $0.60/1M çıktıdan başlıyor; Scout DeepInfra'da yaklaşık $0.10/$0.30, Groq'ta $0.11/$0.34
- Open weights bir modelde yerleşik erken füzyon çok modluluk (metin artı görseller, 8 görsele kadar test edildi)
- Çıkışında open weights modeller arasında en büyük nominal bağlam: Scout'ta 10M token, Maverick'te 1M
- Scout, Int4 nicemlemeyle tek bir H100 GPU'ya sığıyor; 200 dilde ön eğitildi
- Yüksek iş hacmi: 17B aktif parametre hızlı sağlayıcılarda 500+ token/sn'ye ulaşıyor (Groq, Scout'u 594 TPS ile listeliyor)
- Benchmark güveni zedelendi: Meta, LMArena'ya yayımlanmamış sohbet için optimize edilmiş bir Maverick varyantı gönderdi (ELO 1417); halka açık ağırlıklar daha düşük puan aldığı için geliştiriciler bunu yanıltıcı buldu
- Uzun bağlam iddiaları pratikte çöküyor: Scout, Fiction.LiveBench'te 128K'da ~%15.6 aldı, Gemini 2.5 Pro'nun %90.6'sına karşı; barındıran sağlayıcılar Scout'u 10M'nin çok altında sınırlıyor (ör. DeepInfra'da ~320K)
- Kodlama r/LocalLlama ve HN'de sert eleştirildi; gerçek geliştirme görevlerinde benzer fiyatlı DeepSeek V3'e kaybediyor
- OSI anlamında açık kaynak değil: lisans AB merkezli şirketleri dışlıyor, 700M MAU üzerinde özel lisans istiyor ve Llama markalamasını zorunlu kılıyor
- Toplam 109B/400B parametre tüketici GPU'ları için fazla büyük ve seri durdu: reasoning varyantı hiç çıkmadı, Behemoth hiç yayımlanmadı
GPT-5.2
- Çıkışta 80.0% SWE-bench Verified ve 55.6% SWE-Bench Pro, Claude Opus 4.5 (80.9%) ile neredeyse başa baş
- GDPval: karşılaştırmaların %70.9'unda insan profesyonellerle berabere kalıyor veya onları geçiyor, GPT-5.1'in %38.8'inin neredeyse iki katı
- Güçlü bilim ve matematik: 92.4% GPQA Diamond (Thinking, Pro'da 93.2%) ve 40.3% FrontierMath, çıkışında son teknoloji
- 400K bağlam ve 256K tokene kadar neredeyse kusursuz MRCR v2 uzun bağlam getirimi
- GPT-5.1'e göre %30 daha az halüsinasyon (gerçek ChatGPT sorgularında hata oranı %8.8'den %6.2'ye düştü)
- Haleflerinden daha ucuz: 1M başına $1.75/$14, GPT-5.4'ün $2.50/$15'ine ve GPT-5.5'in $5/$30'una karşı
- Hız, topluluğun bir numaralı şikayeti: ChatGPT'de genişletilmiş düşünmenin ~4 token/sn'ye kadar düştüğü bildiriliyor ve Pro çok uzun süre düşünüp yine de başarısız olabiliyor
- Manşetteki benchmark skorları, varsayılan ayarlardan çok daha fazla token ve zaman tüketen xhigh akıl yürütme effort'unda elde edildi
- GPT-5.1'e göre yaygın biçimde eleştirilen kişilik gerilemesi: Reddit kullanıcıları sohbet ve yazarlık için 'fazla kurumsal, fazla güvenli' ve 'geriye doğru bir adım' dedi
- Kodlama, birebir Elo karşılaştırmalarında Anthropic serisinin gerisinde (sonraki bir Opus 4.7 analizi 144 Elo fark gösterdi); ses modalitesi yok, ince ayar yok
- 2026 ortası itibarıyla zaten geride kaldı: OpenAI GPT-5.5'i öneriyor ve GPT-5.2 ana API fiyat sayfasında artık görünmüyor
Hükmünüzü verin
Gladyatör başına, araç başına bir tavsiye. Herkesin gördüğü kalabalık puanını yeniden şekillendirir.
Arenanın Llama 4 (Scout / Maverick) hakkındaki hükmü
AB dışında yüksek hacimli sohbet, veri çıkarma veya çok dilli iş yükleri için ucuz, hızlı, kendi sunucunuzda barındırılabilir çok modlu bir model gerekiyorsa Llama 4'ü seçin; Maverick, kabaca onda bir fiyata GPT-4o kalitesine yaklaşıyor. Kodlama, zorlu akıl yürütme veya gerçek milyon tokenlik getirim için uzak durun; DeepSeek, Qwen 3 ve Gemini oralarda açık ara daha iyi. Llama 3.3 70B'ye göre yerleşik görü ve daha uzun pencere ekliyor ama birçok geliştirici salt metin kalitesi için eski yoğun modeli veya Qwen'i daha güvenilir buldu ve 10M bağlam büyük ölçüde kağıt üzerinde bir rakam.
Arenanın GPT-5.2 hakkındaki hükmü
Ağır akıl yürütme, uzun bağlam veya ajan işleri için GPT-5.2'yi GPT-5.1'e tercih edin: GDPval kazanma oranını neredeyse ikiye katlıyor, halüsinasyonları %30 azaltıyor ve 400K bağlamları güvenilir şekilde işliyor. 2026 ortasında esasen bir fiyat/fayda hamlesi: GPT-5.5'in $5/$30'una karşı $1.75/$14 fiyatla çoğu profesyonel görevde yetkin kalıyor. Kullanıcıların yavaş ve GPT-5.1'den daha yavan bulduğu gecikmeye duyarlı sohbet ve yaratıcı yazarlık için uzak durun. OpenAI'ın güncel sınır modelini isteyen ekipler bunun yerine GPT-5.5'e para vermeli.
Kalabalık ne diyor
Llama 4 (Scout / Maverick) hakkında
Henüz hüküm yok. İlk konuşan siz olun.
GPT-5.2 hakkında
“The thinking speed is brutal, I clocked something like 4 tok/s in ChatGPT on extended thinking. Pro will grind for ages and still whiff. Great scores, painful to actually use.”
“GDPval numbers are wild, it ties or beats human pros in 71% of comparisons. For science and math work (92.4 GPQA Diamond) it earned a spot in my stack.”
Karşılaştırmaya devam edin
Sık sorulan sorular
Llama 4 (Scout / Maverick), GPT-5.2 aracından daha mı iyi?
Akıl yürütme tarafında GPT-5.2 daha yüksek puan alıyor (4/5 vs 2.5/5). Doğru seçim kullanım amacınıza bağlı. Bu sayfadaki satır satır karşılaştırma; fiyatlandırmayı, temel özellikleri ve arena puanlarını ayrıntılarıyla ele alıyor.
Hangisi daha ucuz, Llama 4 (Scout / Maverick) mı GPT-5.2 mi?
Llama 4 (Scout / Maverick) daha ucuz: $0.60/1M out (Maverick, hosted) seviyesinden başlıyor, GPT-5.2 ise $14/1M out seviyesinden başlıyor.
Llama 4 (Scout / Maverick) ve GPT-5.2 1M token başına ne kadar tutuyor?
Llama 4 (Scout / Maverick): 1M girdi tokeni başına $0.15/1M in (Maverick, hosted), 1M çıktı tokeni başına $0.60/1M out (Maverick, hosted). GPT-5.2: 1M girdi tokeni başına $1.75/1M in, 1M çıktı tokeni başına $14/1M out.