Birebir düello

DeepSeek-V4 logosuvsKimi K3 logosu

DeepSeek-V4 vs Kimi K3: 2026'da hangi yapay zeka modeli kazanıyor?

DeepSeek-V4 ($0.87/1M out) ve Kimi K3 ($15/1M out), 2026'nın en çok kullanılan yapay zeka modelleri arasında. 6 topluluk oyunda DeepSeek-V4, %57 onayla önde.

Hızlı hüküm

Akıl yürütme tarafında DeepSeek-V4 ve Kimi K3, 4.5/5 ile berabere. Bütçe tarafında DeepSeek-V4 kazanıyor: Kimi K3 için $15/1M out yerine $0.87/1M out seviyesinden başlıyor.

Satır satır karşılaştırma

Başlangıç
$0.87/1M outV4-Pro katmanı: $0.435/1M girdi ($0.003625 önbellek isabeti), $0.87/1M çıktı; daha ucuz V4-Flash katmanı $0.14/$0.28 ($0.0028 önbellek isabeti); %75'lik çıkış indirimi 2026-05-22'de kalıcı fiyat oldu. 2026 Temmuz ortasındaki resmi sürüm, Pekin yoğun saatlerinde listelenen tarifelerin ikiye katlandığı yoğun/sakin saat fiyatlandırması getiriyor.
$15/1M outkimi-k3 için resmi Moonshot API liste fiyatı: 1M girdi için $3 (önbellek ıskalaması), önbellek isabetinde 1M için $0,30, akıl yürütme izini de içeren 1M çıktı için $15, 1M bağlam boyunca sabit (uzunluğa göre kademe yok). OpenRouter'da da aynı $3/$15 geçerli (orada önbellek fiyatlandırması gösterilmiyor). Kimi K2.6'nın $0,95/$4 fiyatına kıyasla 3 kat artış. platform.kimi.ai/docs/pricing/chat-k3 referans alınarak Temmuz 2026'da doğrulandı.
Sağlayıcı
DeepSeek
Moonshot AI
Bağlam penceresi
1M tokens (384K max output)
1M tokens
Girdi fiyatı
$0.435/1M in (cache hit $0.003625)
$3/1M in
Çıktı fiyatı
$0.87/1M out
$15/1M out
Modaliteler
text only
text, vision, video input
Open weights
Evet
Hayır
Kalabalık puanı
57%(3)
57%(3)
Arena puanları (1-5)
Akıl yürütme
4.5
4.5
Kodlama
4.5
4.5
Yazarlık
3.5
4.0
Hız
3.0
2.0
Fiyat/performans
5.0
3.5

Güçlü ve zayıf yönler

DeepSeek-V4

  • 1M token bağlam penceresi (V3.2'nin 128K'sının 8 katı) ve 384K'ya kadar çıktı tokeni, resmi API'de standart
  • Agresif fiyatlandırma: 1M token başına $0.435/$0.87 (V4-Pro), çıktı tokeni başına Claude Opus 4.8'den kabaca 28.7 kat ucuz; önbellek isabetli girdi $0.003625/1M'ye düşüyor (%99'un üzerinde indirim)
  • Hem V4-Pro hem V4-Flash için Hugging Face'te MIT lisanslı open weights: ticari kullanım, ince ayar ve yeniden dağıtım serbest
  • Ajan kodlamada açık kaynak SOTA: SWE-bench Verified'da 80.6 (Think Max yapılandırması), Gemini 3.1 Pro ile berabere, artı Codeforces puanı 3206 (insanlara karşı ~23. sıra)
  • Artificial Analysis Intelligence Index'te 93 model arasında 3. sıra (skor 44), 25'lik ortalamanın epey üzerinde
  • Seyrek dikkat yığını, 1M bağlamlı çıkarımı V3.2'nin FLOP'larının %27'sine ve KV önbelleğinin %10'una indiriyor
  • Aralıklı bozuk araç çağrıları: fonksiyon çağrıları bazen tool_calls alanı yerine içerikte düz metin olarak üretiliyor (GitHub issue deepseek-ai #1244)
  • Düşünme modu, ajan çerçevelerinde uzun çok turlu araç çağrısı zincirlerini 400 hatalarıyla bozuyor (OpenClaw issue #72044, düzeltme hala eksik)
  • Geliştiriciler, özel kod tabanlarında var olmayan API'ler uydurduğunu ve ajan döngülerinde halüsinasyon ürünü kullanıcı girdisine göre hareket ettiğini bildiriyor
  • Çok uzun yazıyor (95M medyana karşı 180M değerlendirme çıktı tokeni) ve orta sıralarda hız: 54.6 token/sn (93 modelde 39. sıra), bu da düşük token fiyatını pratikte aşındırıyor
  • Yalnızca metin (görü veya ses yok) ve hala önizleme: 2026 Temmuz ortasına planlanan resmi sürüm, Pekin mesai saatlerinde listelenen API tarifelerini ikiye katlayan yoğun saat fiyatlandırması ekliyor

Kimi K3

  • Piyasaya çıkışta Artificial Analysis Intelligence Index'te (57 puan) 3. sırada, Claude Opus 4.8 ve GPT-5.5 ile karşılaştırılabilir: bir Çinli laboratuvarın kapalı ABD sınırına şimdiye kadarki en yakın yaklaşımı
  • Vals AI'nin bağımsız test ortamında SWE-bench Verified'da %93,4 (GPT-5.6 Sol: %96,2, Claude Fable 5: %95,0) ve Arena.ai'nin Frontend Code Arena'sında 1679 puanla 1. sırada, Fable 5'in önünde
  • GPQA Diamond'da %93,5 (Fable 5'in %92,6'sı ile GPT-5.6'nın %94,1'i arasında), AIME 2025'te %96,1 ve GDPval-AA v2 ajan işinde Elo 1668 ile yalnızca Fable 5'in gerisinde
  • Güçlü bir ajan profili: AutomationBench-AA SaaS iş akışlarında (%53) 1. sırada, Kimi Code aracılığıyla uzun ufuklu terminal ve depo gezinmesi ve K2'ye kıyasla daha fazla zeka için yaklaşık %21 daha az çıktı tokeni
  • 1M token başına $3/$15 (önbellek isabetinde girdi fiyatı $0,30'a düşüyor), tüm 1M bağlam boyunca sabit: yine de kapalı ABD sınır modeli fiyatlarının oldukça altında, OpenAI uyumlu bir API ve OpenRouter erişilebilirliğiyle
  • Yerel çok modlu girdi (metin, görsel, video) ve 27.07.2026 için beklenen Modified-MIT tarzı bir lisans altında duyurulan açık ağırlıklar, modeli 3 trilyon parametre sınıfında açık ağırlıklı ilk sınır model olarak konumlandırıyor
  • Kimi K2.6'ya kıyasla 3 kat fiyat artışı ($0,95/$4'ten $3/$15'e) modeli Claude Sonnet 5 liste fiyatı seviyesinde, şimdiye kadar piyasaya sürülmüş en pahalı Çin modeli yapıyor: 'ABD modellerinden 10 kat ucuz' dönemi sona erdi (artışı Simon Willison belgeledi)
  • Yavaş: saniyede 33 çıktı tokeni, Artificial Analysis'te 190 model arasında 145. sırada, etkileşimli kullanım için zayıf bir seçim
  • Halüsinasyon oranı AA-Omniscience'ta %39'dan (K2.6) %51'e yükseldi; çünkü model artık daha önce reddettiği sorulara yanıt vermeye çalışıyor (Fable 5 karşılaştırılabilir bir oran olan %54,9'da)
  • Mandarin dilinde hassas konularda siyasi sansür (Xi, ÇKP, Tiananmen konularında kaçınma) ve API verileri için Pekin yargı yetkisi, birçok AB ve kurumsal dağıtım için bir uyumluluk engeli oluşturuyor; İngiltere'nin AISI/CAISI kurumu da test sırasında modelin siber koruma önlemlerinin exploit geliştirme girişimlerini engellemede başarısız olduğunu tespit etti
  • 'Açık ağırlıklar' çoğu kullanıcı için şimdilik teorik kalıyor: yerel MXFP4 formatında yaklaşık 594 GB, kendi kendine barındırma için çoklu GPU'lu bir veri merkezi gerektiriyor ve ağırlıklar (nihai lisansla birlikte) bu inceleme sırasında hâlâ yayınlanmamıştı

Hükmünüzü verin

Gladyatör başına, araç başına bir tavsiye. Herkesin gördüğü kalabalık puanını yeniden şekillendirir.

DeepSeek-V4$0.87/1M out
57%kalabalık puanı · 3
Kimi K3$15/1M out
57%kalabalık puanı · 3

Arenanın DeepSeek-V4 hakkındaki hükmü

Claude Opus veya GPT-5.5 fiyatlarının 3 ila yaklaşık 30 kat altında, sınıra yakın akıl yürütme ve ajan kodlama istiyorsanız ya da kendi sunucunuzda barındırma ve ince ayar için MIT lisanslı ağırlıklar sizin için önemliyse DeepSeek-V4'ü seçin. V3.2'ye göre kesin bir yükseltme: 8 kat daha uzun bağlam, çok daha ucuz uzun bağlam çıkarımı ve daha güçlü kodlama; eski deepseek-chat/reasoner uç noktaları zaten 24 Temmuz 2026'da kullanımdan kalkıyor. Kaya gibi sağlam çok turlu araç çağrısına bağımlı üretim ajanları için uzak durun; kullanıcılar hala bozuk araç çağrıları ve uydurulmuş API'ler bildiriyor. Görü veya ses işleri için de uygun değil, çünkü yalnızca metin. Gecikmeye duyarlı uygulamalar önce test etmeli; uzun yazma eğilimi ve orta sıradaki 54.6 token/sn çıktı hızı maliyet avantajının bir kısmını törpülüyor. Temmuz ortasındaki resmi sürümle gelecek yoğun saat fiyat katlanmasına da bütçe ayırın.

Arenanın Kimi K3 hakkındaki hükmü

Kimi K3, sınırın artık yalnızca Amerikan olmadığının şimdiye kadarki en güçlü kanıtı: Artificial Analysis'te 3. sıra, üst düzey GPQA ve SWE-bench Verified puanları ve sektördeki en iyi frontend kod arenası sıralaması, ABD'nin kapalı sınır fiyatlarının kabaca yarısı ile üçte biri arasında bir fiyata. Kıyaslamalarının en güçlü olduğu ajan tabanlı kodlama, frontend çalışması ve SaaS otomasyonu için, ya da yol haritası ağırlıklar yayınlandıktan sonra sınır sınıfı bir modeli kendi kendine barındırmaya bağlıysa tercih edilebilir. Etkileşimli ürünler için (saniyede 33 token yavaştır), siyasi açıdan hassas içerik veya sıkı AB veri yerelliği gereksinimleri içeren her şey için (Mandarin dilinde sansür, Pekin yargı yetkisi) ve AA-Omniscience'taki %51'lik halüsinasyon oranının bir doğrulama katmanı gerektirdiği yüksek doğruluklu erişim işleri için tercih edilmemeli. Maliyet odaklı ekipler, DeepSeek V4'ün hâlâ dolar başına çok daha fazla token sunduğunu unutmamalı; K3'ün iddiası dolar başına en yüksek yetenek, en ucuz token değil.

Kalabalık ne diyor

DeepSeek-V4 hakkında

Başparmak Aşağıcus

Tool calling is flaky. Function calls sometimes land as plain text instead of the tool_calls field, and thinking mode 400s on long multi-turn chains. Not agent-ready yet.

Adil Yorumcu

MIT license on both Pro and Flash weights is the real story. Fine-tune, redistribute, ship commercially, no lawyer needed. Plus 384K output tokens for long-doc generation.

Sör Durmadan Yayınlar

MIT weights, 1M context, and output tokens roughly 29x cheaper than Opus 4.8. Cache hits make input basically free. Moved my bulk pipelines over and the bill collapsed.

Kimi K3 hakkında

Kaptan Churn

Tried it for our knowledge-base assistant and the hallucination rate is real: it confidently invented two API endpoints in one afternoon. 33 tokens per second on top of that. Back to waiting for the open weights to fine-tune.

Altın Başparmakus

Our Zapier-style automation stack runs on it now. Tool orchestration that GPT-5.5 fumbled works reliably, and the cache-hit pricing makes repeated workflows genuinely cheap.

Aziz Deployus

The Frontend Arena ranking is deserved. Gave it the same dashboard spec I gave Fable 5 and K3's React came out cleaner, with fewer invented props. At $3/$15 through OpenRouter it was a drop-in swap.

Sık sorulan sorular

DeepSeek-V4, Kimi K3 aracından daha mı iyi?

Doğru seçim kullanım amacınıza bağlı. Bu sayfadaki satır satır karşılaştırma; fiyatlandırmayı, temel özellikleri ve arena puanlarını ayrıntılarıyla ele alıyor.

Hangisi daha ucuz, DeepSeek-V4 mı Kimi K3 mi?

DeepSeek-V4 daha ucuz: $0.87/1M out seviyesinden başlıyor, Kimi K3 ise $15/1M out seviyesinden başlıyor.

DeepSeek-V4 ve Kimi K3 1M token başına ne kadar tutuyor?

DeepSeek-V4: 1M girdi tokeni başına $0.435/1M in (cache hit $0.003625), 1M çıktı tokeni başına $0.87/1M out. Kimi K3: 1M girdi tokeni başına $3/1M in, 1M çıktı tokeni başına $15/1M out.