Birebir düello

Claude Haiku 4.5 logosuvsKimi K3 logosu

Claude Haiku 4.5 vs Kimi K3: 2026'da hangi yapay zeka modeli kazanıyor?

Claude Haiku 4.5 ($5/1M out) ve Kimi K3 ($15/1M out), 2026'nın en çok kullanılan yapay zeka modelleri arasında. 5 topluluk oyunda Claude Haiku 4.5, %67 onayla önde.

Hızlı hüküm

Akıl yürütme tarafında Kimi K3 seçin: arena onu Claude Haiku 4.5 için 3/5 puana karşı 4.5/5 olarak değerlendiriyor. Bütçe tarafında Claude Haiku 4.5 kazanıyor: Kimi K3 için $15/1M out yerine $5/1M out seviyesinden başlıyor.

Satır satır karşılaştırma

Başlangıç
$5/1M outTek katman: $1/1M girdi, $5/1M çıktı; prompt önbellek okumaları $0.10/1M (5 dk yazmaları $1.25/1M), Batch API %50 keser ($0.50/$2.50); uzun bağlam ek ücreti yok (maks. 200K).
$15/1M outkimi-k3 için resmi Moonshot API liste fiyatı: 1M girdi için $3 (önbellek ıskalaması), önbellek isabetinde 1M için $0,30, akıl yürütme izini de içeren 1M çıktı için $15, 1M bağlam boyunca sabit (uzunluğa göre kademe yok). OpenRouter'da da aynı $3/$15 geçerli (orada önbellek fiyatlandırması gösterilmiyor). Kimi K2.6'nın $0,95/$4 fiyatına kıyasla 3 kat artış. platform.kimi.ai/docs/pricing/chat-k3 referans alınarak Temmuz 2026'da doğrulandı.
Sağlayıcı
Anthropic
Moonshot AI
Bağlam penceresi
200K tokens
1M tokens
Girdi fiyatı
$1/1M in
$3/1M in
Çıktı fiyatı
$5/1M out
$15/1M out
Modaliteler
text, vision (input); text output
text, vision, video input
Open weights
Hayır
Hayır
Kalabalık puanı
67%(2)
57%(3)
Arena puanları (1-5)
Akıl yürütme
3.0
4.5
Kodlama
3.5
4.5
Yazarlık
3.0
4.0
Hız
4.5
2.0
Fiyat/performans
4.0
3.5

Güçlü ve zayıf yönler

Claude Haiku 4.5

  • SWE-bench Verified'da 73.3%, üçte bir fiyata Sonnet 4.5'in ajan kodlamasının yaklaşık %90'ı
  • Hızlı: Anthropic'e göre Sonnet 4 hızının 2 katından fazla, çıkış müşterileri Sonnet 4.5'ten 4-5 kat hızlı bildiriyor; Artificial Analysis ölçümüyle ~92-110 çıktı tokeni/sn
  • Geliştiriciler, ilgisiz koda dokunmayan isabetli ve yerelleşmiş kod düzenlemeleri bildiriyor; erken testlerde GPT-5 mini sınıfından daha iyi
  • Hem görsel girdiyi hem genişletilmiş düşünmeyi destekliyor, çıkışta bu fiyat katmanında ender
  • Çoklu ajan kurulumlarında işçi model olarak çok uygun (Sonnet/Opus planlar, paralel Haiku alt ajanları uygular)
  • $0.10/1M prompt önbellek okumaları ve %50 Batch API indirimi efektif maliyeti daha da düşürüyor
  • $5/1M çıktı, küçük bir model için pahalı: Gemini Flash ve GPT mini katmanları çıktı ağırlıklı görevlerde onu birkaç kat geride bırakıyor
  • 200K bağlam (Sonnet 5/Opus kardeşlerinin 1M'sine karşı) ve 64K maks. çıktı, büyük kod tabanı ve uzun çıktı işlerini sınırlıyor
  • Vasat alanlar arası akıl yürütme: kullanıcılar GPQA, MedQA, MMMU tarzı bilgi görevlerinde zayıf sonuçlar bildiriyor
  • Pratikte iş hacmi çok değişken (82-208 token/sn bildiriliyor) ve 7-8+ dakikalık uzun ajan oturumlarında kalite düşüyor
  • Bilgi kesim tarihi (Şubat 2025'e kadar güvenilir) 2026 ortası standartlarına göre eski

Kimi K3

  • Piyasaya çıkışta Artificial Analysis Intelligence Index'te (57 puan) 3. sırada, Claude Opus 4.8 ve GPT-5.5 ile karşılaştırılabilir: bir Çinli laboratuvarın kapalı ABD sınırına şimdiye kadarki en yakın yaklaşımı
  • Vals AI'nin bağımsız test ortamında SWE-bench Verified'da %93,4 (GPT-5.6 Sol: %96,2, Claude Fable 5: %95,0) ve Arena.ai'nin Frontend Code Arena'sında 1679 puanla 1. sırada, Fable 5'in önünde
  • GPQA Diamond'da %93,5 (Fable 5'in %92,6'sı ile GPT-5.6'nın %94,1'i arasında), AIME 2025'te %96,1 ve GDPval-AA v2 ajan işinde Elo 1668 ile yalnızca Fable 5'in gerisinde
  • Güçlü bir ajan profili: AutomationBench-AA SaaS iş akışlarında (%53) 1. sırada, Kimi Code aracılığıyla uzun ufuklu terminal ve depo gezinmesi ve K2'ye kıyasla daha fazla zeka için yaklaşık %21 daha az çıktı tokeni
  • 1M token başına $3/$15 (önbellek isabetinde girdi fiyatı $0,30'a düşüyor), tüm 1M bağlam boyunca sabit: yine de kapalı ABD sınır modeli fiyatlarının oldukça altında, OpenAI uyumlu bir API ve OpenRouter erişilebilirliğiyle
  • Yerel çok modlu girdi (metin, görsel, video) ve 27.07.2026 için beklenen Modified-MIT tarzı bir lisans altında duyurulan açık ağırlıklar, modeli 3 trilyon parametre sınıfında açık ağırlıklı ilk sınır model olarak konumlandırıyor
  • Kimi K2.6'ya kıyasla 3 kat fiyat artışı ($0,95/$4'ten $3/$15'e) modeli Claude Sonnet 5 liste fiyatı seviyesinde, şimdiye kadar piyasaya sürülmüş en pahalı Çin modeli yapıyor: 'ABD modellerinden 10 kat ucuz' dönemi sona erdi (artışı Simon Willison belgeledi)
  • Yavaş: saniyede 33 çıktı tokeni, Artificial Analysis'te 190 model arasında 145. sırada, etkileşimli kullanım için zayıf bir seçim
  • Halüsinasyon oranı AA-Omniscience'ta %39'dan (K2.6) %51'e yükseldi; çünkü model artık daha önce reddettiği sorulara yanıt vermeye çalışıyor (Fable 5 karşılaştırılabilir bir oran olan %54,9'da)
  • Mandarin dilinde hassas konularda siyasi sansür (Xi, ÇKP, Tiananmen konularında kaçınma) ve API verileri için Pekin yargı yetkisi, birçok AB ve kurumsal dağıtım için bir uyumluluk engeli oluşturuyor; İngiltere'nin AISI/CAISI kurumu da test sırasında modelin siber koruma önlemlerinin exploit geliştirme girişimlerini engellemede başarısız olduğunu tespit etti
  • 'Açık ağırlıklar' çoğu kullanıcı için şimdilik teorik kalıyor: yerel MXFP4 formatında yaklaşık 594 GB, kendi kendine barındırma için çoklu GPU'lu bir veri merkezi gerektiriyor ve ağırlıklar (nihai lisansla birlikte) bu inceleme sırasında hâlâ yayınlanmamıştı

Hükmünüzü verin

Gladyatör başına, araç başına bir tavsiye. Herkesin gördüğü kalabalık puanını yeniden şekillendirir.

67%kalabalık puanı · 2
Kimi K3$15/1M out
57%kalabalık puanı · 3

Arenanın Claude Haiku 4.5 hakkındaki hükmü

Anthropic yığınındaysanız ve düşük gecikmeyle, üçte bir fiyata Sonnet'e yakın kodlama kalitesi gerekiyorsa Haiku 4.5'i seçin: Haiku 3.5'e göre devasa bir sıçrama ve çoklu ajan hatlarında işçi model olarak mükemmel. Temmuz 2026 itibarıyla hala Anthropic'in güncel küçük modeli, dolayısıyla Claude tabanlı ürünler için varsayılan ucuz katman. Derin alanlar arası akıl yürütme, çok büyük kod tabanları (200K bağlam tavanı) veya salt token başına maliyet avcılığı için uzak durun; oralarda Gemini Flash ve GPT mini katmanları artık daha ucuz. Kalite hızdan önemli olduğunda Sonnet 5'e yükselin.

Arenanın Kimi K3 hakkındaki hükmü

Kimi K3, sınırın artık yalnızca Amerikan olmadığının şimdiye kadarki en güçlü kanıtı: Artificial Analysis'te 3. sıra, üst düzey GPQA ve SWE-bench Verified puanları ve sektördeki en iyi frontend kod arenası sıralaması, ABD'nin kapalı sınır fiyatlarının kabaca yarısı ile üçte biri arasında bir fiyata. Kıyaslamalarının en güçlü olduğu ajan tabanlı kodlama, frontend çalışması ve SaaS otomasyonu için, ya da yol haritası ağırlıklar yayınlandıktan sonra sınır sınıfı bir modeli kendi kendine barındırmaya bağlıysa tercih edilebilir. Etkileşimli ürünler için (saniyede 33 token yavaştır), siyasi açıdan hassas içerik veya sıkı AB veri yerelliği gereksinimleri içeren her şey için (Mandarin dilinde sansür, Pekin yargı yetkisi) ve AA-Omniscience'taki %51'lik halüsinasyon oranının bir doğrulama katmanı gerektirdiği yüksek doğruluklu erişim işleri için tercih edilmemeli. Maliyet odaklı ekipler, DeepSeek V4'ün hâlâ dolar başına çok daha fazla token sunduğunu unutmamalı; K3'ün iddiası dolar başına en yüksek yetenek, en ucuz token değil.

Kalabalık ne diyor

Claude Haiku 4.5 hakkında

Repo Muhafızı

The precise localized edits are the underrated feature. It fixes the line that needs fixing and leaves the rest alone. GPT mini class models keep rewriting half my file.

Vibe Şampiyonu

Haiku 4.5 gives me about 90% of Sonnet agentic coding at a third of the price, and it is fast enough that edit loops feel instant. My default for quick fixes now.

Kimi K3 hakkında

Kaptan Churn

Tried it for our knowledge-base assistant and the hallucination rate is real: it confidently invented two API endpoints in one afternoon. 33 tokens per second on top of that. Back to waiting for the open weights to fine-tune.

Altın Başparmakus

Our Zapier-style automation stack runs on it now. Tool orchestration that GPT-5.5 fumbled works reliably, and the cache-hit pricing makes repeated workflows genuinely cheap.

Aziz Deployus

The Frontend Arena ranking is deserved. Gave it the same dashboard spec I gave Fable 5 and K3's React came out cleaner, with fewer invented props. At $3/$15 through OpenRouter it was a drop-in swap.

Sık sorulan sorular

Claude Haiku 4.5, Kimi K3 aracından daha mı iyi?

Kalabalık şu anda Claude Haiku 4.5 tarafında: %67 tavsiye ediyor, Kimi K3 için bu oran %57 (5 oy). Akıl yürütme tarafında Kimi K3 daha yüksek puan alıyor (4.5/5 vs 3/5). Doğru seçim kullanım amacınıza bağlı. Bu sayfadaki satır satır karşılaştırma; fiyatlandırmayı, temel özellikleri ve arena puanlarını ayrıntılarıyla ele alıyor.

Hangisi daha ucuz, Claude Haiku 4.5 mı Kimi K3 mi?

Claude Haiku 4.5 daha ucuz: $5/1M out seviyesinden başlıyor, Kimi K3 ise $15/1M out seviyesinden başlıyor.

Claude Haiku 4.5 ve Kimi K3 1M token başına ne kadar tutuyor?

Claude Haiku 4.5: 1M girdi tokeni başına $1/1M in, 1M çıktı tokeni başına $5/1M out. Kimi K3: 1M girdi tokeni başına $3/1M in, 1M çıktı tokeni başına $15/1M out.