Arena · yapay zeka modeli incelemesi

Kimi K3

Moonshot AI tarafından

Moonshot'un 2,8 trilyon parametreli MoE modeli 'yeni DeepSeek anı'nı tetikledi: $3/$15 fiyatına sınıra yakın puanlar

Arena puanı 3.7/5%57 tavsiye · 3 oy
Akıl yürütme4.5
Kodlama4.5
Yazarlık4.0
Hız2.0
Fiyat/performans3.5
Kimi K3 sitesini ziyaret etABD bulut sağlayıcıları dışında sınır düzeyinde kodlama ve ajanlarfrontend üretimi (Arena.ai sıralamasının zirvesinde)SaaS iş akışı otomasyonu ve araç orkestrasyonu3 trilyon parametre sınıfında açık ağırlıkları kendi kendine barındırmayı planlayan ekipler
Fiyat

$15/1M out

kimi-k3 için resmi Moonshot API liste fiyatı: 1M girdi için $3 (önbellek ıskalaması), önbellek isabetinde 1M için $0,30, akıl yürütme izini de içeren 1M çıktı için $15, 1M bağlam boyunca sabit (uzunluğa göre kademe yok). OpenRouter'da da aynı $3/$15 geçerli (orada önbellek fiyatlandırması gösterilmiyor). Kimi K2.6'nın $0,95/$4 fiyatına kıyasla 3 kat artış. platform.kimi.ai/docs/pricing/chat-k3 referans alınarak Temmuz 2026'da doğrulandı.

Sağlayıcı

Moonshot AI

Bağlam penceresi

1M tokens

Girdi fiyatı

$3/1M in

Çıktı fiyatı

$15/1M out

Modaliteler

text, vision, video input

Open weights

Hayır

Kimi K3 nedir?

16.07.2026 tarihinde Pekin merkezli Moonshot AI tarafından yayınlandı ve Şanghay'daki World AI Conference'ta tanıtıldı. Kimi K3, 1M token bağlam penceresine ve metin, görsel ve video girdisini yerel olarak destekleyen 2,8 trilyon parametreli bir Mixture-of-Experts modeli (896 uzman, token başına 16 aktif). API kimliği kimi-k3, tüm bağlam penceresi boyunca sabit olan 1M girdi için $3 (önbellek isabetinde $0,30) ve 1M çıktı için $15 fiyatına, ayrıca OpenRouter üzerinden de sunuluyor. Piyasaya çıkışta Artificial Analysis Intelligence Index'te 3. sıraya ulaştı; Claude Opus 4.8 ve GPT-5.5 ile karşılaştırılabilir bu sonuç, 'yeni DeepSeek anı' başlıklarına ve yarı iletken sektöründe satış dalgasına yol açtı. Açık ağırlıklar (yaklaşık 594 GB, MXFP4) 27.07.2026 için duyuruldu; bu fişin hazırlandığı sırada henüz yayınlanmamıştı ve Modified-MIT tarzı bir lisans bekleniyor ama henüz teyit edilmedi.

Kimi K3 artıları ve eksileri

Artılar

  • Piyasaya çıkışta Artificial Analysis Intelligence Index'te (57 puan) 3. sırada, Claude Opus 4.8 ve GPT-5.5 ile karşılaştırılabilir: bir Çinli laboratuvarın kapalı ABD sınırına şimdiye kadarki en yakın yaklaşımı
  • Vals AI'nin bağımsız test ortamında SWE-bench Verified'da %93,4 (GPT-5.6 Sol: %96,2, Claude Fable 5: %95,0) ve Arena.ai'nin Frontend Code Arena'sında 1679 puanla 1. sırada, Fable 5'in önünde
  • GPQA Diamond'da %93,5 (Fable 5'in %92,6'sı ile GPT-5.6'nın %94,1'i arasında), AIME 2025'te %96,1 ve GDPval-AA v2 ajan işinde Elo 1668 ile yalnızca Fable 5'in gerisinde
  • Güçlü bir ajan profili: AutomationBench-AA SaaS iş akışlarında (%53) 1. sırada, Kimi Code aracılığıyla uzun ufuklu terminal ve depo gezinmesi ve K2'ye kıyasla daha fazla zeka için yaklaşık %21 daha az çıktı tokeni
  • 1M token başına $3/$15 (önbellek isabetinde girdi fiyatı $0,30'a düşüyor), tüm 1M bağlam boyunca sabit: yine de kapalı ABD sınır modeli fiyatlarının oldukça altında, OpenAI uyumlu bir API ve OpenRouter erişilebilirliğiyle
  • Yerel çok modlu girdi (metin, görsel, video) ve 27.07.2026 için beklenen Modified-MIT tarzı bir lisans altında duyurulan açık ağırlıklar, modeli 3 trilyon parametre sınıfında açık ağırlıklı ilk sınır model olarak konumlandırıyor

Eksiler

  • Kimi K2.6'ya kıyasla 3 kat fiyat artışı ($0,95/$4'ten $3/$15'e) modeli Claude Sonnet 5 liste fiyatı seviyesinde, şimdiye kadar piyasaya sürülmüş en pahalı Çin modeli yapıyor: 'ABD modellerinden 10 kat ucuz' dönemi sona erdi (artışı Simon Willison belgeledi)
  • Yavaş: saniyede 33 çıktı tokeni, Artificial Analysis'te 190 model arasında 145. sırada, etkileşimli kullanım için zayıf bir seçim
  • Halüsinasyon oranı AA-Omniscience'ta %39'dan (K2.6) %51'e yükseldi; çünkü model artık daha önce reddettiği sorulara yanıt vermeye çalışıyor (Fable 5 karşılaştırılabilir bir oran olan %54,9'da)
  • Mandarin dilinde hassas konularda siyasi sansür (Xi, ÇKP, Tiananmen konularında kaçınma) ve API verileri için Pekin yargı yetkisi, birçok AB ve kurumsal dağıtım için bir uyumluluk engeli oluşturuyor; İngiltere'nin AISI/CAISI kurumu da test sırasında modelin siber koruma önlemlerinin exploit geliştirme girişimlerini engellemede başarısız olduğunu tespit etti
  • 'Açık ağırlıklar' çoğu kullanıcı için şimdilik teorik kalıyor: yerel MXFP4 formatında yaklaşık 594 GB, kendi kendine barındırma için çoklu GPU'lu bir veri merkezi gerektiriyor ve ağırlıklar (nihai lisansla birlikte) bu inceleme sırasında hâlâ yayınlanmamıştı

Arenanın hükmü

Kimi K3, sınırın artık yalnızca Amerikan olmadığının şimdiye kadarki en güçlü kanıtı: Artificial Analysis'te 3. sıra, üst düzey GPQA ve SWE-bench Verified puanları ve sektördeki en iyi frontend kod arenası sıralaması, ABD'nin kapalı sınır fiyatlarının kabaca yarısı ile üçte biri arasında bir fiyata. Kıyaslamalarının en güçlü olduğu ajan tabanlı kodlama, frontend çalışması ve SaaS otomasyonu için, ya da yol haritası ağırlıklar yayınlandıktan sonra sınır sınıfı bir modeli kendi kendine barındırmaya bağlıysa tercih edilebilir. Etkileşimli ürünler için (saniyede 33 token yavaştır), siyasi açıdan hassas içerik veya sıkı AB veri yerelliği gereksinimleri içeren her şey için (Mandarin dilinde sansür, Pekin yargı yetkisi) ve AA-Omniscience'taki %51'lik halüsinasyon oranının bir doğrulama katmanı gerektirdiği yüksek doğruluklu erişim işleri için tercih edilmemeli. Maliyet odaklı ekipler, DeepSeek V4'ün hâlâ dolar başına çok daha fazla token sunduğunu unutmamalı; K3'ün iddiası dolar başına en yüksek yetenek, en ucuz token değil.

Başparmak yukarı ya da aşağı

Hükmünüzü verin

Kimi K3 aracını tavsiye eder misiniz, yoksa kalabalığı uyarır mısınız?

57%kalabalık puanı · 3

En iyi Kimi K3 alternatifleri

Tüm alternatifler
1
Claude Haiku 4.5

Anthropic'in en hızlı modeli: Sonnet 4.5'in kodlama becerisinin yaklaşık %90'ı, 1M token başına $1/$5, 200K bağlam.

$5/1M out67%(2)
Visit
2
Claude Opus 5

Anthropic'in Temmuz 2026 Opus yenilemesi: Fable 5'e yakın zeka, yarı fiyatına, Opus 4.8 ile aynı $5/$25 fiyatlandırmasıyla

$25/1M out63%(4)
Visit
3
Claude Fable 5

Anthropic'in Haziran 2026 Mythos sınıfı amiral gemisi: SWE-bench Pro'da 80.3%, diğer tüm sınır modellerden 11 puan önde

$50/1M out63%(4)
Visit

Kimi K3 birebir karşılaştırmaları

Kalabalık ne diyor

Kaptan Churn

Tried it for our knowledge-base assistant and the hallucination rate is real: it confidently invented two API endpoints in one afternoon. 33 tokens per second on top of that. Back to waiting for the open weights to fine-tune.

Altın Başparmakus

Our Zapier-style automation stack runs on it now. Tool orchestration that GPT-5.5 fumbled works reliably, and the cache-hit pricing makes repeated workflows genuinely cheap.

Aziz Deployus

The Frontend Arena ranking is deserved. Gave it the same dashboard spec I gave Fable 5 and K3's React came out cleaner, with fewer invented props. At $3/$15 through OpenRouter it was a drop-in swap.

Kimi K3: sık sorulan sorular

Kimi K3 1M token başına ne kadar tutuyor?

Kimi K3, 1M girdi tokeni başına $3/1M in ve 1M çıktı tokeni başına $15/1M out tutuyor. kimi-k3 için resmi Moonshot API liste fiyatı: 1M girdi için $3 (önbellek ıskalaması), önbellek isabetinde 1M için $0,30, akıl yürütme izini de içeren 1M çıktı için $15, 1M bağlam boyunca sabit (uzunluğa göre kademe yok). OpenRouter'da da aynı $3/$15 geçerli (orada önbellek fiyatlandırması gösterilmiyor). Kimi K2.6'nın $0,95/$4 fiyatına kıyasla 3 kat artış. platform.kimi.ai/docs/pricing/chat-k3 referans alınarak Temmuz 2026'da doğrulandı.