一騎打ち

Kimi K3 のロゴvsDeepSeek-V4 のロゴ

Kimi K3 vs DeepSeek-V4:2026年に勝つAIモデルはどっち?

Kimi K3($15/1M out)と DeepSeek-V4($0.87/1M out)は、2026年に最も使われているAIモデルのひとつです。 6件のコミュニティ票のうち、Kimi K3 が支持率57%でリードしています。

即断の評決

推論では、Kimi K3 と DeepSeek-V4 は4.5/5で互角です。 予算重視なら DeepSeek-V4 の勝ち:$0.87/1M outから始められるのに対し、Kimi K3 は$15/1M outからです。

項目別比較

最低価格
$15/1M outkimi-k3のMoonshot公式API定価は、入力100万トークンあたり3ドル(キャッシュミス時)、キャッシュヒット時は0.30ドル、出力100万トークンあたり15ドル(推論トレース込み)で、1Mトークンのコンテキスト全体で均一料金です(長さによる階層はありません)。OpenRouterでも同じ3ドル/15ドルですが、そちらではキャッシュ料金は公開されていません。これはKimi K2.6の0.95ドル/4ドルから3倍の値上げです。platform.kimi.ai/docs/pricing/chat-k3を基準に2026年7月時点で確認済みです。
$0.87/1M outV4-Proティア:入力$0.435/1M(キャッシュヒット$0.003625)、出力$0.87/1M。より安価なV4-Flashティアは$0.14/$0.28(キャッシュヒット$0.0028)。75%の発売割引は2026-05-22に恒久価格になりました。2026年7月中旬の正式リリースでピーク/オフピーク料金が導入され、北京のピーク時間帯は表示料金が2倍になります。
プロバイダー
Moonshot AI
DeepSeek
コンテキストウィンドウ
1M tokens
1M tokens (384K max output)
入力料金
$3/1M in
$0.435/1M in (cache hit $0.003625)
出力料金
$15/1M out
$0.87/1M out
モダリティ
text, vision, video input
text only
オープンウェイト
なし
あり
観客スコア
57%(3)
57%(3)
アリーナ評価(1-5)
推論
4.5
4.5
コーディング
4.5
4.5
ライティング
4.0
3.5
速度
2.0
3.0
コスパ
3.5
5.0

強みと弱み

Kimi K3

  • 発売時点でArtificial Analysis Intelligence Indexの第3位(スコア57)を獲得し、Claude Opus 4.8やGPT-5.5に匹敵する水準です。これは中国の研究機関が米国のクローズドなフロンティアモデルに最も近づいた事例といえます。
  • Vals AIの独立評価環境によるSWE-bench Verifiedで93.4%を記録し(GPT-5.6 Solは96.2%、Claude Fable 5は95.0%)、Arena.aiのFrontend Code Arenaでは1679ポイントでFable 5を上回り第1位を獲得しました。
  • GPQA Diamondでは93.5%を記録し(Fable 5の92.6%とGPT-5.6の94.1%の間)、AIME 2025では96.1%、GDPval-AA v2のエージェント作業評価ではEloレーティング1668でFable 5に次ぐ第2位となりました。
  • エージェント性能に優れており、AutomationBench-AAのSaaSワークフロー評価で53%を記録し第1位となりました。Kimi Codeを通じた長時間のターミナル操作やリポジトリ探索にも対応し、K2と比べて出力トークン数が約21%少ないにもかかわらず知能は向上しています。
  • 価格は100万トークンあたり3ドル/15ドルで(キャッシュヒット時の入力は0.30ドルまで下がります)、1Mトークンのコンテキスト全体で均一です。米国のクローズドなフロンティアモデルの価格よりも依然として大幅に安く、OpenAI互換APIを備え、OpenRouterでも利用できます。
  • テキスト、画像、動画のネイティブなマルチモーダル入力に対応し、2026年7月27日にはModified MIT形式(想定)のライセンスでオープンウェイトの公開が予定されており、初の3兆パラメータ級オープンウェイト・フロンティアモデルとなる見込みです。
  • Kimi K2.6(0.95ドル/4ドル)から3ドル/15ドルへと価格が3倍に上昇し、これまでにリリースされた中国製モデルの中で最も高価となり、Claude Sonnet 5の定価水準に達しています。「米国モデルより10倍安い」という時代は終わったといえ、Simon Willisonがこの値上げを詳しく記録しています。
  • 速度は遅く、出力は秒間33トークンで、Artificial Analysisの190モデル中145位にとどまり、対話的な用途には不向きです。
  • AA-Omniscienceにおける幻覚率はK2.6の39%から51%に上昇しました。これは以前なら回答を拒否していたであろう質問にも今回は答えを試みるようになったためです(Fable 5も同水準の54.9%です)。
  • 中国語での機微な話題(習近平、中国共産党、天安門事件など)に対する政治的検閲が存在し、APIデータの管轄も北京にあるため、多くのEU企業や規制対応が必要な導入先ではコンプライアンス上の障壁となります。さらに英国のAISI/CAISIによるテストでは、サイバーセキュリティのガードレールがエクスプロイト開発の試みを阻止できなかったことも確認されています。
  • 「オープンウェイト」とはいっても大半のユーザーにとっては理論上のものにすぎません。ネイティブMXFP4形式で約594GBあり、自前でホストするには複数GPUを備えたデータセンターが必要です。また本レビュー時点では、ウェイト本体と最終的なライセンスもまだ公開されていません。

DeepSeek-V4

  • 1M tokensのコンテキストウィンドウ(V3.2の128Kの8倍)と最大384Kの出力tokensが公式APIで標準です
  • 攻めの価格設定:$0.435/$0.87 per 1M tokens(V4-Pro)で、出力トークンあたりClaude Opus 4.8の約28.7分の1。キャッシュヒット入力は$0.003625/1M(99%超の割引)まで下がります
  • V4-ProとV4-Flashの両方がHugging FaceでMITライセンスのオープンウェイト:商用利用、ファインチューニング、再配布が可能です
  • エージェント型コーディングのオープンソースSOTA:SWE-bench Verifiedで80.6(Think Max構成)でGemini 3.1 Proと同点、Codeforcesレーティング3206(対人間で約23位相当)です
  • Artificial Analysis Intelligence Indexで93モデル中3位(スコア44)、平均の25を大きく上回ります
  • スパースアテンションのスタックにより、1Mコンテキスト推論をV3.2の27%のFLOPsと10%のKVキャッシュで実現します
  • 断続的に不正なツール呼び出し:function callがtool_callsフィールドではなくcontent内のプレーンテキストとして出力されることがあります(GitHub issue deepseek-ai #1244)
  • thinkingモードはエージェントフレームワークで長いマルチターンのツール呼び出しチェーンを400エラーで壊します(OpenClaw issue #72044、修正はまだ不完全)
  • 独自コードベースで実在しないAPIを捏造し、エージェントループ内でハルシネーションしたユーザー入力に基づいて行動するとの開発者報告があります
  • 非常に冗長(評価出力180M tokens、中央値は95M)で速度も中位の54.6 tok/s(93モデル中39位)のため、実運用では低い単価が目減りします
  • テキストのみ(ビジョン・音声なし)で、まだプレビュー段階:2026年7月中旬予定の正式リリースでは、北京の業務時間帯にAPI表示価格が2倍になるピーク料金が導入されます

あなたの審判を下す

1人につき各ツール1票。あなたの推薦が、みんなの見る観客スコアを動かします。

Kimi K3$15/1M out
57%観客スコア · 3
DeepSeek-V4$0.87/1M out
57%観客スコア · 3

Kimi K3 へのアリーナの評決

Kimi K3は、フロンティアがもはや米国だけのものではないことを示す最も強力な証拠です。Artificial Analysisで第3位、GPQAとSWE-bench Verifiedでもトップクラスのスコアを記録し、フロントエンドコード分野のアリーナ評価では業界最高位を獲得しながら、価格は米国のクローズドなフロンティアモデルのおよそ2分の1から3分の1にとどまります。ベンチマークが特に強いエージェント型コーディング、フロントエンド作業、SaaS自動化には向いており、ウェイト公開後にフロンティア級モデルを自前でホストする計画があるチームにも適しています。一方、対話型プロダクト(秒間33トークンは遅い)、政治的に機微な内容やEUの厳格なデータ所在地要件が絡む用途(中国語での検閲、北京の管轄)、そしてAA-Omniscienceでの幻覚率51%が検証レイヤーを必要とする高精度な検索用途には向きません。コストを最優先するチームは、DeepSeek V4が依然としてドルあたりのトークン量で圧倒的に優れている点に注意すべきです。K3が訴求するのはドルあたりの最安値ではなく、ドルあたりのピーク性能です。

DeepSeek-V4 へのアリーナの評決

Claude OpusやGPT-5.5の3倍から30倍近く安い価格でフロンティア級に迫る推論とエージェント型コーディングが欲しい場合、あるいはセルフホストとファインチューニングのためのMITライセンスウェイトが重要な場合は、DeepSeek-V4を選んでください。V3.2からは決定的なアップグレードです:8倍長いコンテキスト、はるかに安い長文コンテキスト推論、強化されたコーディング。しかもレガシーのdeepseek-chat/reasonerエンドポイントは2026年7月24日にいずれにせよ廃止されます。堅牢なマルチターンツール呼び出しに依存する本番エージェント(不正なツール呼び出しやAPI捏造の報告が続いています)と、テキストのみのためあらゆるビジョン・音声作業には避けてください。レイテンシ重視のアプリも事前テストを推奨します。冗長さと中位の54.6 tok/sの出力速度がコスト優位を一部相殺し、7月中旬の正式リリースで来るピーク時の価格倍増も予算に織り込むべきです。

観客の声

Kimi K3 について

解約隊長

Tried it for our knowledge-base assistant and the hallucination rate is real: it confidently invented two API endpoints in one afternoon. 33 tokens per second on top of that. Back to waiting for the open weights to fine-tune.

黄金の親指クス

Our Zapier-style automation stack runs on it now. Tool orchestration that GPT-5.5 fumbled works reliably, and the cache-hit pricing makes repeated workflows genuinely cheap.

聖デプロイウス

The Frontend Arena ranking is deserved. Gave it the same dashboard spec I gave Fable 5 and K3's React came out cleaner, with fewer invented props. At $3/$15 through OpenRouter it was a drop-in swap.

DeepSeek-V4 について

親指下げリクス

Tool calling is flaky. Function calls sometimes land as plain text instead of the tool_calls field, and thinking mode 400s on long multi-turn chains. Not agent-ready yet.

公正なる審判者

MIT license on both Pro and Flash weights is the real story. Fine-tune, redistribute, ship commercially, no lawyer needed. Plus 384K output tokens for long-doc generation.

リリース卿

MIT weights, 1M context, and output tokens roughly 29x cheaper than Opus 4.8. Cache hits make input basically free. Moved my bulk pipelines over and the bill collapsed.

よくある質問

Kimi K3 は DeepSeek-V4 より優れていますか?

最適な選択は用途次第です。このページの項目別比較で、料金、主要スペック、アリーナ評価を分解しています。

Kimi K3 と DeepSeek-V4、安いのはどちらですか?

DeepSeek-V4 の方が安く、$0.87/1M outから始められます。Kimi K3 は$15/1M outからです。

Kimi K3 と DeepSeek-V4 の100万トークンあたりの料金は?

Kimi K3:入力100万トークンあたり$3/1M in、出力100万トークンあたり$15/1M out。DeepSeek-V4:入力100万トークンあたり$0.435/1M in (cache hit $0.003625)、出力100万トークンあたり$0.87/1M out。