アリーナ · AIモデルレビュー

Kimi K3

開発:Moonshot AI

「新たなDeepSeekモーメント」を巻き起こしたMoonshotの2.8兆パラメータMoEモデルで、フロンティア級に迫るスコアを3ドル/15ドルで実現しています。

アリーナスコア 3.7/557%が推薦 · 3票
推論4.5
コーディング4.5
ライティング4.0
速度2.0
コスパ3.5
Kimi K3 のサイトへ米国クラウド以外でフロンティア級のコーディングやエージェントを運用したいチームフロントエンド生成(Arena.aiのリーダーボードで首位)SaaSワークフローの自動化やツールオーケストレーション3兆パラメータ級のオープンウェイトを自前でホストする予定のチーム
価格

$15/1M out

kimi-k3のMoonshot公式API定価は、入力100万トークンあたり3ドル(キャッシュミス時)、キャッシュヒット時は0.30ドル、出力100万トークンあたり15ドル(推論トレース込み)で、1Mトークンのコンテキスト全体で均一料金です(長さによる階層はありません)。OpenRouterでも同じ3ドル/15ドルですが、そちらではキャッシュ料金は公開されていません。これはKimi K2.6の0.95ドル/4ドルから3倍の値上げです。platform.kimi.ai/docs/pricing/chat-k3を基準に2026年7月時点で確認済みです。

プロバイダー

Moonshot AI

コンテキストウィンドウ

1M tokens

入力料金

$3/1M in

出力料金

$15/1M out

モダリティ

text, vision, video input

オープンウェイト

なし

Kimi K3 とは?

北京拠点のMoonshot AIにより2026年7月16日にリリースされ、上海で開催されたWorld AI Conferenceで発表されました。Kimi K3は2.8兆パラメータのMixture-of-Expertsモデルで(896のエキスパートのうち1トークンあたり16個が活性化)、1Mトークンのコンテキストウィンドウを持ち、テキスト、画像、動画をネイティブに入力できます。API IDはkimi-k3で、価格は入力100万トークンあたり3ドル(キャッシュヒット時は0.30ドル)、出力100万トークンあたり15ドルで、コンテキストウィンドウ全体を通じて均一料金であり、OpenRouterでも利用できます。発売時点でArtificial Analysis Intelligence Indexの第3位に達し、Claude Opus 4.8やGPT-5.5に匹敵する水準となったことで「新たなDeepSeekモーメント」という見出しと半導体株の急落を引き起こしました。オープンウェイト(約594GB、MXFP4形式)は2026年7月27日に公開予定と発表されていますが、本フィッシュ作成時点ではまだ公開されておらず、Modified MIT形式のライセンスが想定されているものの未確定です。

Kimi K3 の長所と短所

長所

  • 発売時点でArtificial Analysis Intelligence Indexの第3位(スコア57)を獲得し、Claude Opus 4.8やGPT-5.5に匹敵する水準です。これは中国の研究機関が米国のクローズドなフロンティアモデルに最も近づいた事例といえます。
  • Vals AIの独立評価環境によるSWE-bench Verifiedで93.4%を記録し(GPT-5.6 Solは96.2%、Claude Fable 5は95.0%)、Arena.aiのFrontend Code Arenaでは1679ポイントでFable 5を上回り第1位を獲得しました。
  • GPQA Diamondでは93.5%を記録し(Fable 5の92.6%とGPT-5.6の94.1%の間)、AIME 2025では96.1%、GDPval-AA v2のエージェント作業評価ではEloレーティング1668でFable 5に次ぐ第2位となりました。
  • エージェント性能に優れており、AutomationBench-AAのSaaSワークフロー評価で53%を記録し第1位となりました。Kimi Codeを通じた長時間のターミナル操作やリポジトリ探索にも対応し、K2と比べて出力トークン数が約21%少ないにもかかわらず知能は向上しています。
  • 価格は100万トークンあたり3ドル/15ドルで(キャッシュヒット時の入力は0.30ドルまで下がります)、1Mトークンのコンテキスト全体で均一です。米国のクローズドなフロンティアモデルの価格よりも依然として大幅に安く、OpenAI互換APIを備え、OpenRouterでも利用できます。
  • テキスト、画像、動画のネイティブなマルチモーダル入力に対応し、2026年7月27日にはModified MIT形式(想定)のライセンスでオープンウェイトの公開が予定されており、初の3兆パラメータ級オープンウェイト・フロンティアモデルとなる見込みです。

短所

  • Kimi K2.6(0.95ドル/4ドル)から3ドル/15ドルへと価格が3倍に上昇し、これまでにリリースされた中国製モデルの中で最も高価となり、Claude Sonnet 5の定価水準に達しています。「米国モデルより10倍安い」という時代は終わったといえ、Simon Willisonがこの値上げを詳しく記録しています。
  • 速度は遅く、出力は秒間33トークンで、Artificial Analysisの190モデル中145位にとどまり、対話的な用途には不向きです。
  • AA-Omniscienceにおける幻覚率はK2.6の39%から51%に上昇しました。これは以前なら回答を拒否していたであろう質問にも今回は答えを試みるようになったためです(Fable 5も同水準の54.9%です)。
  • 中国語での機微な話題(習近平、中国共産党、天安門事件など)に対する政治的検閲が存在し、APIデータの管轄も北京にあるため、多くのEU企業や規制対応が必要な導入先ではコンプライアンス上の障壁となります。さらに英国のAISI/CAISIによるテストでは、サイバーセキュリティのガードレールがエクスプロイト開発の試みを阻止できなかったことも確認されています。
  • 「オープンウェイト」とはいっても大半のユーザーにとっては理論上のものにすぎません。ネイティブMXFP4形式で約594GBあり、自前でホストするには複数GPUを備えたデータセンターが必要です。また本レビュー時点では、ウェイト本体と最終的なライセンスもまだ公開されていません。

アリーナの評決

Kimi K3は、フロンティアがもはや米国だけのものではないことを示す最も強力な証拠です。Artificial Analysisで第3位、GPQAとSWE-bench Verifiedでもトップクラスのスコアを記録し、フロントエンドコード分野のアリーナ評価では業界最高位を獲得しながら、価格は米国のクローズドなフロンティアモデルのおよそ2分の1から3分の1にとどまります。ベンチマークが特に強いエージェント型コーディング、フロントエンド作業、SaaS自動化には向いており、ウェイト公開後にフロンティア級モデルを自前でホストする計画があるチームにも適しています。一方、対話型プロダクト(秒間33トークンは遅い)、政治的に機微な内容やEUの厳格なデータ所在地要件が絡む用途(中国語での検閲、北京の管轄)、そしてAA-Omniscienceでの幻覚率51%が検証レイヤーを必要とする高精度な検索用途には向きません。コストを最優先するチームは、DeepSeek V4が依然としてドルあたりのトークン量で圧倒的に優れている点に注意すべきです。K3が訴求するのはドルあたりの最安値ではなく、ドルあたりのピーク性能です。

親指を上げるか、下げるか

あなたの審判を下す

Kimi K3 を推薦しますか?それとも観客に警告しますか?

57%観客スコア · 3

Kimi K3 の代替ツールTOP

すべての代替ツール
1
Claude Haiku 4.5

Anthropic最速のモデル:Sonnet 4.5の約90%のコーディング力を$1/$5 per 1M tokensで、200Kコンテキスト。

$5/1M out67%(2)
Visit
2
Claude Opus 5

アンソロピックが2026年7月に投入したOpusシリーズの刷新版です。価格はOpus 4.8と同じ5ドル/25ドルのまま、Fable 5に迫る知能を実現しています。

$25/1M out63%(4)
Visit
3
Claude Fable 5

Anthropicの2026年6月Mythosクラスフラッグシップ:SWE-bench Proで80.3%、他のあらゆるフロンティアモデルに11ポイントの差

$50/1M out63%(4)
Visit

Kimi K3 を1対1で比較

観客の声

解約隊長

Tried it for our knowledge-base assistant and the hallucination rate is real: it confidently invented two API endpoints in one afternoon. 33 tokens per second on top of that. Back to waiting for the open weights to fine-tune.

黄金の親指クス

Our Zapier-style automation stack runs on it now. Tool orchestration that GPT-5.5 fumbled works reliably, and the cache-hit pricing makes repeated workflows genuinely cheap.

聖デプロイウス

The Frontend Arena ranking is deserved. Gave it the same dashboard spec I gave Fable 5 and K3's React came out cleaner, with fewer invented props. At $3/$15 through OpenRouter it was a drop-in swap.

Kimi K3:よくある質問

Kimi K3 の100万トークンあたりの料金は?

Kimi K3 の料金は、入力100万トークンあたり$3/1M in、出力100万トークンあたり$15/1M outです。 kimi-k3のMoonshot公式API定価は、入力100万トークンあたり3ドル(キャッシュミス時)、キャッシュヒット時は0.30ドル、出力100万トークンあたり15ドル(推論トレース込み)で、1Mトークンのコンテキスト全体で均一料金です(長さによる階層はありません)。OpenRouterでも同じ3ドル/15ドルですが、そちらではキャッシュ料金は公開されていません。これはKimi K2.6の0.95ドル/4ドルから3倍の値上げです。platform.kimi.ai/docs/pricing/chat-k3を基準に2026年7月時点で確認済みです。