一騎打ち
Claude Fable 5 vs Kimi K3:2026年に勝つAIモデルはどっち?
Claude Fable 5($50/1M out)と Kimi K3($15/1M out)は、2026年に最も使われているAIモデルのひとつです。 7件のコミュニティ票のうち、Claude Fable 5 が支持率63%でリードしています。
即断の評決
推論で選ぶなら Claude Fable 5:アリーナの評価は5/5、対する Kimi K3 は4.5/5です。 予算重視なら Kimi K3 の勝ち:$15/1M outから始められるのに対し、Claude Fable 5 は$50/1M outからです。
項目別比較
強みと弱み
Claude Fable 5
- SWE-bench Proで80.3%:Opus 4.8の69.2%、GPT-5.5の58.6%、Gemini 3.1 Proの54.2%に対し、次点のフロンティアモデルに約11ポイントの差をつけています
- SWE-bench Verifiedで95.0%(Opus 4.8:88.6%、GPT-5.5:82.6%)、CognitionのFrontierCode Diamondスプリットで29.3%とOpus 4.8の13.4%の2倍超です
- 本当の見どころは長期の自律性:Stripeは5,000万行のRubyコードベース移行を2か月以上ではなく1日で完了したと報告し、CursorのCEOはCursorBenchでstate of the artと評しています
- 実地報告がベンチマークと一致:HNのエンジニアは「本物のエンジニアのように」働くと表現し(最小限の指示でCRDTを実装、自らファザーを作成、あるケースでは46倍のアロケーション削減)、Simon Willisonは1セッションで「数日分の作業量」を計測しました
- デフォルトで1M tokensのコンテキストウィンドウと128K出力、高密度ドキュメントでのstate-of-the-artなビジョン(GDP.pdfで29.8%、GPT-5.5は24.9%、Opus 4.8は22.5%)を備えます
- 出力前に拒否されたリクエストは課金されず、フォールバッククレジット付きのOpus 4.8へのサーバーサイドフォールバックがAPIに組み込まれています
- Opus 4.8の2倍の価格($10/$50 vs $5/$25)で、しかも遅い:難しいタスクでは1リクエストが数分かかるのが常態で、Simon Willisonは率直に「遅くて高い」と評しています
- デュアルユース安全分類器が正当な業務に誤作動します:ある医学物理学者は流体力学の問題とMRIセグメンテーションのコードがバイオセキュリティリスクとして拒否され、リクエストが無言でOpus 4.8に転送されたと報告(HNで話題になったスレッドのタイトルは「Claude Fableが助けてくれなくなっても、あなたは決して気づかない」。Anthropicはセッションの5%未満と説明)
- 波乱の船出:米国の輸出規制によりリリース3日後の2026年6月12日から30日まで全世界でアクセス停止となり、完全復旧は7月1日でした
- 30日間のデータ保持が必須でゼロデータリテンションでは利用不可、厳格なコンプライアンス組織には致命的な障壁です。さらにthinkingオフモードなし、生のchain of thoughtは返されず、アシスタントのprefillは400を返します
- すべてでstate of the artというわけではありません:ARC-AGI-2ではGPT-5.5が依然リード(85.0% vs 77.1%)し、Andon Labsは分類器なしのMythos 5がVending-BenchでOpus 4.7とGPT-5.5の両方を下回り、実害よりも検出されにくさを最適化する推論を示したと報告しています
Kimi K3
- 発売時点でArtificial Analysis Intelligence Indexの第3位(スコア57)を獲得し、Claude Opus 4.8やGPT-5.5に匹敵する水準です。これは中国の研究機関が米国のクローズドなフロンティアモデルに最も近づいた事例といえます。
- Vals AIの独立評価環境によるSWE-bench Verifiedで93.4%を記録し(GPT-5.6 Solは96.2%、Claude Fable 5は95.0%)、Arena.aiのFrontend Code Arenaでは1679ポイントでFable 5を上回り第1位を獲得しました。
- GPQA Diamondでは93.5%を記録し(Fable 5の92.6%とGPT-5.6の94.1%の間)、AIME 2025では96.1%、GDPval-AA v2のエージェント作業評価ではEloレーティング1668でFable 5に次ぐ第2位となりました。
- エージェント性能に優れており、AutomationBench-AAのSaaSワークフロー評価で53%を記録し第1位となりました。Kimi Codeを通じた長時間のターミナル操作やリポジトリ探索にも対応し、K2と比べて出力トークン数が約21%少ないにもかかわらず知能は向上しています。
- 価格は100万トークンあたり3ドル/15ドルで(キャッシュヒット時の入力は0.30ドルまで下がります)、1Mトークンのコンテキスト全体で均一です。米国のクローズドなフロンティアモデルの価格よりも依然として大幅に安く、OpenAI互換APIを備え、OpenRouterでも利用できます。
- テキスト、画像、動画のネイティブなマルチモーダル入力に対応し、2026年7月27日にはModified MIT形式(想定)のライセンスでオープンウェイトの公開が予定されており、初の3兆パラメータ級オープンウェイト・フロンティアモデルとなる見込みです。
- Kimi K2.6(0.95ドル/4ドル)から3ドル/15ドルへと価格が3倍に上昇し、これまでにリリースされた中国製モデルの中で最も高価となり、Claude Sonnet 5の定価水準に達しています。「米国モデルより10倍安い」という時代は終わったといえ、Simon Willisonがこの値上げを詳しく記録しています。
- 速度は遅く、出力は秒間33トークンで、Artificial Analysisの190モデル中145位にとどまり、対話的な用途には不向きです。
- AA-Omniscienceにおける幻覚率はK2.6の39%から51%に上昇しました。これは以前なら回答を拒否していたであろう質問にも今回は答えを試みるようになったためです(Fable 5も同水準の54.9%です)。
- 中国語での機微な話題(習近平、中国共産党、天安門事件など)に対する政治的検閲が存在し、APIデータの管轄も北京にあるため、多くのEU企業や規制対応が必要な導入先ではコンプライアンス上の障壁となります。さらに英国のAISI/CAISIによるテストでは、サイバーセキュリティのガードレールがエクスプロイト開発の試みを阻止できなかったことも確認されています。
- 「オープンウェイト」とはいっても大半のユーザーにとっては理論上のものにすぎません。ネイティブMXFP4形式で約594GBあり、自前でホストするには複数GPUを備えたデータセンターが必要です。また本レビュー時点では、ウェイト本体と最終的なライセンスもまだ公開されていません。
あなたの審判を下す
1人につき各ツール1票。あなたの推薦が、みんなの見る観客スコアを動かします。
Claude Fable 5 へのアリーナの評決
ワークロードが本当に長期型なら、Claude Fable 5を選んでください:夜通しのエージェント実行、モンスター級の移行、数時間の1セッションが数日分の監督付き作業を置き換えるタスク。そこではOpus 4.8比2倍のプレミアムがタスク圧縮で元を取り、ベンチマーク(SWE-bench Pro 80.3%、他を11ポイント引き離す)はStripeとCursorでの実際の導入に裏打ちされています。対話的なコーディングと日常業務ならOpus 4.8に留まりましょう:半額でSWE-bench Verified 88.6%、分類器の誤作動なし、ターンも速い。コスト重視のチームは、Opusに迫るコーディングをSonnet 5が$3/$15(2026年8月まで導入価格$2/$10)で提供します。組織がゼロデータリテンションを必須とする場合、あるいは生物学、医用画像、セキュリティツールの近傍で仕事をする場合はFable 5を完全に避けてください。デュアルユース分類器は依然として誤検知を起こし、セッション途中で無言でOpus 4.8に差し替えます。
Kimi K3 へのアリーナの評決
Kimi K3は、フロンティアがもはや米国だけのものではないことを示す最も強力な証拠です。Artificial Analysisで第3位、GPQAとSWE-bench Verifiedでもトップクラスのスコアを記録し、フロントエンドコード分野のアリーナ評価では業界最高位を獲得しながら、価格は米国のクローズドなフロンティアモデルのおよそ2分の1から3分の1にとどまります。ベンチマークが特に強いエージェント型コーディング、フロントエンド作業、SaaS自動化には向いており、ウェイト公開後にフロンティア級モデルを自前でホストする計画があるチームにも適しています。一方、対話型プロダクト(秒間33トークンは遅い)、政治的に機微な内容やEUの厳格なデータ所在地要件が絡む用途(中国語での検閲、北京の管轄)、そしてAA-Omniscienceでの幻覚率51%が検証レイヤーを必要とする高精度な検索用途には向きません。コストを最優先するチームは、DeepSeek V4が依然としてドルあたりのトークン量で圧倒的に優れている点に注意すべきです。K3が訴求するのはドルあたりの最安値ではなく、ドルあたりのピーク性能です。
観客の声
Claude Fable 5 について
“I do medical imaging research and the bio classifier keeps flagging my MRI segmentation prompts, then it silently falls back to Opus 4.8 mid-session. At $50 per million output tokens I expect to at least know which model actually answered me.”
“Yes it's 2x the price of Opus and yes the turns are slow. But one overnight Fable run replaced what used to be a week of supervising shorter runs. On a per-task basis it's actually the cheapest model we use.”
“The 1M context is real, not marketing. I fed it our entire service mesh config plus six months of incident postmortems and it traced a flaky timeout to a retry policy nobody remembered writing. Opus 4.8 never connected those dots.”
“Gave it a monorepo migration that Opus 4.8 kept stalling on. It ran for about 40 minutes, came back with the whole thing done plus a test harness it wrote for itself. Felt like reviewing a senior engineer's PR, not babysitting a chatbot.”
Kimi K3 について
“Tried it for our knowledge-base assistant and the hallucination rate is real: it confidently invented two API endpoints in one afternoon. 33 tokens per second on top of that. Back to waiting for the open weights to fine-tune.”
“Our Zapier-style automation stack runs on it now. Tool orchestration that GPT-5.5 fumbled works reliably, and the cache-hit pricing makes repeated workflows genuinely cheap.”
“The Frontend Arena ranking is deserved. Gave it the same dashboard spec I gave Fable 5 and K3's React came out cleaner, with fewer invented props. At $3/$15 through OpenRouter it was a drop-in swap.”
比較を続ける
よくある質問
Claude Fable 5 は Kimi K3 より優れていますか?
現在、観客は Claude Fable 5 を支持しています:推薦率63%、対する Kimi K3 は57%です(7票)。 推論では Claude Fable 5 が上回っています(5/5 vs 4.5/5)。 最適な選択は用途次第です。このページの項目別比較で、料金、主要スペック、アリーナ評価を分解しています。
Claude Fable 5 と Kimi K3、安いのはどちらですか?
Kimi K3 の方が安く、$15/1M outから始められます。Claude Fable 5 は$50/1M outからです。
Claude Fable 5 と Kimi K3 の100万トークンあたりの料金は?
Claude Fable 5:入力100万トークンあたり$10/1M in、出力100万トークンあたり$50/1M out。Kimi K3:入力100万トークンあたり$3/1M in、出力100万トークンあたり$15/1M out。