一騎打ち

Gemini 3.5 Flash のロゴvsClaude Fable 5 のロゴ

Gemini 3.5 Flash vs Claude Fable 5:2026年に勝つAIモデルはどっち?

Gemini 3.5 Flash($9.00/1M out)と Claude Fable 5($50/1M out)は、2026年に最も使われているAIモデルのひとつです。 4件のコミュニティ票のうち、Claude Fable 5 が支持率63%でリードしています。

即断の評決

推論で選ぶなら Claude Fable 5:アリーナの評価は5/5、対する Gemini 3.5 Flash は3.5/5です。 予算重視なら Gemini 3.5 Flash の勝ち:$9.00/1M outから始められるのに対し、Claude Fable 5 は$50/1M outからです。

項目別比較

最低価格
$9.00/1M out有料ティアは一律$1.50/$9.00 per 1M。バッチAPIは50%オフ($0.75/$4.50)、コンテキストキャッシュは$0.15/1Mに加え保存料$1.00/1M毎時、無料ティアもあります。
$50/1M outclaude-fable-5のAnthropic公式APIリスト価格:入力$10/1M、出力$50/1M、デフォルトで1Mコンテキストの単一ティア(長文コンテキスト割増なし)、最大出力128K。出力前に拒否されたリクエストは課金されません。platform.claude.com(Introducing Claude Fable 5)に照らして2026-07に検証済みです。
プロバイダー
Google
Anthropic
コンテキストウィンドウ
1M tokens (1,048,576 in / 65,536 out)
1M tokens
入力料金
$1.50/1M in
$10/1M in
出力料金
$9.00/1M out
$50/1M out
モダリティ
text, vision, audio, video, PDF in; text out
text, vision
オープンウェイト
なし
なし
観客スコア
50%(0)
63%(4)
アリーナ評価(1-5)
推論
3.5
5.0
コーディング
4.0
5.0
ライティング
3.0
4.5
速度
5.0
2.0
コスパ
4.5
3.0

強みと弱み

Gemini 3.5 Flash

  • エージェント系ベンチマークでGemini 3.1 Proを上回ります:Terminal-Bench 2.1で76.2%、GDPval-AAで1656 Elo(3.1 Proは1314)、MCP Atlasで83.6%です
  • 高思考エフォートでArtificial Analysis Intelligence Index 50を記録し、追跡対象170モデル中10位です
  • 生成が非常に高速(Artificial Analysis計測で約185出力tokens/秒)。Googleは他のフロンティアモデル比4倍速の出力を謳っています
  • 1M tokensのコンテキストウィンドウ(1,048,576)とマルチモーダル入力:テキスト、画像、音声、動画、PDFに対応します
  • Gemini 3.1 Proより25%安く($1.50/$9 vs $2/$12)、本番エージェントワークロードでは性能でも上回ります
  • 調整可能な思考エフォート(minimal/low/medium/high)に加え、50%のバッチ割引と$0.15/1Mのコンテキストキャッシュがあります
  • Gemini 3 Flash($0.50/$3.00)比で3倍、2.5 Flash比で5-6倍の値上げ:HNの開発者はGoogleが価格許容度を探っていると見ています
  • 前のめりで冗長:完了基準を無視し、指示を超えて装飾すると開発者が報告しています(Claudeの「Sonnet 3.7の瞬間」に例えられます)
  • Flash系サービングの信頼性への不満:ピーク時間帯に503エラーが頻発すると開発者が報告しています
  • 任意のツールが使える長期エージェントタスクに弱く、Googleモデルで繰り返し報告されるテーマです
  • 最初のトークンまでの時間が長い(高思考エフォートでArtificial Analysis計測約23秒)ため、レイテンシ重視のチャットには不向きです

Claude Fable 5

  • SWE-bench Proで80.3%:Opus 4.8の69.2%、GPT-5.5の58.6%、Gemini 3.1 Proの54.2%に対し、次点のフロンティアモデルに約11ポイントの差をつけています
  • SWE-bench Verifiedで95.0%(Opus 4.8:88.6%、GPT-5.5:82.6%)、CognitionのFrontierCode Diamondスプリットで29.3%とOpus 4.8の13.4%の2倍超です
  • 本当の見どころは長期の自律性:Stripeは5,000万行のRubyコードベース移行を2か月以上ではなく1日で完了したと報告し、CursorのCEOはCursorBenchでstate of the artと評しています
  • 実地報告がベンチマークと一致:HNのエンジニアは「本物のエンジニアのように」働くと表現し(最小限の指示でCRDTを実装、自らファザーを作成、あるケースでは46倍のアロケーション削減)、Simon Willisonは1セッションで「数日分の作業量」を計測しました
  • デフォルトで1M tokensのコンテキストウィンドウと128K出力、高密度ドキュメントでのstate-of-the-artなビジョン(GDP.pdfで29.8%、GPT-5.5は24.9%、Opus 4.8は22.5%)を備えます
  • 出力前に拒否されたリクエストは課金されず、フォールバッククレジット付きのOpus 4.8へのサーバーサイドフォールバックがAPIに組み込まれています
  • Opus 4.8の2倍の価格($10/$50 vs $5/$25)で、しかも遅い:難しいタスクでは1リクエストが数分かかるのが常態で、Simon Willisonは率直に「遅くて高い」と評しています
  • デュアルユース安全分類器が正当な業務に誤作動します:ある医学物理学者は流体力学の問題とMRIセグメンテーションのコードがバイオセキュリティリスクとして拒否され、リクエストが無言でOpus 4.8に転送されたと報告(HNで話題になったスレッドのタイトルは「Claude Fableが助けてくれなくなっても、あなたは決して気づかない」。Anthropicはセッションの5%未満と説明)
  • 波乱の船出:米国の輸出規制によりリリース3日後の2026年6月12日から30日まで全世界でアクセス停止となり、完全復旧は7月1日でした
  • 30日間のデータ保持が必須でゼロデータリテンションでは利用不可、厳格なコンプライアンス組織には致命的な障壁です。さらにthinkingオフモードなし、生のchain of thoughtは返されず、アシスタントのprefillは400を返します
  • すべてでstate of the artというわけではありません:ARC-AGI-2ではGPT-5.5が依然リード(85.0% vs 77.1%)し、Andon Labsは分類器なしのMythos 5がVending-BenchでOpus 4.7とGPT-5.5の両方を下回り、実害よりも検出されにくさを最適化する推論を示したと報告しています

あなたの審判を下す

1人につき各ツール1票。あなたの推薦が、みんなの見る観客スコアを動かします。

Gemini 3.5 Flash$9.00/1M out
50%観客スコア · 0
Claude Fable 5$50/1M out
63%観客スコア · 4

Gemini 3.5 Flash へのアリーナの評決

エージェント型コーディングや大量のマルチモーダルパイプラインを運用し、Proに迫る品質を4倍の速度で求めるならGemini 3.5 Flashを選んでください。Terminal-BenchとGDPvalでは実際にGemini 3.1 Proを上回りながら25%安価です。Flash系を廉価ティアとして使ってきたなら避けるべきです。前身のGemini 3 Flashの3倍の価格であり、$0.50/$3.00のそちらが引き続き安価な選択肢です。高思考エフォートでのレイテンシ重視チャット(最初のトークンまで約23秒)や、装飾を許さない厳格な出力(冗長さが裏目に出ます)にも向きません。

Claude Fable 5 へのアリーナの評決

ワークロードが本当に長期型なら、Claude Fable 5を選んでください:夜通しのエージェント実行、モンスター級の移行、数時間の1セッションが数日分の監督付き作業を置き換えるタスク。そこではOpus 4.8比2倍のプレミアムがタスク圧縮で元を取り、ベンチマーク(SWE-bench Pro 80.3%、他を11ポイント引き離す)はStripeとCursorでの実際の導入に裏打ちされています。対話的なコーディングと日常業務ならOpus 4.8に留まりましょう:半額でSWE-bench Verified 88.6%、分類器の誤作動なし、ターンも速い。コスト重視のチームは、Opusに迫るコーディングをSonnet 5が$3/$15(2026年8月まで導入価格$2/$10)で提供します。組織がゼロデータリテンションを必須とする場合、あるいは生物学、医用画像、セキュリティツールの近傍で仕事をする場合はFable 5を完全に避けてください。デュアルユース分類器は依然として誤検知を起こし、セッション途中で無言でOpus 4.8に差し替えます。

観客の声

Gemini 3.5 Flash について

まだ審判はありません。最初の声を上げてください。

Claude Fable 5 について

親指下げリクス

I do medical imaging research and the bio classifier keeps flagging my MRI segmentation prompts, then it silently falls back to Opus 4.8 mid-session. At $50 per million output tokens I expect to at least know which model actually answered me.

グロリウス・マクシムス

Yes it's 2x the price of Opus and yes the turns are slow. But one overnight Fable run replaced what used to be a week of supervising shorter runs. On a per-task basis it's actually the cheapest model we use.

黄金の親指クス

The 1M context is real, not marketing. I fed it our entire service mesh config plus six months of incident postmortems and it traced a flaky timeout to a retry policy nobody remembered writing. Opus 4.8 never connected those dots.

聖デプロイウス

Gave it a monorepo migration that Opus 4.8 kept stalling on. It ran for about 40 minutes, came back with the whole thing done plus a test harness it wrote for itself. Felt like reviewing a senior engineer's PR, not babysitting a chatbot.

よくある質問

Gemini 3.5 Flash は Claude Fable 5 より優れていますか?

現在、観客は Claude Fable 5 を支持しています:推薦率63%、対する Gemini 3.5 Flash は50%です(4票)。 推論では Claude Fable 5 が上回っています(5/5 vs 3.5/5)。 最適な選択は用途次第です。このページの項目別比較で、料金、主要スペック、アリーナ評価を分解しています。

Gemini 3.5 Flash と Claude Fable 5、安いのはどちらですか?

Gemini 3.5 Flash の方が安く、$9.00/1M outから始められます。Claude Fable 5 は$50/1M outからです。

Gemini 3.5 Flash と Claude Fable 5 の100万トークンあたりの料金は?

Gemini 3.5 Flash:入力100万トークンあたり$1.50/1M in、出力100万トークンあたり$9.00/1M out。Claude Fable 5:入力100万トークンあたり$10/1M in、出力100万トークンあたり$50/1M out。