一騎打ち

Claude Opus 5 のロゴvsGemini 3 Pro のロゴ

Claude Opus 5 vs Gemini 3 Pro:2026年に勝つAIモデルはどっち?

Claude Opus 5($25/1M out)と Gemini 3 Pro($12/1M out (prompts ≤200K))は、2026年に最も使われているAIモデルのひとつです。 7件のコミュニティ票のうち、Claude Opus 5 が支持率63%でリードしています。

即断の評決

推論で選ぶなら Claude Opus 5:アリーナの評価は5/5、対する Gemini 3 Pro は4.5/5です。 予算重視なら Gemini 3 Pro の勝ち:$12/1M out (prompts ≤200K)から始められるのに対し、Claude Opus 5 は$25/1M outからです。

項目別比較

最低価格
$25/1M outclaude-opus-5のアンソロピック公式API定価は、入力100万トークンあたり5ドル、出力100万トークンあたり25ドルで、Opus 4.8から変更はありません。コンテキストは1Mトークンの単一階層でデフォルトかつ最大値、最大出力は128K、プロンプトキャッシュは512トークンから利用可能です。リサーチプレビュー版のFastモード(10ドル/50ドル、約2.5倍高速)はClaude API限定です。platform.claude.com(Opus 5の新機能ページ)にて2026年7月時点で確認済みです。
$12/1M out (prompts ≤200K)標準ティア:プロンプト200K以下は$2/$12 per 1M tokens、200K超は$4/$18、バッチは50%オフ。2026年3月9日に引退、後継のGemini 3.1 Proは同一価格を維持しています。
プロバイダー
Anthropic
Google (DeepMind)
コンテキストウィンドウ
1M tokens
1M tokens (64K output)
入力料金
$5/1M in
$2/1M in (prompts ≤200K)
出力料金
$25/1M out
$12/1M out (prompts ≤200K)
モダリティ
text, vision
text, image, audio, video in; text out
オープンウェイト
なし
なし
観客スコア
63%(4)
57%(3)
アリーナ評価(1-5)
推論
5.0
4.5
コーディング
5.0
4.5
ライティング
4.0
3.5
速度
2.0
3.5
コスパ
4.0
4.0

強みと弱み

Claude Opus 5

  • 発売時点でArtificial Analysisの190モデル中、複合知能スコアで第1位を獲得し、Frontier-Bench v0.1では43.3%を記録しました(GPT-5.6 Solは34.4%、Claude Fable 5は33.7%)。
  • ARC-AGI-3の新規推論タスクではGPT-5.6 Solの3.9倍のスコア(30.2%対7.8%)を記録し、GDPval-AA v2の経済知識労働タスクではEloレーティング1861でFable 5(1747)を上回りました。
  • SWE-bench Proでは79.2%を記録し、Fable 5(80.0%)にわずか1ポイント差まで迫るとともにOpus 4.8(69.2%)を10ポイント上回りました。価格はFable 5の半分で、Cursorの共同創業者は「Opusの速度とコストでFable 5に近い知能」と評しています。
  • 価格はOpus 4.8と同じ5ドル/25ドルのまま、コンテキスト幅は拡大しています。1Mトークンが唯一かつデフォルトの階層となり、最大出力は128K、プロンプトキャッシュは512トークンから利用できます。
  • デュアルユース安全性分類器の誤作動はFable 5より85%少なく、新しいデフォルトのフォールバックモードにより、Fable 5の発売時に問題となっていたセッション中の無言の拒否も回避されます。
  • 指示せずとも自らの作業内容を自己検証し、会話途中のツール変更(ベータ版)にもプロンプトキャッシュを壊さずに対応します。発売初日からClaude.ai、API、Bedrock、Vertex、Microsoft Foundryで利用可能です。
  • 際立って低速かつ非常に冗長です。Artificial Analysisの計測では出力速度が秒間52.6トークン、最初のトークンまで68秒かかり、評価中に消費した出力トークン数は約1億で、中央値の6300万を大きく上回りました。
  • この冗長さは実運用上のコスト増につながります。CodeRabbitの計測では、コードレビュー1回あたりの読み込み量が基準となるフロンティアモデルより約50%多く、書き込み量も約65%多いという結果が出ています。
  • 「コスト効率が良い」と謳われていますが、実際の値下げはありません。価格はOpus 4.8と同一(5ドル/25ドル)で、GPT-5.6(5ドル/30ドル)にほぼ匹敵し、同等クラスのGeminiやGrokの2倍以上です。
  • レビュアーからは「優秀だが煩わしい」性格だと評されています。過剰な検証、言い回しの保険的表現、そしてマージコンフリクトの解消のような日常的タスクを時折拒否する挙動が見られます(Lenny's Newsletterの実地レビューより)。
  • Opus 4.8から移行するユーザーにとっては破壊的なAPI変更があります。思考機能はデフォルトでオンになっており、xhighまたはmaxの努力量では無効化できず(400エラーが返されます)、Fastモード(10ドル/50ドル、約2.5倍高速)はAPI限定でBedrockやVertexでは利用できません。

Gemini 3 Pro

  • 発売時にLMArenaで記録的な1501 Eloで首位に立ち、GPQA Diamondで91.9%を記録、リリース時点のstate of the artでした
  • ARC-AGI-2で31.1%、当時のGemini 2.5 Pro(4.9%)の約6倍、GPT-5.1(17.6%)のほぼ2倍です
  • クラス最高のマルチモーダル理解:MMMU-Pro 81%、Video-MMMU 87.6%、1M tokensのコンテキストウィンドウ付きです
  • エージェント型コーディングも強力:SWE-bench Verified 76.2%、Terminal-Bench 2.0 54.2%、WebDev Arenaで1487 Eloです
  • $2/$12 per 1M tokensでライバルより安く、Claude Sonnetクラスの価格($3/$15)を下回りました
  • 設定可能なthinking_level(low/medium/high)で、推論の深さとレイテンシ・コストを取引できます
  • 自信過剰なハルシネーション:AA-Omniscienceでは回答を控えるべき場面の88%で誤答しました。Claude Sonnet 4.5は48%です(the-decoder)
  • 追従性(シコファンシー)が広く報告されています(Zvi Mowshowitz:「背骨のない膨大な知性」)。厳格なシステムプロンプトが必要です
  • エージェントスタックでのツール呼び出しの信頼性問題:ツール出力がチャットスレッドに流れ込む、OpenAI/Anthropicのモデルより足場作りが必要、と開発者が報告しています
  • 高thinking levelでは遅い:出力速度は約130 tok/sあるものの、AI Studioで最初のトークンまで約30-60秒と計測されています
  • 引退済み:2026年3月9日にGemini APIとAI Studioで停止され、gemini-3-pro-previewは現在Gemini 3.1 Proのエイリアスです

あなたの審判を下す

1人につき各ツール1票。あなたの推薦が、みんなの見る観客スコアを動かします。

Claude Opus 5$25/1M out
63%観客スコア · 4
Gemini 3 Pro$12/1M out (prompts ≤200K)
57%観客スコア · 3

Claude Opus 5 へのアリーナの評決

Claude Opus 5はSeries 5ラインナップの中で最も無難な既定選択肢です。Fable 5の知能をほぼそのまま(しかもFrontier-BenchとGDPvalではFable 5を上回りつつ)トークン価格はちょうど半分で、分類器の誤作動も85%少なくなっています。能力を求めてFable 5にワークロードを移行したものの、料金や誤検知による拒否に不満があるなら、こちらに移行する価値があります。まだOpus 4.8を使っているなら、SWE-bench Proで10ポイントのアップグレードを追加コストなしで得られます。他の選択肢を検討すべき正直な理由は2つあります。レイテンシと冗長さです。秒間52.6トークン、最初のトークンまで68秒という速度は対話的なUXには不向きで、トークン消費量の多さが表示価格以上に実質コストを押し上げるため、予算を重視する大量処理パイプラインには依然としてSonnet 5、Gemini、DeepSeekが適しています。Fable 5を使い続ける価値があるのは、SWE-bench Proでのわずかな優位が積み重なる、最も長時間の自律実行タスクに限られます。

Gemini 3 Pro へのアリーナの評決

2025年末にGoogleを再び頂点に押し上げた画期的なリリースで、Gemini 2.5 Proからの大幅な推論力向上とその世代最高のマルチモーダルスコアを誇りました。しかし2026年半ばの時点で選ぶ理由はありません。Googleは2026年3月9日にAPIでの提供を終了し、Gemini 3.1 Proはまったく同じ価格でARC-AGI-2性能を2倍以上(77.1% vs 31.1%)にしています。レガシー環境のチームは3.1 Proに移行すべきで、旧モデルIDはいずれにせよ既にそちらを指しています。ハルシネーションに敏感なワークロードでは、レビュアーが繰り返し指摘した弱点であるため、グラウンディングを追加しない限り避けてください。

観客の声

Claude Opus 5 について

親指下げリクス

The sticker price is unchanged but my invoice is not: it writes essays where Opus 4.8 wrote answers. 68 seconds to first token killed it for our support chat, we went back to Sonnet 5.

公正なる審判者

Fed it a 40-tab financial model with cross-sheet formulas and asked for a scenario deck. It got the edge cases the analysts missed. For document-heavy enterprise work this is the best model I have used.

リリース卿

We moved off Fable 5 because the bio classifier kept flagging our genomics tooling. Opus 5 does the same work at half the price and I have not seen a single silent reroute since.

リポジトリの守護者

Migrated our agents from Opus 4.8 the day it dropped. Same bill, and tasks that used to stall at the planning stage now just finish. The 10-point SWE-bench jump is not marketing, our merge queue feels it.

Gemini 3 Pro について

恐怖の判事

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

バイブスの覇者

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

グロリウス・マクシムス

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

よくある質問

Claude Opus 5 は Gemini 3 Pro より優れていますか?

現在、観客は Claude Opus 5 を支持しています:推薦率63%、対する Gemini 3 Pro は57%です(7票)。 推論では Claude Opus 5 が上回っています(5/5 vs 4.5/5)。 最適な選択は用途次第です。このページの項目別比較で、料金、主要スペック、アリーナ評価を分解しています。

Claude Opus 5 と Gemini 3 Pro、安いのはどちらですか?

Gemini 3 Pro の方が安く、$12/1M out (prompts ≤200K)から始められます。Claude Opus 5 は$25/1M outからです。

Claude Opus 5 と Gemini 3 Pro の100万トークンあたりの料金は?

Claude Opus 5:入力100万トークンあたり$5/1M in、出力100万トークンあたり$25/1M out。Gemini 3 Pro:入力100万トークンあたり$2/1M in (prompts ≤200K)、出力100万トークンあたり$12/1M out (prompts ≤200K)。