一騎打ち

Claude Opus 4.7 のロゴvsGemini 3 Pro のロゴ

Claude Opus 4.7 vs Gemini 3 Pro:2026年に勝つAIモデルはどっち?

Claude Opus 4.7($25/1M out)と Gemini 3 Pro($12/1M out (prompts ≤200K))は、2026年に最も使われているAIモデルのひとつです。 6件のコミュニティ票のうち、Claude Opus 4.7 が支持率57%でリードしています。

即断の評決

推論では、Claude Opus 4.7 と Gemini 3 Pro は4.5/5で互角です。 予算重視なら Gemini 3 Pro の勝ち:$12/1M out (prompts ≤200K)から始められるのに対し、Claude Opus 4.7 は$25/1M outからです。

項目別比較

最低価格
$25/1M out標準APIティアで入力$5 / 出力$25 per 1M tokens、1Mコンテキストまで一律(長文コンテキスト割増なし)。Batch APIは-50%。新トークナイザーは4.7以前のモデル比で約30%多くのtokensを生成します。
$12/1M out (prompts ≤200K)標準ティア:プロンプト200K以下は$2/$12 per 1M tokens、200K超は$4/$18、バッチは50%オフ。2026年3月9日に引退、後継のGemini 3.1 Proは同一価格を維持しています。
プロバイダー
Anthropic
Google (DeepMind)
コンテキストウィンドウ
1M tokens (128K max output)
1M tokens (64K output)
入力料金
$5/1M in
$2/1M in (prompts ≤200K)
出力料金
$25/1M out
$12/1M out (prompts ≤200K)
モダリティ
text + image input (up to 2576px), text output
text, image, audio, video in; text out
オープンウェイト
なし
なし
観客スコア
57%(3)
57%(3)
アリーナ評価(1-5)
推論
4.5
4.5
コーディング
4.5
4.5
ライティング
4.5
3.5
速度
2.5
3.5
コスパ
3.0
4.0

強みと弱み

Claude Opus 4.7

  • 発売時にSWE-bench Verified 87.6%(Opus 4.6の80.8%から向上)とSWE-bench Pro 64.3%を記録し、GPT-5.4(57.7%)とGemini 3.1 Pro(54.2%)をリードしました
  • 1M tokensのコンテキストウィンドウと128Kの最大出力を、長文コンテキスト割増なしの一律$5/$25で提供(Batch APIベータ経由で300K出力)
  • 高解像度ビジョンを備えた初のClaude:長辺2576pxまでの画像をピクセル精度の座標で受け付け、従来比約3倍の精細さです
  • コードレビューが傑出:独立テストでライバルより強力なファイル横断推論で実在バグを多く発見し、ドキュメント推論エラーはOpus 4.6比21%減です
  • 新しいxhighエフォートレベルとTask Budgets(ベータ)による細かなコスト制御:低エフォートの4.7は中エフォートの4.6の出力品質にほぼ匹敵します
  • 知識が新しい:リリース時点でどのClaudeモデルよりも新しい、2026年1月の確実なカットオフです
  • 新トークナイザーにより同じテキストのトークン数が4.7以前のモデル比で約30%増加し(Anthropic自身のドキュメントによる)、表示価格は据え置きでも実質的なリクエスト単価が上がります
  • エージェント用途では非常に冗長:あるベンチマークでは同等のコーディングタスクでGPT-5.5の出力tokensが72%少なく、レビュアーはそのナレーションを過剰と評しています
  • 移行者を悩ませる破壊的なAPI変更:temperature/top_p/top_kとthinkingのbudget_tokensは400エラーを返すようになり、思考テキストはデフォルトで非表示です
  • レイテンシは中程度で、高エフォートでは1ターンに数分かかることも。fastモードはプレミアムなリサーチプレビューで、4.7では既に非推奨です
  • 約3か月で同じ$5/$25のOpus 4.8に抜かれ、リアルタイムのサイバーセキュリティ保護機能が正当なセキュリティ業務に誤検知することがあります

Gemini 3 Pro

  • 発売時にLMArenaで記録的な1501 Eloで首位に立ち、GPQA Diamondで91.9%を記録、リリース時点のstate of the artでした
  • ARC-AGI-2で31.1%、当時のGemini 2.5 Pro(4.9%)の約6倍、GPT-5.1(17.6%)のほぼ2倍です
  • クラス最高のマルチモーダル理解:MMMU-Pro 81%、Video-MMMU 87.6%、1M tokensのコンテキストウィンドウ付きです
  • エージェント型コーディングも強力:SWE-bench Verified 76.2%、Terminal-Bench 2.0 54.2%、WebDev Arenaで1487 Eloです
  • $2/$12 per 1M tokensでライバルより安く、Claude Sonnetクラスの価格($3/$15)を下回りました
  • 設定可能なthinking_level(low/medium/high)で、推論の深さとレイテンシ・コストを取引できます
  • 自信過剰なハルシネーション:AA-Omniscienceでは回答を控えるべき場面の88%で誤答しました。Claude Sonnet 4.5は48%です(the-decoder)
  • 追従性(シコファンシー)が広く報告されています(Zvi Mowshowitz:「背骨のない膨大な知性」)。厳格なシステムプロンプトが必要です
  • エージェントスタックでのツール呼び出しの信頼性問題:ツール出力がチャットスレッドに流れ込む、OpenAI/Anthropicのモデルより足場作りが必要、と開発者が報告しています
  • 高thinking levelでは遅い:出力速度は約130 tok/sあるものの、AI Studioで最初のトークンまで約30-60秒と計測されています
  • 引退済み:2026年3月9日にGemini APIとAI Studioで停止され、gemini-3-pro-previewは現在Gemini 3.1 Proのエイリアスです

あなたの審判を下す

1人につき各ツール1票。あなたの推薦が、みんなの見る観客スコアを動かします。

Claude Opus 4.7$25/1M out
57%観客スコア · 3
Gemini 3 Pro$12/1M out (prompts ≤200K)
57%観客スコア · 3

Claude Opus 4.7 へのアリーナの評決

Opus 4.7を選ぶべきなのは、再現性のために既にこのモデルに固定している場合だけです。Opus 4.8は同じ$5/$25でAPI仕様も同一のまま性能で上回るため、新規プロジェクトのデフォルトとしてはそちらが適切です。エージェント型コーディング、コードレビュー、1Mコンテキストのドキュメント作業では依然として非常に強力で、Opus 4.6からは明確なアップグレードです。4.6から移行するチームは、破壊的なAPI変更と、プロンプトあたり約30%多くのトークンを生むトークナイザーを予算に織り込んでください。コスト重視のユーザーは、Opusに迫る品質を$3/$15(2026年8月31日まで導入価格$2/$10)で提供するSonnet 5を検討すべきです。

Gemini 3 Pro へのアリーナの評決

2025年末にGoogleを再び頂点に押し上げた画期的なリリースで、Gemini 2.5 Proからの大幅な推論力向上とその世代最高のマルチモーダルスコアを誇りました。しかし2026年半ばの時点で選ぶ理由はありません。Googleは2026年3月9日にAPIでの提供を終了し、Gemini 3.1 Proはまったく同じ価格でARC-AGI-2性能を2倍以上(77.1% vs 31.1%)にしています。レガシー環境のチームは3.1 Proに移行すべきで、旧モデルIDはいずれにせよ既にそちらを指しています。ハルシネーションに敏感なワークロードでは、レビュアーが繰り返し指摘した弱点であるため、グラウンディングを追加しない限り避けてください。

観客の声

Claude Opus 4.7 について

親指下げリクス

Watch your invoices. New tokenizer counts ~30% more tokens for the same text, and it narrates every tiny step. Sticker price unchanged, effective cost definitely not.

公正なる審判者

Came from 4.6 and stopped chunking repos entirely. 1M context, 128K output, flat $5/$25 with no long-context premium. That pricing decision alone won me over.

リリース卿

87.6 SWE-bench Verified is not just marketing, it closes tickets GPT-5.4 fumbles. And the hi-res vision with pixel-accurate coords finally makes screenshot debugging useful.

Gemini 3 Pro について

恐怖の判事

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

バイブスの覇者

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

グロリウス・マクシムス

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

よくある質問

Claude Opus 4.7 は Gemini 3 Pro より優れていますか?

最適な選択は用途次第です。このページの項目別比較で、料金、主要スペック、アリーナ評価を分解しています。

Claude Opus 4.7 と Gemini 3 Pro、安いのはどちらですか?

Gemini 3 Pro の方が安く、$12/1M out (prompts ≤200K)から始められます。Claude Opus 4.7 は$25/1M outからです。

Claude Opus 4.7 と Gemini 3 Pro の100万トークンあたりの料金は?

Claude Opus 4.7:入力100万トークンあたり$5/1M in、出力100万トークンあたり$25/1M out。Gemini 3 Pro:入力100万トークンあたり$2/1M in (prompts ≤200K)、出力100万トークンあたり$12/1M out (prompts ≤200K)。