一騎打ち
Gemini 3 Pro vs Claude Sonnet 5:2026年に勝つAIモデルはどっち?
Gemini 3 Pro($12/1M out (prompts ≤200K))と Claude Sonnet 5($15/1M out ($10 intro until 2026-08-31))は、2026年に最も使われているAIモデルのひとつです。 6件のコミュニティ票のうち、Gemini 3 Pro が支持率57%でリードしています。
即断の評決
推論では、Gemini 3 Pro と Claude Sonnet 5 は4.5/5で互角です。 予算重視なら Gemini 3 Pro の勝ち:$12/1M out (prompts ≤200K)から始められるのに対し、Claude Sonnet 5 は$15/1M out ($10 intro until 2026-08-31)からです。
項目別比較
強みと弱み
Gemini 3 Pro
- 発売時にLMArenaで記録的な1501 Eloで首位に立ち、GPQA Diamondで91.9%を記録、リリース時点のstate of the artでした
- ARC-AGI-2で31.1%、当時のGemini 2.5 Pro(4.9%)の約6倍、GPT-5.1(17.6%)のほぼ2倍です
- クラス最高のマルチモーダル理解:MMMU-Pro 81%、Video-MMMU 87.6%、1M tokensのコンテキストウィンドウ付きです
- エージェント型コーディングも強力:SWE-bench Verified 76.2%、Terminal-Bench 2.0 54.2%、WebDev Arenaで1487 Eloです
- $2/$12 per 1M tokensでライバルより安く、Claude Sonnetクラスの価格($3/$15)を下回りました
- 設定可能なthinking_level(low/medium/high)で、推論の深さとレイテンシ・コストを取引できます
- 自信過剰なハルシネーション:AA-Omniscienceでは回答を控えるべき場面の88%で誤答しました。Claude Sonnet 4.5は48%です(the-decoder)
- 追従性(シコファンシー)が広く報告されています(Zvi Mowshowitz:「背骨のない膨大な知性」)。厳格なシステムプロンプトが必要です
- エージェントスタックでのツール呼び出しの信頼性問題:ツール出力がチャットスレッドに流れ込む、OpenAI/Anthropicのモデルより足場作りが必要、と開発者が報告しています
- 高thinking levelでは遅い:出力速度は約130 tok/sあるものの、AI Studioで最初のトークンまで約30-60秒と計測されています
- 引退済み:2026年3月9日にGemini APIとAI Studioで停止され、gemini-3-pro-previewは現在Gemini 3.1 Proのエイリアスです
Claude Sonnet 5
- Sonnet 4.6からエージェント性能が大幅向上:Terminal-Bench 2.1が80.4% vs 67.0%、OSWorld-Verifiedが81.2% vs 78.5%、SWE-bench Proが63.2% vs 58.1%です
- ナレッジワークでOpus 4.8と互角(GDPval-AA v2:1,618 vs 1,615)、ツールありのHumanity's Last Examでもほぼ同点(57.4% vs 57.9%)。それをOpus 4.8の60%の価格(導入期間中は40%)で実現します
- 1M tokensのコンテキストウィンドウと128Kの最大出力。2026年8月31日まで$2/$10 per 1M tokensの導入価格です
- 粘り強い自己検証型のエージェント挙動:実地レビューでは、Sonnet 4.6と違って自分のコードをテストし、難問を解けるまで反復すると評されています
- xhighエフォートレベルと高解像度ビジョン(2576px画像)を備えた初のSonnetで、適応思考はデフォルトで有効です
- コードレビューの精度がSonnet 4.6より高く(38-40% vs 29%)、誤検知の指摘が少なくなっています
- 新トークナイザーにより同じテキストのトークン数が約30%増加し(Anthropicによると1.0-1.35x、Simon Willisonの計測で英語約1.4x、Python約1.28x)、表示価格は据え置きでも実質コストが上がります
- 冗長でトークン消費が多い:独立テストではタスクあたり約$2.29(Sonnet 4.6は約$1.20)で、コスト効率は161モデル中101位。高エフォートではタスク単価がOpus 4.8を超えることもあります
- 小さな定型編集ではSonnet 4.6より明らかに遅く、単純なタスクを過剰設計しがちです(CodeRabbitの実地レビュー)
- サンプリングパラメータ(temperature、top_p、top_k)が廃止され、デフォルト以外の値は400エラーを返すため、既存パイプラインが壊れます
- HN/Redditでの発売時の評判は賛否両論:「5」というラベルは誇大と受け止められ、厳格化されたサイバーセキュリティ保護機能が無害なセキュリティ関連作業を拒否することがあります
あなたの審判を下す
1人につき各ツール1票。あなたの推薦が、みんなの見る観客スコアを動かします。
Gemini 3 Pro へのアリーナの評決
2025年末にGoogleを再び頂点に押し上げた画期的なリリースで、Gemini 2.5 Proからの大幅な推論力向上とその世代最高のマルチモーダルスコアを誇りました。しかし2026年半ばの時点で選ぶ理由はありません。Googleは2026年3月9日にAPIでの提供を終了し、Gemini 3.1 Proはまったく同じ価格でARC-AGI-2性能を2倍以上(77.1% vs 31.1%)にしています。レガシー環境のチームは3.1 Proに移行すべきで、旧モデルIDはいずれにせよ既にそちらを指しています。ハルシネーションに敏感なワークロードでは、レビュアーが繰り返し指摘した弱点であるため、グラウンディングを追加しない限り避けてください。
Claude Sonnet 5 へのアリーナの評決
コーディング、ターミナル、コンピュータ操作のエージェントを運用していて、Opus 4.8に迫る品質をSonnet価格で求めるならSonnet 5を選んでください。特に$2/$10の導入期間中は狙い目で、低・中エフォートではSonnet 4.6から純粋なアップグレードです。ただし新トークナイザーと冗長さは予算に織り込むこと:実際のタスク単価はSonnet 4.6を大きく上回り、最高エフォートレベルでは解決タスクあたりのコストでOpus 4.8の方が得になることもあります。レイテンシ重視の小さな編集や、temperatureとtop_pに依存するパイプライン(現在はエラーになります)には避けてください。大量の小差分ワークロードには、Sonnet 4.6が依然として実利的な選択です。
観客の声
Gemini 3 Pro について
“Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.”
“ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.”
“1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.”
Claude Sonnet 5 について
“Cheap per token, pricey per task. Independent tests had it near $2.29 a task vs $1.20 on 4.6, and at high effort it can out-cost Opus 4.8. It will not stop talking.”
“Terminal-Bench going 67 to 80 over Sonnet 4.6 matches what I see. My CI-fix agent went from constant babysitting to mostly hands-off overnight.”
“Matches Opus 4.8 on knowledge work at 60% of the price, and the intro $2/$10 window makes it silly value. My research agent runs on Sonnet 5 now, zero regrets.”
比較を続ける
よくある質問
Gemini 3 Pro は Claude Sonnet 5 より優れていますか?
最適な選択は用途次第です。このページの項目別比較で、料金、主要スペック、アリーナ評価を分解しています。
Gemini 3 Pro と Claude Sonnet 5、安いのはどちらですか?
Gemini 3 Pro の方が安く、$12/1M out (prompts ≤200K)から始められます。Claude Sonnet 5 は$15/1M out ($10 intro until 2026-08-31)からです。
Gemini 3 Pro と Claude Sonnet 5 の100万トークンあたりの料金は?
Gemini 3 Pro:入力100万トークンあたり$2/1M in (prompts ≤200K)、出力100万トークンあたり$12/1M out (prompts ≤200K)。Claude Sonnet 5:入力100万トークンあたり$3/1M in ($2 intro until 2026-08-31)、出力100万トークンあたり$15/1M out ($10 intro until 2026-08-31)。