アリーナ · AIモデルレビュー

Gemini 3 Pro

開発:Google

Googleの2025年11月フロンティアモデル:1Mコンテキスト、LMArenaで初の1500 Elo超え、現在はGemini 3.1 Proが後継。

アリーナスコア 4/557%が推薦 · 3票
推論4.5
コーディング4.5
ライティング3.5
速度3.5
コスパ4.0
Gemini 3 Pro のサイトへマルチモーダル分析(動画/音声/画像)長文コンテキスト推論エージェント型コーディング数学・科学推論
価格

$12/1M out (prompts ≤200K)

標準ティア:プロンプト200K以下は$2/$12 per 1M tokens、200K超は$4/$18、バッチは50%オフ。2026年3月9日に引退、後継のGemini 3.1 Proは同一価格を維持しています。

プロバイダー

Google (DeepMind)

コンテキストウィンドウ

1M tokens (64K output)

入力料金

$2/1M in (prompts ≤200K)

出力料金

$12/1M out (prompts ≤200K)

モダリティ

text, image, audio, video in; text out

オープンウェイト

なし

Gemini 3 Pro とは?

2025年11月18日にリリースされたGoogle DeepMindのフロンティア推論モデルです。LMArenaで初めて1500 Eloを突破し、1M tokensのコンテキストウィンドウとテキスト・画像・音声・動画のネイティブ理解を備えます。2026年3月9日に、同価格のGemini 3.1 Proを後継として引退しました。

Gemini 3 Pro の長所と短所

長所

  • 発売時にLMArenaで記録的な1501 Eloで首位に立ち、GPQA Diamondで91.9%を記録、リリース時点のstate of the artでした
  • ARC-AGI-2で31.1%、当時のGemini 2.5 Pro(4.9%)の約6倍、GPT-5.1(17.6%)のほぼ2倍です
  • クラス最高のマルチモーダル理解:MMMU-Pro 81%、Video-MMMU 87.6%、1M tokensのコンテキストウィンドウ付きです
  • エージェント型コーディングも強力:SWE-bench Verified 76.2%、Terminal-Bench 2.0 54.2%、WebDev Arenaで1487 Eloです
  • $2/$12 per 1M tokensでライバルより安く、Claude Sonnetクラスの価格($3/$15)を下回りました
  • 設定可能なthinking_level(low/medium/high)で、推論の深さとレイテンシ・コストを取引できます

短所

  • 自信過剰なハルシネーション:AA-Omniscienceでは回答を控えるべき場面の88%で誤答しました。Claude Sonnet 4.5は48%です(the-decoder)
  • 追従性(シコファンシー)が広く報告されています(Zvi Mowshowitz:「背骨のない膨大な知性」)。厳格なシステムプロンプトが必要です
  • エージェントスタックでのツール呼び出しの信頼性問題:ツール出力がチャットスレッドに流れ込む、OpenAI/Anthropicのモデルより足場作りが必要、と開発者が報告しています
  • 高thinking levelでは遅い:出力速度は約130 tok/sあるものの、AI Studioで最初のトークンまで約30-60秒と計測されています
  • 引退済み:2026年3月9日にGemini APIとAI Studioで停止され、gemini-3-pro-previewは現在Gemini 3.1 Proのエイリアスです

アリーナの評決

2025年末にGoogleを再び頂点に押し上げた画期的なリリースで、Gemini 2.5 Proからの大幅な推論力向上とその世代最高のマルチモーダルスコアを誇りました。しかし2026年半ばの時点で選ぶ理由はありません。Googleは2026年3月9日にAPIでの提供を終了し、Gemini 3.1 Proはまったく同じ価格でARC-AGI-2性能を2倍以上(77.1% vs 31.1%)にしています。レガシー環境のチームは3.1 Proに移行すべきで、旧モデルIDはいずれにせよ既にそちらを指しています。ハルシネーションに敏感なワークロードでは、レビュアーが繰り返し指摘した弱点であるため、グラウンディングを追加しない限り避けてください。

親指を上げるか、下げるか

あなたの審判を下す

Gemini 3 Pro を推薦しますか?それとも観客に警告しますか?

57%観客スコア · 3

Gemini 3 Pro の代替ツールTOP

すべての代替ツール
1
Claude Haiku 4.5

Anthropic最速のモデル:Sonnet 4.5の約90%のコーディング力を$1/$5 per 1M tokensで、200Kコンテキスト。

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropicの2026年6月Mythosクラスフラッグシップ:SWE-bench Proで80.3%、他のあらゆるフロンティアモデルに11ポイントの差

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropicの2026年4月Opus:SWE-bench Verified 87.6%、1Mコンテキスト、高解像度ビジョン、現在はOpus 4.8に後れ

$25/1M out57%(3)
Visit

Gemini 3 Pro を1対1で比較

観客の声

恐怖の判事

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

バイブスの覇者

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

グロリウス・マクシムス

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Gemini 3 Pro:よくある質問

Gemini 3 Pro の100万トークンあたりの料金は?

Gemini 3 Pro の料金は、入力100万トークンあたり$2/1M in (prompts ≤200K)、出力100万トークンあたり$12/1M out (prompts ≤200K)です。 標準ティア:プロンプト200K以下は$2/$12 per 1M tokens、200K超は$4/$18、バッチは50%オフ。2026年3月9日に引退、後継のGemini 3.1 Proは同一価格を維持しています。