一騎打ち

Grok 4.3 のロゴvsGemini 3 Pro のロゴ

Grok 4.3 vs Gemini 3 Pro:2026年に勝つAIモデルはどっち?

Grok 4.3($2.50/1M out)と Gemini 3 Pro($12/1M out (prompts ≤200K))は、2026年に最も使われているAIモデルのひとつです。 3件のコミュニティ票のうち、Gemini 3 Pro が支持率57%でリードしています。

即断の評決

推論で選ぶなら Gemini 3 Pro:アリーナの評価は4.5/5、対する Grok 4.3 は4/5です。 予算重視なら Grok 4.3 の勝ち:$2.50/1M outから始められるのに対し、Gemini 3 Pro は$12/1M out (prompts ≤200K)からです。

項目別比較

最低価格
$2.50/1M out全推論エフォートティアで一律の入力$1.25 / 出力$2.50、キャッシュ済み入力は$0.20/1M。xAI自身の価格ページに長文コンテキスト割増はありませんが、OpenRouterは合計200K tokens超に段階的な割増料金を掲載しています。
$12/1M out (prompts ≤200K)標準ティア:プロンプト200K以下は$2/$12 per 1M tokens、200K超は$4/$18、バッチは50%オフ。2026年3月9日に引退、後継のGemini 3.1 Proは同一価格を維持しています。
プロバイダー
xAI
Google (DeepMind)
コンテキストウィンドウ
1M tokens
1M tokens (64K output)
入力料金
$1.25/1M in
$2/1M in (prompts ≤200K)
出力料金
$2.50/1M out
$12/1M out (prompts ≤200K)
モダリティ
text, vision (text output only)
text, image, audio, video in; text out
オープンウェイト
なし
なし
観客スコア
50%(0)
57%(3)
アリーナ評価(1-5)
推論
4.0
4.5
コーディング
3.5
4.5
ライティング
4.5
3.5
速度
3.5
3.5
コスパ
4.5
4.0

強みと弱み

Grok 4.3

  • 攻めの価格設定:$1.25/$2.50 per 1M tokensで、Grok 4比で入力58%・出力83%安く、GPT-5.5とGemini 3.1 Proを下回ります
  • エージェント性能の大躍進:GDPval-AAでGrok 4.20比+321 Elo、ツール呼び出しと指示追従も強力です
  • キャッシュ済み入力は$0.20/1M(84%割引)で、繰り返しのエージェントループで大きな節約になります
  • 設定可能な推論エフォート(none/low/medium/high)を1つのモデル・1つの価格で提供、高速版と深思考版の間のルーティングは不要です
  • 自然で簡潔なトーンと、実コストを下げるトークン密度の高い出力がHNで称賛されています
  • スループットは約130出力tokens/秒と堅実です(Artificial Analysis)
  • コーディング推論はHNの開発者から「4月の大型リリース勢とは勝負にならない」と評され、知能のフロンティアはGrok 4からほとんど動いていません
  • AA-Omniscienceの非ハルシネーションスコアがGrok 4.20比で8ポイント低下:精度が命の領域では4.20が依然xAIの安全な選択です
  • 最初のトークンまでの時間が長く(高推論エフォートでArtificial Analysis計測約13秒)、対話型アプリにはつらいところです
  • コンテキストウィンドウはGrok 4.20の2Mから1Mに縮小しました
  • 信頼と安全性への苦情が繰り返されており(有害コンテンツの報告、一貫しない挙動)、コンシューマーアプリにMCP/接続アプリのサポートがありません

Gemini 3 Pro

  • 発売時にLMArenaで記録的な1501 Eloで首位に立ち、GPQA Diamondで91.9%を記録、リリース時点のstate of the artでした
  • ARC-AGI-2で31.1%、当時のGemini 2.5 Pro(4.9%)の約6倍、GPT-5.1(17.6%)のほぼ2倍です
  • クラス最高のマルチモーダル理解:MMMU-Pro 81%、Video-MMMU 87.6%、1M tokensのコンテキストウィンドウ付きです
  • エージェント型コーディングも強力:SWE-bench Verified 76.2%、Terminal-Bench 2.0 54.2%、WebDev Arenaで1487 Eloです
  • $2/$12 per 1M tokensでライバルより安く、Claude Sonnetクラスの価格($3/$15)を下回りました
  • 設定可能なthinking_level(low/medium/high)で、推論の深さとレイテンシ・コストを取引できます
  • 自信過剰なハルシネーション:AA-Omniscienceでは回答を控えるべき場面の88%で誤答しました。Claude Sonnet 4.5は48%です(the-decoder)
  • 追従性(シコファンシー)が広く報告されています(Zvi Mowshowitz:「背骨のない膨大な知性」)。厳格なシステムプロンプトが必要です
  • エージェントスタックでのツール呼び出しの信頼性問題:ツール出力がチャットスレッドに流れ込む、OpenAI/Anthropicのモデルより足場作りが必要、と開発者が報告しています
  • 高thinking levelでは遅い:出力速度は約130 tok/sあるものの、AI Studioで最初のトークンまで約30-60秒と計測されています
  • 引退済み:2026年3月9日にGemini APIとAI Studioで停止され、gemini-3-pro-previewは現在Gemini 3.1 Proのエイリアスです

あなたの審判を下す

1人につき各ツール1票。あなたの推薦が、みんなの見る観客スコアを動かします。

Grok 4.3$2.50/1M out
50%観客スコア · 0
Gemini 3 Pro$12/1M out (prompts ≤200K)
57%観客スコア · 3

Grok 4.3 へのアリーナの評決

呼び出し単価が支配的なエージェント型・大量処理パイプラインを運用しているならGrok 4.3を選んでください。GPT-5.5やGemini 3.1 Proのごく一部の価格で、フロンティアに迫る推論とGrok 4.20からのツール呼び出しの大幅な向上が得られます。コーディング精度が最優先なら見送ってください。開発者は依然Claudeと4月の大型リリース勢を上位に置いています。2Mコンテキストや、法務・医療・コンプライアンス業務向けのより高い非ハルシネーションスコアが必要ならGrok 4.20に留まりましょう。レイテンシ重視のアプリは、コミットする前に最初のトークンまで約13秒という点をテストすべきです。

Gemini 3 Pro へのアリーナの評決

2025年末にGoogleを再び頂点に押し上げた画期的なリリースで、Gemini 2.5 Proからの大幅な推論力向上とその世代最高のマルチモーダルスコアを誇りました。しかし2026年半ばの時点で選ぶ理由はありません。Googleは2026年3月9日にAPIでの提供を終了し、Gemini 3.1 Proはまったく同じ価格でARC-AGI-2性能を2倍以上(77.1% vs 31.1%)にしています。レガシー環境のチームは3.1 Proに移行すべきで、旧モデルIDはいずれにせよ既にそちらを指しています。ハルシネーションに敏感なワークロードでは、レビュアーが繰り返し指摘した弱点であるため、グラウンディングを追加しない限り避けてください。

観客の声

Grok 4.3 について

まだ審判はありません。最初の声を上げてください。

Gemini 3 Pro について

恐怖の判事

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

バイブスの覇者

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

グロリウス・マクシムス

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

よくある質問

Grok 4.3 は Gemini 3 Pro より優れていますか?

現在、観客は Gemini 3 Pro を支持しています:推薦率57%、対する Grok 4.3 は50%です(3票)。 推論では Gemini 3 Pro が上回っています(4.5/5 vs 4/5)。 最適な選択は用途次第です。このページの項目別比較で、料金、主要スペック、アリーナ評価を分解しています。

Grok 4.3 と Gemini 3 Pro、安いのはどちらですか?

Grok 4.3 の方が安く、$2.50/1M outから始められます。Gemini 3 Pro は$12/1M out (prompts ≤200K)からです。

Grok 4.3 と Gemini 3 Pro の100万トークンあたりの料金は?

Grok 4.3:入力100万トークンあたり$1.25/1M in、出力100万トークンあたり$2.50/1M out。Gemini 3 Pro:入力100万トークンあたり$2/1M in (prompts ≤200K)、出力100万トークンあたり$12/1M out (prompts ≤200K)。