アリーナ · AIモデルレビュー

GPT-5.2

開発:OpenAI

OpenAIの2025年12月フロンティアモデル:400Kコンテキスト、SWE-bench Verified 80%、推論は強力だが出力は遅め。

アリーナスコア 3.5/550%が推薦 · 2票
推論4.0
コーディング4.0
ライティング3.5
速度2.5
コスパ3.5
GPT-5.2 のサイトへ長文コンテキスト分析エージェント型コーディング数学・科学推論業務文書・スプレッドシート作業
価格

$14/1M out

ベースのgpt-5.2(Thinking)は$1.75/$14 per 1M、gpt-5.2-proティアは$21/$168、キャッシュ済み入力は$0.175(90%割引)です。

プロバイダー

OpenAI

コンテキストウィンドウ

400K tokens (128K max output)

入力料金

$1.75/1M in

出力料金

$14/1M out

モダリティ

text, vision (text output only)

オープンウェイト

なし

GPT-5.2 とは?

2025年12月11日にリリースされた、プロフェッショナル業務と長時間稼働エージェント向けのOpenAIフロンティア推論モデルです。400K tokensコンテキスト、テキストと画像の入力、5段階の推論エフォート(noneからxhigh)を備えます。2026年にGPT-5.4/5.5に取って代わられましたが、旧世代価格でAPI提供が続いています。

GPT-5.2 の長所と短所

長所

  • 発売時にSWE-bench Verified 80.0%とSWE-Bench Pro 55.6%を記録、Claude Opus 4.5(80.9%)とほぼ互角です
  • GDPval:比較の70.9%で人間のプロフェッショナルと同等以上、GPT-5.1の38.8%のほぼ2倍です
  • 科学と数学に強い:GPQA Diamond 92.4%(Thinking、Proは93.2%)とFrontierMath 40.3%で、リリース時点のstate of the artでした
  • 400Kコンテキストで、256K tokensまでMRCR v2の長文検索がほぼ完璧です
  • GPT-5.1比でハルシネーションが30%減(実際のChatGPTクエリでのエラー率が8.8%から6.2%に低下)
  • 後継より安価:$1.75/$14 per 1Mで、GPT-5.4の$2.50/$15、GPT-5.5の$5/$30に対して割安です

短所

  • 速度がコミュニティ最大の不満:ChatGPTでの拡張思考は約4 tokens/sまで落ちるとの報告があり、Proは非常に長く考えた末に失敗することもあります
  • 看板のベンチマークスコアはxhigh推論エフォートで取得されたもので、デフォルト設定よりはるかに多くのトークンと時間を消費します
  • GPT-5.1からの人格の後退が広く批判されました:Redditユーザーは「企業的すぎ、安全すぎ」「チャットとライティングでは一歩後退」と評しています
  • コーディングは直接対決のElo比較でAnthropic系に後れます(後のOpus 4.7分析では144 Eloの差)。音声モダリティなし、ファインチューニング不可です
  • 2026年半ば時点で既に旧世代:OpenAIはGPT-5.5を推奨し、GPT-5.2はメインのAPI価格ページに載っていません

アリーナの評決

重い推論、長文コンテキスト、エージェント作業ならGPT-5.1よりGPT-5.2を選んでください。GDPvalの勝率はGPT-5.1のほぼ2倍、ハルシネーションは30%減、400Kコンテキストも安定して扱えます。2026年半ばでは主にコスパ狙いの選択肢で、GPT-5.5の$5/$30に対し$1.75/$14でほとんどの業務タスクをこなせます。レイテンシ重視のチャットやクリエイティブライティングには不向きで、ユーザーはGPT-5.1より遅く平板だと感じています。OpenAIの現行フロンティアが欲しいチームは、素直にGPT-5.5に投資すべきです。

親指を上げるか、下げるか

あなたの審判を下す

GPT-5.2 を推薦しますか?それとも観客に警告しますか?

50%観客スコア · 2

GPT-5.2 の代替ツールTOP

すべての代替ツール
1
Claude Haiku 4.5

Anthropic最速のモデル:Sonnet 4.5の約90%のコーディング力を$1/$5 per 1M tokensで、200Kコンテキスト。

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropicの2026年6月Mythosクラスフラッグシップ:SWE-bench Proで80.3%、他のあらゆるフロンティアモデルに11ポイントの差

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropicの2026年4月Opus:SWE-bench Verified 87.6%、1Mコンテキスト、高解像度ビジョン、現在はOpus 4.8に後れ

$25/1M out57%(3)
Visit

GPT-5.2 を1対1で比較

観客の声

返金なしウス

The thinking speed is brutal, I clocked something like 4 tok/s in ChatGPT on extended thinking. Pro will grind for ages and still whiff. Great scores, painful to actually use.

聖デプロイウス

GDPval numbers are wild, it ties or beats human pros in 71% of comparisons. For science and math work (92.4 GPQA Diamond) it earned a spot in my stack.

GPT-5.2:よくある質問

GPT-5.2 の100万トークンあたりの料金は?

GPT-5.2 の料金は、入力100万トークンあたり$1.75/1M in、出力100万トークンあたり$14/1M outです。 ベースのgpt-5.2(Thinking)は$1.75/$14 per 1M、gpt-5.2-proティアは$21/$168、キャッシュ済み入力は$0.175(90%割引)です。