アリーナ · AIモデルレビュー

GPT-5.5

開発:OpenAI

OpenAIのエージェント特化フラッグシップ:1Mコンテキスト、ARC-AGI-2とTerminal-Bench 2.0でSOTA、$5/$30 per 1M tokens。

アリーナスコア 4/557%が推薦 · 3票
推論5.0
コーディング4.5
ライティング4.0
速度3.5
コスパ3.0
GPT-5.5 のサイトへエージェント型コーディング長文コンテキスト分析コンピュータ操作エージェントターミナル・CLI自動化
価格

$30/1M out

標準ティアは$5/$30 per 1M tokens(キャッシュ済み入力$0.50)で、GPT-5.4の$2.50/$15の2倍。Batch/Flexは$2.50/$15、Priorityは$12.50/$75、GPT-5.5 Proは$30/$180。入力272K tokens超のプロンプトは入力2x / 出力1.5xで課金されます。

プロバイダー

OpenAI

コンテキストウィンドウ

1M tokens (1,050,000)

入力料金

$5/1M in

出力料金

$30/1M out

モダリティ

text, vision (image input, text output)

オープンウェイト

なし

GPT-5.5 とは?

2026年4月23日にリリースされたOpenAIのフラッグシップ推論モデルです。エージェント型コーディング、コンピュータ操作、長期ナレッジワーク向けに設計され、1,050,000 tokensのコンテキストウィンドウと128Kの最大出力を備えます。テキストと画像の入力、テキスト出力に対応し、function calling、structured outputs、Responses API経由のホスト型エージェントツールを提供します。

GPT-5.5 の長所と短所

長所

  • 1M tokensのコンテキストウィンドウ(1,050,000)と128Kの最大出力、推論エフォートはnoneからxhighまで調整可能です
  • ARC-AGI-2で85.0%(GPT-5.4は73.3%)、Terminal-Bench 2.0で82.7%のstate-of-the-artです
  • エージェント型コーディングの自律性が高い:GPT-5.4が複数ターンかけたタスクを一発で完了し、自分のミスを修正すると開発者が報告。Code ArenaではGPT-5.4比+50ポイントです
  • 積極的な割引:キャッシュ済み入力は90%オフ($0.50/1M)、BatchまたはFlex経由で50%オフ($2.50/$15)です
  • フロンティア推論モデルとしては高速:中・低の思考エフォートで快適に回せる初のGPTモデルと開発者は評しています

短所

  • リスト価格がGPT-5.4比で倍増($5/$30 vs $2.50/$15)、コンテキストウィンドウは同じ1M tokensのままです
  • 指示に過度に忠実:Claudeなら意図を汲む明白な場面で、意図の推測に失敗すると開発者が報告しています
  • SWE-bench ProではClaude Opus 4.8に後れ(58.6% vs 69.2%)。HNの開発者は依然コーディングでClaudeを約2:1で支持しています
  • コード変更に保守的すぎたり、複雑なプロンプトに深い推論を完全にスキップして即答したりすることがあります
  • 長文コンテキスト割増:入力272K tokensを超えるプロンプトは、セッション全体で入力2倍・出力1.5倍で課金されます

アリーナの評決

より強いエージェント自律性、ターミナル中心のワークフロー、SOTAの抽象推論が必要ならGPT-5.4よりGPT-5.5を選んでください。ただしリスト価格はGPT-5.4の$2.50/$15から$5/$30に倍増し、1M tokensのコンテキストは据え置きです。高リスクの複数ファイルリファクタリングを行うチームは、SWE-bench Proで首位(69.2% vs 58.6%)で曖昧なプロンプトから意図をよく汲むClaude Opusの方を好むかもしれません。予算重視のユーザーは272K tokensの割増と制限消費が速いという報告に注意し、キャッシュ、Batch、Flexを活用してコストを半減させましょう。

親指を上げるか、下げるか

あなたの審判を下す

GPT-5.5 を推薦しますか?それとも観客に警告しますか?

57%観客スコア · 3

GPT-5.5 の代替ツールTOP

すべての代替ツール
1
Claude Haiku 4.5

Anthropic最速のモデル:Sonnet 4.5の約90%のコーディング力を$1/$5 per 1M tokensで、200Kコンテキスト。

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropicの2026年6月Mythosクラスフラッグシップ:SWE-bench Proで80.3%、他のあらゆるフロンティアモデルに11ポイントの差

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropicの2026年4月Opus:SWE-bench Verified 87.6%、1Mコンテキスト、高解像度ビジョン、現在はOpus 4.8に後れ

$25/1M out57%(3)
Visit

GPT-5.5 を1対1で比較

観客の声

親指下げリクス

It is painfully literal. Where Claude infers intent in obvious places, 5.5 wants everything spelled out. And the price doubled vs 5.4 for the same 1M context.

公正なる審判者

85 on ARC-AGI-2 and you can feel it. Stuff that used to stall my agent just resolves now. 1M context with 128K output covers every workflow I have.

リリース卿

5.5 one-shots tasks that took 5.4 three turns, and it fixes its own mistakes mid-run instead of doubling down. The reasoning effort dial from none to xhigh is genuinely useful.

GPT-5.5:よくある質問

GPT-5.5 の100万トークンあたりの料金は?

GPT-5.5 の料金は、入力100万トークンあたり$5/1M in、出力100万トークンあたり$30/1M outです。 標準ティアは$5/$30 per 1M tokens(キャッシュ済み入力$0.50)で、GPT-5.4の$2.50/$15の2倍。Batch/Flexは$2.50/$15、Priorityは$12.50/$75、GPT-5.5 Proは$30/$180。入力272K tokens超のプロンプトは入力2x / 出力1.5xで課金されます。