アリーナ · AIモデルレビュー
GPT-5.5
開発:OpenAI
OpenAIのエージェント特化フラッグシップ:1Mコンテキスト、ARC-AGI-2とTerminal-Bench 2.0でSOTA、$5/$30 per 1M tokens。
$30/1M out
標準ティアは$5/$30 per 1M tokens(キャッシュ済み入力$0.50)で、GPT-5.4の$2.50/$15の2倍。Batch/Flexは$2.50/$15、Priorityは$12.50/$75、GPT-5.5 Proは$30/$180。入力272K tokens超のプロンプトは入力2x / 出力1.5xで課金されます。
OpenAI
1M tokens (1,050,000)
$5/1M in
$30/1M out
text, vision (image input, text output)
なし
GPT-5.5 とは?
2026年4月23日にリリースされたOpenAIのフラッグシップ推論モデルです。エージェント型コーディング、コンピュータ操作、長期ナレッジワーク向けに設計され、1,050,000 tokensのコンテキストウィンドウと128Kの最大出力を備えます。テキストと画像の入力、テキスト出力に対応し、function calling、structured outputs、Responses API経由のホスト型エージェントツールを提供します。
GPT-5.5 の長所と短所
長所
- 1M tokensのコンテキストウィンドウ(1,050,000)と128Kの最大出力、推論エフォートはnoneからxhighまで調整可能です
- ARC-AGI-2で85.0%(GPT-5.4は73.3%)、Terminal-Bench 2.0で82.7%のstate-of-the-artです
- エージェント型コーディングの自律性が高い:GPT-5.4が複数ターンかけたタスクを一発で完了し、自分のミスを修正すると開発者が報告。Code ArenaではGPT-5.4比+50ポイントです
- 積極的な割引:キャッシュ済み入力は90%オフ($0.50/1M)、BatchまたはFlex経由で50%オフ($2.50/$15)です
- フロンティア推論モデルとしては高速:中・低の思考エフォートで快適に回せる初のGPTモデルと開発者は評しています
短所
- リスト価格がGPT-5.4比で倍増($5/$30 vs $2.50/$15)、コンテキストウィンドウは同じ1M tokensのままです
- 指示に過度に忠実:Claudeなら意図を汲む明白な場面で、意図の推測に失敗すると開発者が報告しています
- SWE-bench ProではClaude Opus 4.8に後れ(58.6% vs 69.2%)。HNの開発者は依然コーディングでClaudeを約2:1で支持しています
- コード変更に保守的すぎたり、複雑なプロンプトに深い推論を完全にスキップして即答したりすることがあります
- 長文コンテキスト割増:入力272K tokensを超えるプロンプトは、セッション全体で入力2倍・出力1.5倍で課金されます
アリーナの評決
より強いエージェント自律性、ターミナル中心のワークフロー、SOTAの抽象推論が必要ならGPT-5.4よりGPT-5.5を選んでください。ただしリスト価格はGPT-5.4の$2.50/$15から$5/$30に倍増し、1M tokensのコンテキストは据え置きです。高リスクの複数ファイルリファクタリングを行うチームは、SWE-bench Proで首位(69.2% vs 58.6%)で曖昧なプロンプトから意図をよく汲むClaude Opusの方を好むかもしれません。予算重視のユーザーは272K tokensの割増と制限消費が速いという報告に注意し、キャッシュ、Batch、Flexを活用してコストを半減させましょう。
親指を上げるか、下げるか
あなたの審判を下す
GPT-5.5 を推薦しますか?それとも観客に警告しますか?
GPT-5.5 の代替ツールTOP
すべての代替ツールAnthropic最速のモデル:Sonnet 4.5の約90%のコーディング力を$1/$5 per 1M tokensで、200Kコンテキスト。
Anthropicの2026年6月Mythosクラスフラッグシップ:SWE-bench Proで80.3%、他のあらゆるフロンティアモデルに11ポイントの差
Anthropicの2026年4月Opus:SWE-bench Verified 87.6%、1Mコンテキスト、高解像度ビジョン、現在はOpus 4.8に後れ
GPT-5.5 を1対1で比較
観客の声
“It is painfully literal. Where Claude infers intent in obvious places, 5.5 wants everything spelled out. And the price doubled vs 5.4 for the same 1M context.”
“85 on ARC-AGI-2 and you can feel it. Stuff that used to stall my agent just resolves now. 1M context with 128K output covers every workflow I have.”
“5.5 one-shots tasks that took 5.4 three turns, and it fixes its own mistakes mid-run instead of doubling down. The reasoning effort dial from none to xhigh is genuinely useful.”
GPT-5.5:よくある質問
GPT-5.5 の100万トークンあたりの料金は?
GPT-5.5 の料金は、入力100万トークンあたり$5/1M in、出力100万トークンあたり$30/1M outです。 標準ティアは$5/$30 per 1M tokens(キャッシュ済み入力$0.50)で、GPT-5.4の$2.50/$15の2倍。Batch/Flexは$2.50/$15、Priorityは$12.50/$75、GPT-5.5 Proは$30/$180。入力272K tokens超のプロンプトは入力2x / 出力1.5xで課金されます。