Die Arena · KI-Modell im Test

GPT-5.2

von OpenAI

OpenAIs Frontier-Modell vom Dez 2025: 400K Kontext, 80% SWE-bench Verified, starkes Reasoning, aber langsamer Output.

Arena-Score 3.5/550% empfehlen es · 2 Stimmen
Reasoning4.0
Coding4.0
Schreiben3.5
Tempo2.5
Preis-Leistung3.5
GPT-5.2 besuchenLong-Context-Analyseagentisches Codingmathematisches und naturwissenschaftliches Reasoningprofessionelle Dokumenten- und Tabellenarbeit
Preis

$14/1M out

Basis gpt-5.2 (Thinking) für $1.75/$14 pro 1M; gpt-5.2-pro-Tarif für $21/$168; gecachter Input $0.175 (90% Rabatt).

Anbieter

OpenAI

Kontextfenster

400K tokens (128K max output)

Input-Preis

$1.75/1M in

Output-Preis

$14/1M out

Modalitäten

text, vision (text output only)

Open Weights

Nein

Was ist GPT-5.2?

OpenAI-Frontier-Reasoning-Modell, veröffentlicht am 11. Dezember 2025, ausgerichtet auf professionelle Arbeit und langlaufende Agents. 400K Token Kontext, Text- und Bildeingabe, fünf Reasoning-Effort-Stufen (none bis xhigh). 2026 von GPT-5.4/5.5 abgelöst, aber weiter über die API verfügbar, zu Preisen der Vorgängergeneration.

GPT-5.2: Vor- und Nachteile

Vorteile

  • 80.0% SWE-bench Verified und 55.6% SWE-Bench Pro zum Start, nahezu gleichauf mit Claude Opus 4.5 (80.9%)
  • GDPval: erreicht oder schlägt menschliche Fachkräfte in 70.9% der Vergleiche, fast das Doppelte der 38.8% von GPT-5.1
  • Stark in Naturwissenschaften und Mathematik: 92.4% GPQA Diamond (Thinking, 93.2% Pro) und 40.3% FrontierMath, State of the Art zum Release
  • 400K Kontext mit nahezu perfekter MRCR-v2-Long-Context-Abfrage bis 256K Tokens
  • 30% weniger Halluzinationen als GPT-5.1 (Fehlerquote bei echten ChatGPT-Anfragen von 8.8% auf 6.2% gesenkt)
  • Günstiger als seine Nachfolger: $1.75/$14 pro 1M gegenüber $2.50/$15 (GPT-5.4) und $5/$30 (GPT-5.5)

Nachteile

  • Tempo ist die häufigste Beschwerde der Community: Extended Thinking wurde in ChatGPT mit bis zu ~4 Tokens/s gemessen, und Pro kann sehr lange nachdenken und trotzdem scheitern
  • Die Spitzen-Benchmarkwerte entstanden auf der Reasoning-Stufe xhigh, die weit mehr Tokens und Zeit verbraucht als die Standardeinstellungen
  • Vielkritisierter Persönlichkeits-Rückschritt gegenüber GPT-5.1: Reddit-Nutzer nannten es 'zu korporativ, zu brav' und 'einen Schritt zurück' für Chat und Schreiben
  • Coding liegt in direkten Elo-Vergleichen hinter Anthropics Reihe (eine spätere Opus-4.7-Analyse nannte 144 Elo Abstand); keine Audio-Modalität, kein Fine-Tuning
  • Stand Mitte 2026 bereits abgelöst: OpenAI empfiehlt GPT-5.5, und GPT-5.2 taucht auf der Haupt-Preisseite der API nicht mehr auf

Das Urteil der Arena

Wählen Sie GPT-5.2 statt GPT-5.1 für schweres Reasoning, Long-Context- oder agentische Arbeit: Es verdoppelt fast die GDPval-Gewinnquote von GPT-5.1, senkt Halluzinationen um 30% und verarbeitet 400K-Kontexte zuverlässig. Mitte 2026 ist es vor allem ein Preistipp: $1.75/$14 gegenüber $5/$30 für GPT-5.5, bei weiterhin solider Leistung in den meisten professionellen Aufgaben. Meiden Sie es für latenzsensiblen Chat und kreatives Schreiben, wo Nutzer es langsam und blasser als GPT-5.1 fanden. Teams, die OpenAIs aktuelle Spitze wollen, sollten stattdessen für GPT-5.5 tiefer in die Tasche greifen.

Daumen hoch oder Daumen runter

Fällen Sie Ihr Urteil

Würden Sie GPT-5.2 empfehlen oder die Menge davor warnen?

50%Crowd-Score · 2

Top-Alternativen zu GPT-5.2

Alle Alternativen
1
Claude Haiku 4.5

Anthropics schnellstes Modell: etwa 90% der Coding-Stärke von Sonnet 4.5 für $1/$5 pro 1M Tokens, 200K Kontext.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropics Mythos-Klasse-Flaggschiff vom Juni 2026: 80.3% auf SWE-bench Pro, 11 Punkte vor jedem anderen Frontier-Modell

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropics Opus vom April 2026: 87.6% SWE-bench Verified, 1M Kontext, hochauflösende Vision, inzwischen hinter Opus 4.8

$25/1M out57%(3)
Visit

GPT-5.2 im direkten Vergleich

Was die Menge sagt

Nullus Refundus

The thinking speed is brutal, I clocked something like 4 tok/s in ChatGPT on extended thinking. Pro will grind for ages and still whiff. Great scores, painful to actually use.

Sankt Deployus

GDPval numbers are wild, it ties or beats human pros in 71% of comparisons. For science and math work (92.4 GPQA Diamond) it earned a spot in my stack.

GPT-5.2: häufige Fragen

Was kostet GPT-5.2 pro 1M Tokens?

GPT-5.2 kostet $1.75/1M in pro 1M Input-Tokens und $14/1M out pro 1M Output-Tokens. Basis gpt-5.2 (Thinking) für $1.75/$14 pro 1M; gpt-5.2-pro-Tarif für $21/$168; gecachter Input $0.175 (90% Rabatt).