Die Arena · KI-Coding-Assistent im Test

OpenAI Codex

von OpenAI

OpenAIs Überall-Coding-Agent: 88.7% auf SWE-bench Verified mit GPT-5.5, gebündelt mit ChatGPT-Plänen ab $8/Monat

Arena-Score 4.3/557% empfehlen es · 3 Stimmen
Codequalität4.5
Agentische Autonomie4.5
Bedienbarkeit4.0
Tempo4.0
Preis-Leistung4.5
OpenAI Codex besuchenparallele Coding-Aufgaben im Hintergrund in der CloudTerminal- und DevOps-AutomatisierungGitHub-PR-Reviews in großem MaßstabEntwickler, die bereits für ChatGPT zahlen
Preis

Ab $8/Monat

Codex ist in den ChatGPT-Plänen gebündelt: Free (limitiert), Go $8/Monat, Plus $20/Monat, Business $20/Nutzer/Monat (jährlich, ab 2 Sitzplätzen), Pro ab $100/Monat mit 5x- oder 20x-Limits; die Credit-Kosten pro 1M Tokens auf Plus betragen 125 in / 750 out für GPT-5.6 Sol; API-Nutzung wird pro Token abgerechnet, ohne feste Limits. Geprüft anhand von developers.openai.com/codex/pricing, Stand 2026-07.

Anbieter

OpenAI

Gratis-Tarif

ChatGPT Free includes limited Codex usage for basic exploration

Formfaktor

Cloud agent

Modellauswahl

Nein

Open Source

Ja

API

Ja

Was ist OpenAI Codex?

OpenAIs agentisches Software-Engineering-System, im Mai 2025 als Cloud-Agent gestartet und heute mit Open-Source-CLI, VS-Code-Erweiterung, GitHub-PR-Reviews, Cloud-Aufgaben und seit Juli 2026 der ChatGPT-Desktop-App auf macOS und Windows. Es läuft auf OpenAIs Frontier-Modellen (GPT-5.6, GPT-5.5, GPT-5.3-Codex) und ist in jedem ChatGPT-Abo enthalten, vom $8-Go-Plan bis zu den Pro-Stufen ab $100, alternativ per API mit Abrechnung pro Token.

OpenAI Codex: Vor- und Nachteile

Vorteile

  • State-of-the-Art-Unterbau: GPT-5.5 erreicht 88.7% auf SWE-bench Verified und 83.4% auf Terminal-Bench 2.1, vor dem gesamten Feld bei agentischer Arbeit auf der Kommandozeile
  • Günstigster ernsthafter Einstieg der Kategorie: enthalten in ChatGPT Go für $8/Monat und Plus für $20/Monat, mit einem brauchbaren Gratis-Tarif für leichte Aufgaben
  • Von Grund auf multi-surface: Open-Source-CLI (Apache 2.0), VS-Code-Erweiterung, Cloud-Agent mit parallelen Aufgaben, ChatGPT-Desktop-App (Juli 2026) und Fernsteuerung Ihres Rechners aus der iOS-/Android-App
  • Das Feature-Tempo 2026 ist unerreicht: Computer Use unter Windows, Record & Replay, das vorgeführte Workflows in wiederverwendbare Skills verwandelt, Kurskorrektur mitten in der Ausführung und GitHub-PR-Reviews mit Inline-Feedback
  • Die Research Preview GPT-5.3-Codex-Spark streamt mit mehr als 1,000 Tokens pro Sekunde für nahezu sofortige Iteration
  • Tester berichten, dass GPT-5.5 deutlich token-effizienter ist als GPT-5.4, dieselben Abo-Credits reichen also weiter

Nachteile

  • Der Wechsel zur Credit-/Token-basierten Abrechnung im April 2026 machte die Kosten schwer kalkulierbar: ein komplexes Refactoring über mehrere Dateien kann rund 9x so viele Credits verbrauchen wie ein kleiner Skript-Fix
  • Die Ratenlimits der Plus-Stufe greifen in 5-Stunden-Fenstern (15 bis 90 Nachrichten mit GPT-5.6 Sol); wer täglich intensiv nutzt, wird Richtung Pro-Pläne ab $100 gedrängt
  • Praktiker bevorzugen für Architekturentscheidungen und komplexe Multi-Datei-Refactorings, die beim ersten Mal sitzen müssen, weiterhin Claude Code; ein gängiges Muster 2026 ist Codex für die Implementierung im Hintergrund, Claude Code für die harten Teile
  • Korrektheitskritische Aufgaben brauchen die langsame Reasoning-Stufe xhigh, und selbst dann sind halluzinierte Details nur reduziert, nicht eliminiert
  • Das volle Erlebnis setzt voraus, dass Sie im ChatGPT-/OpenAI-Ökosystem leben; kein eigenes Modell im gehosteten Produkt mitbringbar

Das Urteil der Arena

Wenn Sie bereits für ChatGPT zahlen, ist das Aktivieren von Codex ein Selbstläufer: für $8 bis $20 pro Monat ist es derzeit das beste Preis-Leistungs-Verhältnis im agentischen Coding, und der GPT-5.5/5.6-Unterbau steht 2026 bei jedem Coding-Benchmark an oder nahe der Spitze. Nehmen Sie es, wenn Sie einen Agenten über CLI, IDE, Cloud, Desktop und Smartphone hinweg wollen. Meiden Sie die Plus-Stufe, wenn Sie den ganzen Tag coden: die 5-Stunden-Fenster werden Sie frustrieren, planen Sie stattdessen Pro ab $100 ein. Wenn Ihre Arbeit von heiklen Großrefactorings dominiert wird, behalten Sie Claude Code im Werkzeugkasten; viele Teams fahren beide.

Daumen hoch oder Daumen runter

Fällen Sie Ihr Urteil

Würden Sie OpenAI Codex empfehlen oder die Menge davor warnen?

57%Crowd-Score · 3

Top-Alternativen zu OpenAI Codex

Alle Alternativen
1
Cline

Der meistgenutzte Open-Source-Coding-Agent: über 58K GitHub-Sterne, über 5M Installationen, $0 Software mit BYOK-Inferenz zum Selbstkostenpreis

Free71%(3)
Try free
2
Lovable

Der schwedische Vibe-Coding-Marktführer: vom Prompt zur Full-Stack-Web-App, rund $500M ARR keine zwei Jahre nach dem Start

$25/mo71%(3)
Try free
3
Cursor

Die Agent-first-KI-IDE jenseits von $2B ARR: Composer 2.5 zieht auf SWE-Bench mit Claude Opus 4.7 gleich, für rund 1/10 der Kosten

$20/mo57%(3)
Try free

OpenAI Codex im direkten Vergleich

Was die Menge sagt

Nullus Refundus

Since the credit billing change I have no idea what a task will cost. One refactor ate a third of my weekly limit on Plus. Felt punished for using it.

Wächter des Repos

The PR review integration alone is worth it. It catches the dumb stuff before my human reviewer even looks.

Champion der Vibes

Kicked off three cloud tasks from my phone during lunch, came back to two mergeable PRs. The $20 Plus plan covers my whole side-project workflow.

OpenAI Codex: häufige Fragen

Ist OpenAI Codex kostenlos?

OpenAI Codex bietet einen Gratis-Tarif (ChatGPT Free includes limited Codex usage for basic exploration). Bezahlte Tarife starten bei $8/Monat.

Was kostet OpenAI Codex?

OpenAI Codex startet bei $8/Monat (Freemium). Codex ist in den ChatGPT-Plänen gebündelt: Free (limitiert), Go $8/Monat, Plus $20/Monat, Business $20/Nutzer/Monat (jährlich, ab 2 Sitzplätzen), Pro ab $100/Monat mit 5x- oder 20x-Limits; die Credit-Kosten pro 1M Tokens auf Plus betragen 125 in / 750 out für GPT-5.6 Sol; API-Nutzung wird pro Token abgerechnet, ohne feste Limits. Geprüft anhand von developers.openai.com/codex/pricing, Stand 2026-07.