OpenAI Codex · Kosten und Limits

Was OpenAI Codex wirklich kostet: Credit-Modell, Limits und Team-Rechnung

Kurz gesagt

Was OpenAI Codex im Unternehmen kostet, entscheidet sich seit April 2026 nicht mehr am Plan-Preis. Codex rechnet über Token-Credits, der Listenpreis ist nur die Untergrenze, der Output-Token der teure Teil. Laut OpenAI liegt die aktive Nutzung bei 100 bis 200 US-Dollar je Power-User und Monat.

14 KI-Agenten in Produktion
anbieterneutral gerechnet
Coding-Agents täglich im Einsatz
Microsoft Solutions Partner (Digital & App Innovation, Infrastructure Azure, Data & AI Azure), ISO/IEC 27001, Google Cloud Partner, AWS Partner

Warum die Kosten-Schätzung pro Sitz teuer wird

Die häufigste Fehlkalkulation lautet: Zahl der Entwickler mal Plan-Preis. Seit dem Billing-Wechsel am 02.04.2026 ist das falsch. Codex rechnet über Token-Credits (ein Credit rund 0,04 USD), und die tatsächliche Rechnung hängt am Token-Verbrauch, nicht am gebuchten Plan.

Der Plan-Preis täuscht
Plus kostet 20 US-Dollar, aber das ist die Untergrenze, nicht die Rechnung. Realistisch sind laut OpenAI 100 bis 200 US-Dollar je Power-User und Monat.
Der Output-Token treibt die Kosten
Beim Standardmodell GPT-5.5 kostet Output das Sechsfache des Inputs. Nicht der Kontext ist teuer, sondern die Antwortlänge und die Retry-Schleifen.
Limits sind die eigentliche Bremse
Codex hat ein 5-Stunden-Fenster und ein wöchentliches Limit. Wer sie ignoriert, plant mit Kapazität, die im Peak nicht da ist.

Ihre Vorteile in Zahlen

Vier belegte Zahlen, die jede Codex-Budgetierung braucht, bevor der erste Entwickler startet.

0,04 USD je Credit
Die Abrechnungseinheit seit April 2026, jeder Token-Verbrauch wird in Credits umgerechnet (OpenAI Rate Card, 2026)
6x teurer je Output-Token
GPT-5.5 kostet 125 Credits je 1 Mio. Input und 750 je 1 Mio. Output, der Kostenhebel liegt in der Antwortlänge (OpenAI Rate Card, 2026)
90-185 EUR je Power-User/Monat
OpenAIs Schätzung für aktive Nutzung (100 bis 200 US-Dollar), die realistische Planungsgröße pro Kopf (OpenAI, 2026)
-50 % mit GPT-5.4 statt 5.5
Das absolut günstigere GPT-5.4 halbiert die Token-Kosten, ideal für Routine-Tasks (OpenAI Rate Card, 2026)

Ab wann sich ein Codex-Budget-Cap lohnt

Ein Budget-Cap pro Team lohnt sich, sobald ab rund 10 Entwickler regelmäßig mit Codex arbeiten, die Kosten über 1.500 EUR im Monat steigen und der Output-Token zum Haupttreiber wird.
ab 10
Entwickler im Team
1.500 EUR
Monatskosten überschritten
Output
ist der Haupttreiber

Anwendungsbeispiele

Use Case 01

10 Entwickler

Ein Team mit moderater Nutzung, GPT-5.5 als Standard, wenige Cloud-Tasks.

Rund 1.500 EUR im Monat (Modellrechnung).
Use Case 02

20 Entwickler

Aktive Nutzung mit regelmäßiger Delegation und Review-Läufen.

Rund 3.000 EUR im Monat (Modellrechnung).
Use Case 03

50 Entwickler

Breiter Rollout über mehrere Teams mit zentralem Credit-Pool.

Rund 7.400 EUR im Monat (Modellrechnung).
Use Case 04

Der Kostenhebel

Routine-Tasks bewusst auf das günstigere GPT-5.4 statt GPT-5.5 legen.

Halbiert die Kosten dieser Tasks.

Integration in Ihre Umgebung

Zwei Fragen entscheiden über die Rechnung: Wie funktioniert das Credit-Modell, und welcher Plan passt zu welchem Team?

Wie das Credit-Modell funktioniert

Credit · Rund 0,04 US-Dollar wert, die Abrechnungseinheit seit April 2026.
Input und Output · Zwei getrennte Token-Arten, Output ist bei GPT-5.5 sechsmal so teuer.
Cached Input · Wiederholter Kontext kostet nur rund ein Zehntel des frischen Inputs.

Die sechs Pläne

Free und Go · 0 und 8 US-Dollar, für Einzelnutzung und erste Tests.
Plus und Pro · 20, 100 und 200 US-Dollar, für echten Team-Einsatz.
Business · Rund 25 US-Dollar je Nutzer mit zentralem Credit-Pool und Admin-Steuerung.

Wie die Kostenkontrolle funktioniert

1
Modell routen
Routine auf GPT-5.4, harte Tasks auf GPT-5.5. Der größte Hebel, kostet nur eine Konvention.
2
Budget-Cap setzen
Credit-Limit pro Team mit klarer Kostenzuordnung.
3
Alarme einrichten
Schwellen vor dem Überlauf, keine böse Überraschung auf der Monatsrechnung.
4
Antwortlänge steuern
Kürzere, präzisere Prompts erzeugen kürzere Antworten und weniger Output-Token.
5
Retries senken
Gute AGENTS.md-Konventionen senken die Nachlauf-Rate, jeder Retry verdoppelt Output-Kosten.
6
Verbrauch messen
Usage-Dashboard und Team-Reports zeigen, wo die Credits verbrennen.
Erfahren Sie mehr über die volle Credit-Rechnung für 20 Entwickler

Warum Pexon statt Inhouse-Entwicklung

Selbst schätzen
Plan-Preis als Kostenbasis unterschätzt die echte Rechnung
Kein Modell-Routing, alles läuft teuer auf dem Standardmodell
Budget-Überläufe fallen erst auf der Rechnung auf
Klassisches Consulting
Nennt Listenpreise, nicht die token-basierte Realität
Kein Setup für Budget-Caps und Modell-Routing
Beratung endet vor der technischen Durchsetzung
Mit Pexon
Rechnet token-basiert und anbieterneutral, mit offengelegten Annahmen
Setzt Budget-Caps, Alarme und Modell-Routing technisch um
Betreibt selbst 14 KI-Agenten in Produktion, kennt die echten Kosten

In 4 Phasen zur produktiven Lösung

1
Woche 1
Nutzungsprofil klären
Wie viele Entwickler, welche Task-Typen, wie viel Delegation.
2
Woche 1-2
Modellrechnung
Credit-Hausnummer für Ihre Team-Größe mit offengelegten Annahmen.
3
Woche 2-3
Caps und Routing
Budget-Cap pro Team, Modell-Routing und Alarme einrichten.
4
ab Woche 4
Messen und nachsteuern
Realverbrauch gegen Modellrechnung prüfen, Caps nachjustieren.

Der Einstieg: Kostenmodell durchrechnen

Bevor Budget fließt, rechnen wir in 30 Minuten Ihr Codex-Kostenmodell durch, anbieterneutral und mit offengelegten Annahmen.

Microsoft Solutions Partner (Digital & App Innovation, Infrastructure Azure, Data & AI Azure), ISO/IEC 27001, Google Cloud Partner, AWS Partner
Ihre Investition
ab Kostenlos Erstgespräch
30 Minuten · ohne Verpflichtung
Enthält:

Modellrechnung · Grobe EUR-Hausnummer für Ihre Team-Größe.

Kostenhebel · Wo bei Ihnen das meiste Budget verbrennt und wie Sie es senken.

Cap-Konzept · Wie ein Budget-Cap pro Team konkret aussieht, ohne Abnahmezwang.
Jetzt Kontakt aufnehmen
100 % unverbindlich, ohne Verpflichtung

Häufige Fragen

Was kostet OpenAI Codex im Unternehmen?

Seit April 2026 rechnet Codex über Token-Credits, nicht pro Sitz. Realistisch sind laut OpenAI 100 bis 200 US-Dollar je Power-User und Monat, umgerechnet rund 90 bis 185 EUR. Für 20 Entwickler sind das grob 3.000 EUR im Monat, je nach Nutzungsprofil.
Was kostet Codex pro Token?

Beim Standardmodell GPT-5.5 rund 5 US-Dollar je 1 Million Input-Token und 30 US-Dollar je 1 Million Output-Token (125 bzw. 750 Credits zu je etwa 0,04 USD). Das günstigere GPT-5.4 kostet die Hälfte. Der Output-Token ist der entscheidende Kostenfaktor.
Warum reicht der Plan-Preis nicht als Rechnung?

Der Plan-Preis von 8 bis 200 US-Dollar ist nur die Untergrenze. Seit dem Billing-Wechsel im April 2026 entsteht die tatsächliche Rechnung aus dem Token-Verbrauch, und der hängt am Nutzungsverhalten, nicht am gebuchten Plan.
Was sind die Codex-Limits?

Codex hat ein 5-Stunden-Fenster und ein zusätzliches wöchentliches, rollierendes Limit. Den Reset zeigt das Usage-Dashboard. Für die Planung sollten Sie einen Puffer einrechnen, weil das Limit im Peak die verfügbare Kapazität begrenzt.
Wo lohnt sich Codex kostenseitig nicht?

Ohne Budget-Cap und Modell-Routing werden die Kosten schnell unkontrolliert. Für sehr geringe, sporadische Nutzung kann ein günstigerer Plan oder ein anderes Tool sinnvoller sein. Der Break-even für den Aufwand liegt aus unserer Praxis bei etwa 10 aktiven Entwicklern.
Wie senke ich die Codex-Kosten am schnellsten?

Der größte Hebel ist die Modellwahl: Routine-Tasks auf das günstigere GPT-5.4, harte Aufgaben auf GPT-5.5. Danach kürzere Antworten und weniger Retries über gute AGENTS.md-Konventionen. Ein Budget-Cap pro Team verhindert Überraschungen.

Codex-Kostenmodell für Ihr Team durchrechnen lassen

Wir rechnen Ihr Codex-Kostenmodell anbieterneutral durch, mit offengelegten Annahmen und einem Cap-Konzept, das die Rechnung planbar macht.

Jetzt Kontakt aufnehmen

Nachricht senden

Kein passender Termin? Schreiben Sie uns, wir melden uns innerhalb von 24 Stunden.

Antwort innerhalb von 24 Stunden
Unverbindliches Erstgespräch
Persönlicher Ansprechpartner
Phillip Pham
Phillip Pham
CEO @ Pexon Consulting
Aktualisiert am 12. August 2026

Sie suchen einen Partner für Ihr Projekt?

Wir analysieren Ihren individuellen Bedarf, geben erste Empfehlungen zu Umsetzungsstrategien und bieten Ihnen transparente Einblicke in unsere Methoden, Technologien und Referenzen.

Vertrieb kontaktieren
Microsoft Solutions Partner (Digital & App Innovation, Infrastructure Azure, Data & AI Azure), ISO/IEC 27001, Google Cloud Partner, AWS Partner
400+Projekte seit 2020
100+Kunden im DACH-Raum
ISO27001 zertifiziert
3Hyperscaler Partner