Codex ist in den meisten ChatGPT-Tarifen enthalten – aber nicht ohne Limits. Nutzt du es für echte Arbeit, siehst du irgendwann die Meldung, dass dein Limit erreicht ist, meist im ungünstigsten Moment. Diese Anleitung erklärt, wie die Codex-Limits funktionieren, wie du sie prüfst, bevor es so weit ist, und welche Optionen du hast, wenn nichts mehr übrig ist.
Fakten geprüft am 24. September 2026 anhand der Codex-Dokumentation von OpenAI. OpenAI aktualisiert Modelle und Limits häufig; aktuelle Zahlen findest du auf der Codex-Preisseite.
Wie funktionieren die Codex-Nutzungslimits?
- Fünf-Stunden-Fenster. Die Codex-Nutzung in einem ChatGPT-Tarif wird über rollierende Fünf-Stunden-Zeiträume gemessen.
- Zusätzlich können Wochenlimits gelten. OpenAI veröffentlicht dafür keine Zahlen.
- Ein gemeinsames Kontingent. Lokale Arbeit in CLI oder IDE und Cloud-Aufgaben zehren vom selben Kontingent, das außerdem mit den anderen Agent-Funktionen von ChatGPT geteilt wird.
- Schätzwerte, keine festen Kontingente. Wie weit ein Fenster reicht, hängt vom Modell, der Größe deines Kontexts, dem Reasoning-Aufwand und den Tools ab, die der Agent nutzt. Eine lange Session über ein großes Repository verbraucht weit mehr als kurze Fragen.
Wie viel bekommst du pro Tarif?
OpenAI veröffentlicht geschätzte Spannen für lokale Nachrichten pro fünf Stunden. Stand September 2026:
| Modell | Plus | Pro 5x | Pro 20x |
|---|---|---|---|
| GPT-6 Astra | 5–45 | 25–225 | 100–900 |
| GPT-6 Sol | 15–150 | 70–700 | 300–3.000 |
| GPT-6 Luna | 350–3.000 | 1.750–14.000 | 7.000–56.000 |
| GPT-5.6 Sol | 10–100 | 50–500 | 200–2.000 |
Business-Plätze bekommen dieselben Schätzwerte wie Plus. Enterprise- und Edu-Workspaces mit flexibler Preisgestaltung haben keine festen Rate Limits und verbrauchen stattdessen Credits. Der Fast Mode verbraucht Credits bei GPT-6-Modellen 2,5-mal so schnell.
Genau die Spannweite ist der Punkt: Derselbe Tarif kann dir fünfzehn schwere Agent-Durchgänge geben oder hundertfünfzig leichte. Für einfache Aufgaben ein leichteres Modell zu wählen, ist dein größter Hebel.
So prüfst du deine Codex-Nutzung
In der CLI: /status
Führ das in einer Codex-Session aus:
/status
Der Befehl zeigt deine verbleibenden Limits zusammen mit dem aktuellen Modell, der Freigaberichtlinie und dem Token-Verbrauch der Session. Verwandte Befehle:
/usagezeigt deine Token-Aktivität nach Tag, Woche oder insgesamt./statuslinekann deine Limits in die Fußzeile legen, damit sie beim Arbeiten sichtbar bleiben.
Im Web
Das Codex-Nutzungsdashboard unter chatgpt.com/codex/settings/usage zeigt deine Nutzung über CLI, IDE, Desktop und Cloud hinweg.
Auf dem Mac, und zwar ständig
Vibe Console zeigt die Codex-Nutzung ohne Befehl an, direkt neben Claude Code:
- Ein Ring in der Notch und in der Terminal-Toolbar für das aktuelle Fünf-Stunden-Fenster, optional mit einem dünneren Bogen für das Wochenlimit.
- Eine Hover-Karte mit beiden Fenstern und ihren Reset-Zeiten.
- Eine macOS-Benachrichtigung bei 80 % und 100 % und eine Notch-Karte, wenn das Fenster zurückgesetzt wird.
Siehst du Codex und Claude nebeneinander, schiebst du Arbeit ganz einfach zu dem Agent, der gerade Luft hat. Die Claude-Seite erklärt der Artikel zu den Claude-Code-Nutzungslimits.
Was passiert, wenn du das Limit erreichst?
Ein Durchgang, der schon läuft, darf zu Ende laufen. Danach hast du vier Optionen:
- Auf den Reset warten. Die Uhrzeit zeigen
/statusoder dein Nutzungsring. - Zusätzliche Credits kaufen. Plus- und Pro-Nutzer können Credits kaufen, ohne den Tarif zu wechseln; Business-, Enterprise- und Edu-Workspaces mit flexibler Preisgestaltung können Workspace-Credits kaufen.
- Auf einen API-Key umsteigen. Melde dich mit einem OpenAI-API-Key an, um lokal zu API-Preisen weiterzuarbeiten. Die Cloud-Funktionen sind so nicht verfügbar.
- Upgraden. Die Pro-Tarife bieten das Fünf- oder Zwanzigfache der Nutzung von Plus.
So reichen deine Codex-Limits länger
- Wähle das Modell passend zur Aufgabe. Nimm GPT-6 Luna für Routineänderungen, Erklärungen und kleine Fixes und spar dir Astra oder Sol für Planung und harte Probleme auf.
- Halte den Kontext fokussiert. Verweise Codex auf die relevanten Dateien, halte
AGENTS.mdkurz und konkret und starte lieber eine neue Session, statt eine lange mitzuschleppen. - Verzichte auf den Fast Mode, wenn du ihn nicht brauchst. Er verbraucht Credits schneller.
- Teil die Arbeit mit einem anderen Agent. Gib Reviews oder kleinere Aufgaben an Claude Code ab, wenn bei Codex das Kontingent knapp wird. Ein Setup mit beiden zeigt Codex vs. Claude Code.
- Lies den Prozentwert zusammen mit der Reset-Zeit. 60 % verbraucht und noch eine Stunde übrig ist okay; 60 % in der ersten halben Stunde nicht.
FAQ
Wie lang ist das Zeitfenster beim Codex-Limit?
Fünf Stunden, rollierend. Zusätzlich können Wochenlimits gelten. /status zeigt genau, was übrig ist und wann es zurückgesetzt wird.
Teilt sich Codex die Limits mit ChatGPT?
Lokale und Cloud-Nutzung von Codex teilen sich ein Kontingent, und das wird mit den Agent-Funktionen von ChatGPT geteilt. Die Details zu deinem Tarif findest du im Nutzungsdashboard.
Gelten für API-Keys dieselben Limits?
Nein. Mit einem API-Key zahlst du pro Token und unterliegst den Rate Limits der API statt den Fenstern des Tarifs.
Warum war mein Limit so schnell erreicht?
Großer Kontext, ein schweres Modell, der Fast Mode und viele Tool-Aufrufe verbrauchen alle mehr vom Fenster. Mehrere parallele Codex-Sessions verbrauchen es außerdem entsprechend schneller.
Codex- und Claude-Limits im Blick behalten: Vibe Console 14 Tage kostenlos testen.
