Codex endet am 23. Juli. Opus 4.7 Fast Mode ohne Fallback.

OpenAI schaltet am 23. Juli 2026 Codex-Snapshots ab, Anthropic entfernt am 24. Juli den Fast Mode von Opus 4.7. Die Migrationscheckliste vor beiden Stichtagen.

Codex endet am 23. Juli. Opus 4.7 Fast Mode ohne Fallback.

Innerhalb von 48 Stunden laufen zwei harte Modell-Stichtage ab, am 23. und am 24. Juli 2026, und keiner von beiden endet sanft. Am 23. Juli 2026 schaltet OpenAI eine Reihe alter Snapshots aus der Codex-Linie ab. Am 24. Juli 2026 entfernt Anthropic den Fast Mode aus Opus 4.7 — und danach fällt die Anfrage nicht auf die Standardgeschwindigkeit zurück, sondern quittiert mit einem harten Fehler. Wer irgendwo in der Produktion Modell-IDs fest verdrahtet, sollte dieses Zeitfenster jetzt einplanen und nicht erst am Donnerstagmorgen, wenn ein Deploy plötzlich 400er wirft.

Wir verankern Modell-IDs überall in unserem eigenen Produktionsstack, und als wir ihn für diese Umstellung geprüft haben, fanden wir drei Dienste, die weiterhin claude-opus-4-7 mit speed: "fast" aufriefen, sowie zwei Build-Skripte, die fest auf einen Codex-Snapshot von der Abschaltliste des 23. Juli verwiesen — jeder davon ein stiller Ausfall, der nur auf den nächsten Deploy mitten in der Woche wartete.

Genau um diese Bestandsaufnahme geht es hier. Es folgt die Checkliste, die wir abgearbeitet haben, in dieser Reihenfolge: was zu inventarisieren ist, worauf jede ID umzustellen ist und wie sich die Migration vor dem Stichtag bestätigen lässt statt danach. Das gilt gleichermaßen, ob Sie diese Modelle direkt über die API ansprechen oder über eine IDE-Erweiterung, die sie für Sie festlegt.

Voraussetzung: wissen, was tatsächlich läuft

Bevor Sie eine einzige Zeile ändern, brauchen Sie eine ehrliche Bestandsaufnahme. Eine erzwungene Migration ist der günstigste Moment, um die eigene Modellnutzung zu prüfen, denn die Kosten des Umstiegs zahlen Sie ohnehin (Developers Digest).

Zwei Stichtage fallen in dasselbe 48-Stunden-Fenster: OpenAI zieht am 23. Juli 2026 alte Snapshots der Codex-Linie zurück, und Anthropic entfernt am 24. Juli 2026 den Fast Mode aus Opus 4.7, ohne automatischen Rückfall.

Sammeln Sie zuerst drei Dinge:

  • Jede Stelle, an der eine Modell-ID notiert ist — Anwendungscode, Konfigurationsdateien, CI/CD-Build-Skripte, Einstellungen von IDE-Erweiterungen und jeder interne SDK-Wrapper.
  • Über welche Oberfläche jeder Aufruf läuft. Die Abschaltung von Codex trifft das ChatGPT-Produkt Codex und den API-Zeitplan der Ausmusterung unterschiedlich, sodass derselbe Modellname zwei verschiedene Migrationswege bedeuten kann.
  • Ihre aktuellen Ausgaben pro Modell, damit Sie erkennen, ob der erzwungene Wechsel Ihre Rechnung senkt oder erhöht.

Wer Modell-IDs nie zentralisiert hat, lernt in diesen Tagen die eigentliche Lektion: eine einzige Konstante oder Umgebungsvariable pro Modell macht aus einem Chaos über mehrere Repositorys eine Änderung an einer einzigen Stelle. Über dieselbe Disziplin haben wir geschrieben, als wir nach der Abrechnungsumstellung von Fable 5 unseren eigenen Modellkostenplan neu aufgesetzt haben.

Schritt 1 — Jede fest verdrahtete Modell-ID inventarisieren

Durchsuchen Sie die gesamte Codebasis, nicht nur die Anwendung. Modell-IDs verstecken sich in Test-Fixtures, Notebooks und Deploy-Skripten.

grep -rEn "gpt-5\.[0-3]-codex|gpt-5\.2|claude-opus-4-7" . \
  --include=*.{py,ts,js,json,yaml,yml,sh,env}

Erwartete Ausgabe: eine Liste von Treffern nach Datei und Zeile. Fehlerbild: Ein Durchlauf ohne Ergebnis bedeutet meist, dass Ihre IDs per Zeichenkettenverkettung entstehen ("gpt-5." + minor + "-codex") — suchen Sie dann allein nach dem Präfix und zusätzlich nach jedem speed- oder fast-Flag.

Halten Sie zu jedem Treffer die Modell-ID, die Oberfläche und die Angabe fest, ob sie auf einer Abschaltliste steht. Diese Tabelle ist Ihre Arbeitsliste für die Migration.

Schritt 2 — Die Codex-Snapshots vor dem 23. Juli migrieren

Die Deprecations-Seite von OpenAI nennt für eine Reihe alter Snapshots den Abschalttermin 23. Juli 2026, jeweils mit einem benannten Ersatzmodell zum Umstieg (OpenAI API-Deprecations). Innerhalb des ChatGPT-Produkts Codex zieht OpenAI zudem GPT-5.2 und GPT-5.3-Codex zurück und lenkt die Nutzer auf GPT-5.5 als allgemeinen Nachfolger (OpenAI Developer Community, SecurityOnline).

Um von zurückgezogenen Codex-Snapshots wegzukommen, ersetzen Sie jede veraltete Modell-ID durch das von OpenAI auf seiner Deprecations-Seite benannte Ersatzmodell — für die meisten Code-Aufgaben ist das GPT-5.5 — und lassen Sie danach Ihre Evaluationen erneut laufen, weil der Nachfolger Token und Rechenzeit anders verbraucht.

Nehmen Sie den Umstieg Oberfläche für Oberfläche vor:

  • API-Aufrufe: Ersetzen Sie jeden veralteten Snapshot durch die exakte Ersatz-ID aus der Deprecations-Tabelle. Raten Sie den Nachfolger nicht — die Tabelle benennt ihn.
  • Codex-CLI- und ChatGPT-Nutzer: Richten Sie Ihre Abläufe auf GPT-5.5 aus. Rückmeldungen aus erster Hand berichten, dass es länger nachdenkt und mehr Token verbraucht als das abgelöste 5.3-Codex; kalkulieren Sie das ein (OpenAI Developer Community).

Fehlerbild zum Testen: ein Snapshot, der jetzt noch antwortet, am 23. Juli aber mit 404 endet. Schicken Sie vor dem Stichtag pro migrierter ID eine echte Anfrage; eine ID, die aktuell auflöst, ist kein Beleg dafür, dass sie die Abschaltung übersteht.

Das ist zugleich der günstigste Moment, den Anbieter grundsätzlich neu zu bewerten — die Kosten der Evaluation tragen Sie ohnehin, sodass der Test eines dritten Modells im selben Durchlauf nur eine weitere Spalte in der Tabelle kostet. Denselben Blick legen wir an jeden Anbieterwechsel an, so wie wir den Streit zwischen Apple und OpenAI als Anlass zur Anbieterprüfung behandelt haben.

Schritt 3 — Fast Mode von Opus 4.7 vor dem 24. Juli umstellen

Anthropic hat den Fast Mode für Opus 4.7 am 25. Juni 2026 als veraltet markiert, mit Entfernung zum 24. Juli 2026 (Anthropic-Changelog). Das ist der schärfere der beiden Stichtage. Nach der Entfernung quittiert jede Anfrage an claude-opus-4-7 mit speed: "fast" einen harten Fehler — es gibt keinen stillen Rückfall auf die Standardgeschwindigkeit (CLSkills Hub).

Die Lösung ist eine Änderung der Modell-ID, keine Neuprogrammierung:

- model: "claude-opus-4-7"
- speed: "fast"
+ model: "claude-opus-4-8"
+ speed: "fast"          # requires the fast-mode-2026-02-01 beta header

Der Fast Mode steht für Opus 4.8 als Research-Preview auf der Claude-API bereit: Setzen Sie speed: "fast" zusammen mit dem Beta-Header fast-mode-2026-02-01, um bei Premium-Preisen bis zu rund 2,5-mal mehr Ausgabe-Token pro Sekunde zu erhalten (Anthropic — Neuerungen in Opus 4.8).

Um nach dem 24. Juli 2026 den schnellen Durchsatz zu behalten, ändern Sie die Modell-ID von claude-opus-4-7 auf claude-opus-4-8 und senden Sie den Beta-Header fast-mode-2026-02-01; die alte Modell-ID mit einem fast-Flag quittiert einen harten Fehler ohne Rückfall.

Der grundlegende Wechsel ist bei den Kosten risikoarm. Opus 4.8 erschien am 28. Mai 2026 zum selben Listenpreis wie 4.7, nämlich 5 / 25 US-Dollar pro Million Token, schneidet dabei aber deutlich besser ab — 69,2 % gegenüber 64,3 % auf SWE-bench Pro — und läuft über die API standardmäßig mit einem Kontext von 1 Million Token (Ofox, Qcode, genai unplugged). Es ist seit Ende Mai allgemein verfügbar, der Umstieg führt also zu einem ausgereiften, ausgelieferten Modell und nicht zu einem Beta-Wagnis (Decode the Future).

Fehlerbild zum Testen: der Beta-Header. Teams, die nur die Modell-ID ändern und den Header fast-mode-2026-02-01 vergessen, erhalten Standardgeschwindigkeit bei Standardabrechnung, ohne Fehlermeldung — die Anfrage funktioniert, doch der Fast Mode ist klammheimlich verloren.

Schritt 4 — Evaluationen erneut laufen lassen und die Kosten neu rechnen

Ein Nachfolgemodell ist kein reiner Austausch, selbst wenn der Preis stimmt. GPT-5.5 denkt anders als die Codex-Snapshots, die es ablöst, und Opus 4.8 legt mehr überlegte Denkschritte ein als 4.7. Beides verändert Ihren Tokenverbrauch und Ihr Latenzprofil.

Arbeiten Sie zum Abschluss die folgende Liste ab:

  1. Lassen Sie Ihre eigene Evaluationssuite gegen jede migrierte ID laufen. Verlassen Sie sich nicht auf Benchmark-Differenzen als Ersatz für Ihre Arbeitslast — messen Sie an Ihren Aufgaben, so wie wir Modelle nach Kosten pro Aufgabe statt nach Schlagzeilenwerten vergleichen.
  2. Rechnen Sie die Ausgaben aus echten Tokenzahlen nach der Migration neu, nicht aus den Werten des alten Modells.
  3. Deployen Sie neu und schicken Sie pro ID eine echte Prüfanfrage, nachdem der Stichtag des jeweiligen Anbieters verstrichen ist, um sicherzugehen, dass nichts auf einem zurückgezogenen Snapshot festhängt.
Lassen Sie nach der Migration Ihre Evaluationssuite erneut laufen und rechnen Sie die Kosten aus echten Tokenzahlen nach der Umstellung neu, denn ein Nachfolgemodell mit gleichem Listenpreis kann Token und Rechenzeit dennoch anders verbrauchen und Ihre Rechnung verändern.

Wer das Zeitfenster verpasst, erlebt keinen leisen Ausfall: Codex-Aufrufe laufen ab dem 23. Juli in 404-Fehler, und Fast-Mode-Aufrufe an Opus 4.7 quittieren ab dem 24. Juli mit einem harten Fehler. Beides ist genau der Donnerstagsvorfall, den eine Prüfung am Dienstag verhindert.

Häufig gestellte Fragen

Was genau passiert am 23. Juli 2026? OpenAI schaltet eine Reihe alter Modell-Snapshots ab, die auf seiner Deprecations-Seite gelistet sind, jeweils einem benannten Ersatz zugeordnet; Anfragen an einen zurückgezogenen Snapshot lösen nicht mehr auf (OpenAI API-Deprecations).

Was bricht am 24. Juli 2026? Der Fast Mode wird aus Opus 4.7 entfernt. Eine Anfrage an claude-opus-4-7 mit speed: "fast" quittiert einen harten Fehler, ohne Rückfall auf die Standardgeschwindigkeit (CLSkills Hub).

Worauf migriere ich den Fast Mode von Opus 4.7? Ändern Sie die Modell-ID auf claude-opus-4-8 und ergänzen Sie den Beta-Header fast-mode-2026-02-01, um den schnellen Durchsatz zu behalten (Anthropic).

Ist Opus 4.8 teurer als 4.7? Der Listenpreis ist derselbe, 5 / 25 US-Dollar pro Million Eingabe- bzw. Ausgabe-Token; der Fast Mode selbst wird zu Premium-Sätzen abgerechnet (Ofox).

Wohin wechseln Codex-Nutzer nach der Abschaltung? GPT-5.5 ist der allgemeine Nachfolger innerhalb des Codex-Produkts; API-Aufgaben sollten die konkreten Ersatz-IDs verwenden, die auf der Deprecations-Seite benannt sind (OpenAI Developer Community).

Fazit

Technisch ist keiner der beiden Stichtage schwierig — jeweils eine Änderung der Modell-ID, bei Opus zusätzlich ein Beta-Header. Schwierig ist es, jede Stelle zu kennen, an der eine zurückgezogene ID verankert ist, bevor der Stichtag daraus einen Ausfall macht. Führen Sie die Inventar-Suche vor dem 23. Juli aus, tauschen Sie die IDs, ergänzen Sie den Header, lassen Sie Ihre Evaluationen erneut laufen und prüfen Sie jede ID nach dem Stichtag. Wenn Sie eine zweite Hand für eine Modellmigration oder eine belastbare Schicht zur Modellsteuerung möchten, die den nächsten erzwungenen Wechsel übersteht, genau das ist unsere Arbeit.

Quellen

  1. OpenAI — API-Deprecations
  2. Anthropic — Neuerungen in Claude Opus 4.8
  3. Anthropic Claude Developer Platform — Changelog
  4. OpenAI Developer Community — GPT-5.2 und GPT-5.3-Codex abgeschaltet
  5. CLSkills Hub — Claude Fast Mode am 24. Juli entfernt
  6. Developers Digest — Migration weg von ausgemusterten GPT-Modellen 2026
  7. Ofox — Migration von Opus 4.7 auf Opus 4.8
  8. genai unplugged — Migrationsleitfaden zu Claude Opus 4.8
  9. Qcode — KI-Coding-Neuerungen 2026
  10. Decode the Future — Claude Opus 4.8 erklärt
  11. SecurityOnline — Ausmusterung alter OpenAI-Modelle

Artikel teilen

Share: