Codex s'arrête le 23 juillet. Opus 4.7 sans repli le 24.

OpenAI retire des instantanés Codex le 23 juillet 2026 et Anthropic supprime le mode rapide d'Opus 4.7 le 24. Voici la liste de contrôle de migration à suivre.

Codex s'arrête le 23 juillet. Opus 4.7 sans repli le 24.

Deux échéances strictes tombent à moins de 48 heures d'écart, les 23 et 24 juillet 2026, et aucune ne s'éteint en douceur. Le 23 juillet 2026, OpenAI arrête une série d'anciens instantanés de la lignée Codex. Le 24 juillet 2026, Anthropic retire le mode rapide d'Opus 4.7 : après cela, la requête ne bascule pas vers la vitesse standard, elle renvoie une erreur ferme. Si vous figez des identifiants de modèle quelque part en production, planifiez ce créneau maintenant, et non le jeudi matin quand un déploiement se met à renvoyer des 400.

Nous figeons des identifiants de modèle dans tout notre propre socle de production, et en l'auditant pour cette bascule nous avons trouvé trois services qui appelaient encore claude-opus-4-7 avec speed: "fast", plus deux scripts de build pointant en dur vers un instantané Codex de la liste d'arrêt du 23 juillet : chacun une panne silencieuse qui n'attendait que le prochain déploiement en milieu de semaine.

C'est précisément cet audit qui nous intéresse ici. Voici la liste de contrôle que nous avons suivie, dans l'ordre : ce qu'il faut inventorier, vers quoi basculer chaque identifiant et comment confirmer la migration avant l'échéance plutôt qu'après. Cela vaut que vous appeliez ces modèles directement par l'API ou via une extension d'IDE qui les fige pour vous.

Prérequis : savoir ce que vous exécutez réellement

Avant de changer la moindre ligne, il vous faut un inventaire honnête. Une migration forcée est le moment le moins coûteux pour auditer votre usage des modèles, puisque vous en payez déjà le coût de bascule (Developers Digest).

Deux échéances comptent dans la même fenêtre de 48 heures : OpenAI retire d'anciens instantanés de la lignée Codex le 23 juillet 2026, et Anthropic retire le mode rapide d'Opus 4.7 le 24 juillet 2026, sans repli automatique.

Rassemblez d'abord trois éléments :

  • Chaque endroit où figure une chaîne d'identifiant de modèle : code applicatif, fichiers de configuration, scripts de build CI/CD, réglages d'extensions d'IDE et tout wrapper de SDK interne.
  • La surface par laquelle passe chaque appel. Le retrait de Codex touche différemment le produit ChatGPT Codex et le calendrier de dépréciation de l'API, si bien qu'un même nom de modèle peut recouvrir deux chemins de migration.
  • Vos dépenses actuelles par modèle, pour savoir si ce changement imposé allège ou alourdit votre facture.

Si vous n'avez jamais centralisé vos identifiants de modèle, c'est la vraie leçon de cette bascule : une seule constante ou variable d'environnement par modèle transforme une course entre plusieurs dépôts en une modification à un seul endroit. Nous avons écrit sur cette même discipline lorsque nous avons refait notre propre plan de coûts de modèles après le changement de facturation de Fable 5.

Étape 1 — Inventorier chaque identifiant de modèle figé

Passez au crible toute la base de code, pas seulement l'application. Les identifiants de modèle se cachent dans les fixtures de test, les notebooks et les scripts de déploiement.

grep -rEn "gpt-5\.[0-3]-codex|gpt-5\.2|claude-opus-4-7" . \
  --include=*.{py,ts,js,json,yaml,yml,sh,env}

Sortie attendue : une liste de correspondances par fichier et par ligne. Cas d'échec : un passage sans résultat signale le plus souvent que vos identifiants sont construits par concaténation de chaînes ("gpt-5." + minor + "-codex") ; cherchez alors le préfixe seul, ainsi que tout indicateur speed ou fast.

Pour chaque correspondance, notez l'identifiant du modèle, la surface concernée et le fait qu'il figure ou non sur une liste d'arrêt. Ce tableau est votre plan de travail de migration.

Étape 2 — Migrer les instantanés Codex avant le 23 juillet

La page des dépréciations d'OpenAI indique une date d'arrêt au 23 juillet 2026 pour un ensemble d'anciens instantanés, chacun assorti d'un modèle de remplacement nommé (dépréciations de l'API OpenAI). Par ailleurs, au sein du produit ChatGPT Codex, OpenAI retire GPT-5.2 et GPT-5.3-Codex et oriente les utilisateurs vers GPT-5.5 comme successeur généraliste (OpenAI Developer Community, SecurityOnline).

Pour quitter les instantanés Codex retirés, remplacez chaque identifiant de modèle obsolète par le modèle de remplacement nommé par OpenAI sur sa page des dépréciations — pour la plupart des charges de code, c'est GPT-5.5 — puis relancez vos évaluations, car le successeur consomme les jetons et le temps de raisonnement différemment.

Effectuez le remplacement surface par surface :

  • Appels par l'API : remplacez chaque instantané obsolète par l'identifiant de remplacement exact figurant dans le tableau des dépréciations. Ne devinez pas le successeur : le tableau le nomme.
  • Utilisateurs de Codex CLI et de ChatGPT : orientez vos flux vers GPT-5.5. Des retours de première main indiquent qu'il raisonne plus longtemps et consomme plus de jetons que le 5.3-Codex qu'il remplace ; prévoyez-le (OpenAI Developer Community).

Cas d'échec à tester : un instantané qui répond encore aujourd'hui mais renvoie un 404 le 23 juillet. Envoyez une vraie requête par identifiant migré avant l'échéance ; un identifiant qui se résout pour l'instant ne prouve pas qu'il survivra à l'arrêt.

C'est aussi le moment le moins coûteux pour réévaluer entièrement le fournisseur : vous payez de toute façon le coût de l'évaluation, si bien que tester un troisième modèle dans le même passage ne coûte qu'une colonne de plus dans le tableau. Nous appliquons ce même regard à tout changement de fournisseur, comme lorsque nous avons traité le litige entre Apple et OpenAI comme un signal d'audit fournisseur.

Étape 3 — Basculer le mode rapide d'Opus 4.7 avant le 24 juillet

Anthropic a déprécié le mode rapide d'Opus 4.7 le 25 juin 2026, avec un retrait fixé au 24 juillet 2026 (journal d'Anthropic). C'est la plus tranchante des deux échéances. Après le retrait, toute requête vers claude-opus-4-7 portant speed: "fast" renvoie une erreur ferme : il n'y a pas de repli silencieux vers la vitesse standard (CLSkills Hub).

La correction est un changement d'identifiant de modèle, pas une réécriture :

- model: "claude-opus-4-7"
- speed: "fast"
+ model: "claude-opus-4-8"
+ speed: "fast"          # requires the fast-mode-2026-02-01 beta header

Le mode rapide est disponible pour Opus 4.8 en préversion de recherche sur l'API Claude : indiquez speed: "fast" avec l'en-tête bêta fast-mode-2026-02-01 pour obtenir jusqu'à environ 2,5 fois plus de jetons de sortie par seconde, à une tarification premium (Anthropic — Nouveautés d'Opus 4.8).

Pour conserver un débit rapide après le 24 juillet 2026, remplacez l'identifiant de modèle claude-opus-4-7 par claude-opus-4-8 et envoyez l'en-tête bêta fast-mode-2026-02-01 ; l'ancien identifiant assorti d'un indicateur de vitesse rapide renvoie une erreur ferme sans repli.

La bascule de base présente peu de risque côté coût. Opus 4.8 est sorti le 28 mai 2026 au même tarif catalogue que 4.7, soit 5 / 25 dollars par million de jetons, tout en obtenant de meilleurs scores — 69,2 % contre 64,3 % sur SWE-bench Pro — et en tournant par défaut avec un contexte d'un million de jetons sur l'API (Ofox, Qcode, genai unplugged). Il est en disponibilité générale depuis la fin mai : cette bascule mène donc vers un modèle livré et mûr, non vers un pari bêta (Decode the Future).

Cas d'échec à tester : l'en-tête bêta. Les équipes qui changent seulement l'identifiant de modèle et oublient l'en-tête fast-mode-2026-02-01 obtiennent la vitesse et la facturation standard, sans erreur : la requête fonctionne, mais vous avez perdu le mode rapide sans vous en apercevoir.

Étape 4 — Relancer les évaluations et recalculer le coût

Un modèle successeur n'est pas un simple remplacement, même à prix égal. GPT-5.5 raisonne autrement que les instantanés Codex qu'il remplace, et Opus 4.8 effectue des passes de raisonnement plus posées que 4.7. Les deux modifient votre consommation de jetons et votre profil de latence.

Déroulez cette liste pour conclure :

  1. Relancez votre propre suite d'évaluation contre chaque identifiant migré. Ne prenez pas les écarts de benchmark pour un substitut à votre charge de travail : mesurez sur vos tâches, comme nous le faisons lorsque nous comparons les modèles au coût par tâche plutôt qu'aux scores en une du classement.
  2. Recalculez la dépense à partir du nombre réel de jetons après migration, et non des chiffres de l'ancien modèle.
  3. Redéployez et envoyez une vraie requête de contrôle par identifiant une fois passée l'échéance de chaque fournisseur, pour vérifier que rien ne pointe encore sur un instantané retiré.
Après la migration, relancez votre suite d'évaluation et recalculez le coût à partir du nombre réel de jetons après bascule, car un modèle successeur au même tarif catalogue peut tout de même consommer les jetons et le temps de raisonnement différemment et modifier votre facture.

Rater le créneau ne produit pas une panne discrète : les appels Codex renvoient un 404 à partir du 23 juillet, et les appels en mode rapide vers Opus 4.7 renvoient une erreur ferme à partir du 24 juillet. Ce sont exactement les incidents du jeudi qu'un audit du mardi évite.

Questions fréquentes

Que se passe-t-il exactement le 23 juillet 2026 ? OpenAI arrête une série d'anciens instantanés de modèles listés sur sa page des dépréciations, chacun rattaché à un remplacement nommé ; les requêtes vers un instantané retiré cessent de se résoudre (dépréciations de l'API OpenAI).

Qu'est-ce qui casse le 24 juillet 2026 ? Le mode rapide est retiré d'Opus 4.7. Une requête vers claude-opus-4-7 avec speed: "fast" renvoie une erreur ferme, sans repli vers la vitesse standard (CLSkills Hub).

Vers quoi migrer le mode rapide d'Opus 4.7 ? Remplacez l'identifiant de modèle par claude-opus-4-8 et ajoutez l'en-tête bêta fast-mode-2026-02-01 pour conserver le débit rapide (Anthropic).

Opus 4.8 est-il plus cher que 4.7 ? Le tarif catalogue est identique, 5 / 25 dollars par million de jetons en entrée et en sortie ; le mode rapide lui-même est facturé à un tarif premium (Ofox).

Où vont les utilisateurs de Codex après l'arrêt ? GPT-5.5 est le successeur généraliste au sein du produit Codex ; les charges par l'API doivent utiliser les identifiants de remplacement précis nommés sur la page des dépréciations (OpenAI Developer Community).

Conclusion

Techniquement, aucune de ces échéances n'est difficile : chacune se résume à un changement d'identifiant de modèle, plus un en-tête bêta pour Opus. Le difficile, c'est de connaître chaque endroit où un identifiant retiré est figé avant que l'échéance n'en fasse une panne. Lancez l'inventaire avant le 23 juillet, remplacez les identifiants, ajoutez l'en-tête, relancez vos évaluations et contrôlez chaque identifiant après l'échéance. Si vous voulez un renfort pour une migration de modèle ou une couche robuste de routage de modèles capable de survivre à la prochaine bascule imposée, c'est précisément le travail que nous faisons.

Sources

  1. OpenAI — dépréciations de l'API
  2. Anthropic — Nouveautés de Claude Opus 4.8
  3. Journal de la Claude Developer Platform d'Anthropic
  4. OpenAI Developer Community — arrêt de GPT-5.2 et GPT-5.3-Codex
  5. CLSkills Hub — mode rapide de Claude retiré le 24 juillet
  6. Developers Digest — migrer hors des modèles GPT retirés en 2026
  7. Ofox — migration d'Opus 4.7 vers Opus 4.8
  8. genai unplugged — guide de migration vers Claude Opus 4.8
  9. Qcode — nouveautés du codage par IA en 2026
  10. Decode the Future — Claude Opus 4.8 expliqué
  11. SecurityOnline — dépréciation des anciens modèles OpenAI

Partager l'article

Share: