News · Logiciel
Codex : le quota 20× n’est pas un contrat
Le 20 septembre 2026, OpenAI dit encore que les messages Codex / 5 h « ne sont pas des plafonds fixes ». Pro 20× : Astra 100–900. Les nouvelles souscriptions à 200 $ sont en pause depuis le 10. Le compteur saute ; les resets de Tibo tiennent le forfait. L’API et les plans chinois facturent au token.

On paie Codex comme un forfait. On le consomme comme une fourchette. Le 20 septembre 2026, la page Pricing (ouvre learn.chatgpt.com dans un nouvel onglet) d’OpenAI le dit encore en toutes lettres : les estimations de messages locaux / 5 h « ne sont pas des plafonds fixes ». Sur Pro 20×, GPT-6 Astra tient 100–900 messages. Le bas de la fourchette est neuf fois plus bas que le haut. Le même abonnement à 200 $ peut donc tenir une journée chargée — ou s’évaporer en une matinée.
Le 10 septembre, OpenAI a cessé de vendre ce palier aux nouveaux. Le Help Center le confirme. Thibault Sottiaux, qui porte Codex et ChatGPT, a écrit que ces comptes « put the most strain on our systems ». Ce n’est pas un détail marketing. C’est le constat qu’un forfait opaque, collé au modèle le plus gourmand, ne tient plus comme un contrat.
Info
Contrôle du 20 septembre 2026. Doc OpenAI : Learn / Pricing (ouvre learn.chatgpt.com dans un nouvel onglet), usage Astra dans Work et Codex (ouvre help.openai.com dans un nouvel onglet), pause Pro 200 $ (ouvre help.openai.com dans un nouvel onglet). Tibo : war room de juin (ouvre x.com dans un nouvel onglet), pause du 10 septembre (ouvre x.com dans un nouvel onglet), qualité du 12 septembre (ouvre x.com dans un nouvel onglet). Recoupement : Business Insider, 30 juin (ouvre businessinsider.com dans un nouvel onglet), GitHub #38335 (ouvre github.com dans un nouvel onglet) et #41220 (ouvre github.com dans un nouvel onglet). GLM : z.ai/subscribe (ouvre z.ai dans un nouvel onglet) et docs DevPack (ouvre docs.z.ai dans un nouvel onglet). DeepSeek : Models & Pricing (ouvre api-docs.deepseek.com dans un nouvel onglet). MiniMax : Pay as You Go (ouvre platform.minimax.io dans un nouvel onglet). Kimi : tarifs Moonshot (ouvre platform.kimi.com dans un nouvel onglet). Observatory : un compte Pro 20× (ouvre codex-quota.manetli.com dans un nouvel onglet). La qualité Astra de début septembre est déjà traitée ici. Les fourchettes ne sont pas des nombres de prompts.
La doc le dit déjà : ce n’est pas un plafond
Les chiffres officiels sont des estimations de messages locaux par fenêtre de cinq heures. Cloud et local partagent le même pot. Un plafond hebdomadaire « may also apply », sans chiffre. On peut taper la limite cinq heures alors qu’il reste du quota de la semaine. Le tableau, relu le 20 septembre :
| Modèle | Plus (20 $) | Pro 5× (100 $) | Pro 20× (200 $) | Clé API |
|---|---|---|---|---|
| GPT-6 Astra | 5–45 | 25–225 | 100–900 | À l’usage |
| GPT-5.6 Sol | 10–100 | 50–500 | 200–2 000 | À l’usage |
| GPT-5.6 Terra | 25–200 | 125–1 000 | 500–4 000 | À l’usage |
| GPT-5.6 Luna | 250–2 000 | 1 250–10 000 | 5 000–40 000 | À l’usage |
Business Standard reprend la colonne Plus. Business à 100 $ reprend Pro 5×. Le Help Center ajoute que la tâche, le modèle, le raisonnement, Fast mode et les images mangent le pot à des vitesses différentes. Fast mode applique un multiplicateur 2,5× au tarif Standard d’Astra. Les images consomment les limites 3 à 5 fois plus vite en moyenne.
OpenAI publie aussi une grille de crédits / million de tokens pour l’usage au-delà du forfait : Astra 250 crédits en entrée, 1 250 en sortie. Sol : 100 et 500. Même abonnement, Astra coûte 2,5 fois Sol au token. Ce n’est pas un bug de dashboard. C’est le barème.
Le 5× et le 20× sont des multiples de Plus, pas une quantité. 20× de 5–45, c’est 100–900. On n’achète pas « 900 messages Astra ». On achète une fourchette dont le bas tient dans une session d’agent, et dont le haut suppose des tours courts. Le Help Center le dit aussi pour le raisonnement : un effort plus élevé « can use more of your allowance and does not always produce a better result ». Le compteur n’est pas un contrat. C’est une moyenne mobile.
200 $ : le palier qu’OpenAI ne vend plus
Depuis le 10 septembre 2026, les nouvelles souscriptions et les montées vers Pro 200 $ (Pro 20×) sont en pause. Free, Go, Plus, Pro 100 $ : on ne passe plus au palier du dessus. Les 200 $ déjà en place se renouvellent. Le 100 $ reste ouvert. L’API aussi. Annuler ou rétrograder pendant la pause, c’est risquer de ne pas pouvoir revenir — un retour unique existe pour les comptes qui avaient le 200 $ au 10 septembre, ou dont l’accès s’est arrêté dans les 30 jours précédents.
Sottiaux, le 10 septembre :
To make sure our current users have an incredible experience and continued access to Astra, we are going to pause subscriptions to our $200 Pro plan. These put the most strain on our systems […] All other plans and the api remain available.
La veille, il parlait d’une demande Astra « really unprecedented ». PCMag et le Help Center : même calendrier. OpenAI n’a pas publié de date de réouverture.
Le FAQ du Help Center ferme une autre porte : le support ne reset pas les limites ChatGPT ou Codex. Si le compteur saute, on attend la fenêtre, on utilise un reset déjà en banque, on achète un reset là où c’est proposé, ou on passe à l’API. Le forfait à 200 $ n’inclut pas un humain qui recale le pourcentage.
Le drama : le compteur, les resets, « at capacity »
Ce n’est pas seulement une fourchette large. Depuis l’été, une partie des comptes Pro raconte un compteur qui ne colle pas au travail visible.
Fin juin, Sottiaux a mis l’équipe Codex en war room un dimanche. Le 29 juin, il a annoncé un reset global, plus un reset en banque pour 24 h. Causes retenues, côté OpenAI : auto-review trop proactive, plus de sous-agents, suggestions en double ou qui retentaient trop, et un dashboard qui affichait de l’usage non facturé (requêtes en erreur ou limitées comptées comme des tours). Business Insider (ouvre businessinsider.com dans un nouvel onglet) a recoupé le fil le 30 juin. OpenAI a dit qu’il n’y avait « pas un seul problème central », mais plusieurs petits qui se cumulaient.
Le 13 août, un ticket Pro 20× reste ouvert : #38335 (ouvre github.com dans un nouvel onglet). L’auteur mesure environ 11 points du quota hebdomadaire en 50 minutes sur un correctif de positionnement frontend — pas de vision, pas de Fast mode, pas de gros document. Autre mesure du même ticket : 2–3 points en un peu plus d’une minute alors que Codex ne faisait qu’orchestrer un CLI externe. Le ticket ajoute les erreurs « Selected model is at capacity » avec du quota restant.

Crédit : GitHub, visuel Open Graph de openai/codex#38335 (ouvre github.com dans un nouvel onglet). Ticket ouvert le 13 août 2026, encore ouvert au 20 septembre. Ce n’est pas un audit OpenAI.
Le 27 août, #41220 (ouvre github.com dans un nouvel onglet) agrège la famille de symptômes : déplétion plus rapide que le baseline, consommation à l’idle, sauts dans une fenêtre inchangée, ledger qui ne se recale pas. Le tracker ne suppose pas une cause unique. Il liste des mécanismes possibles — pondération serveur, activité de fond, retries, rejeu de contexte, amplification côté client. Un des tickets liés décrit une expérience contrôlée : clients fermés pendant 103 h, 0 % de drain ; lancer ChatGPT desktop a déduit environ 6 % du hebdomadaire, puis l’arrêt a stoppé la fuite. C’est un compte, pas un sondage. C’est assez précis pour ne plus traiter chaque plainte comme une impression.
D’autres tickets Pro 20×, autour du 7–8 septembre, collent un autre malentendu. « Selected model is at capacity. Please try a different model. » se lit comme un quota. Les logs locaux disent server_overloaded, avec used_percent: 0.0. Le message d’erreur et le compteur ne parlent pas de la même chose. On peut être refusé pour de l’admission control tout en ayant un pot plein.
Les resets de Tibo sont devenus la soupape. CodexRunway comptait, au 20 septembre, 55 signaux de reset sur 52 jours actifs ; le dernier reset global confirmé date du 12 septembre, 08:09 UTC, « Reset all propagated. Sweet dreams. », collé au correctif qualité Astra. Ce n’est pas le plafond du forfait. C’est une compensation ponctuelle, trop fréquente pour être un incident isolé, trop irrégulière pour caler un planning. Le Help Center décrit aussi des resets bancaires et des resets achetés : un reset avance la semaine, il n’augmente pas le palier.

Crédit : Codex Quota Observatory (ouvre codex-quota.manetli.com dans un nouvel onglet) / Manetli, visuel Open Graph. Mesure d’un compte Pro 20× anonyme, pas un allowance universel. Astra observé jusqu’au 19 septembre 2026 UTC.
L’Observatory, relu le 20 septembre, affiche pour ce compte : Astra 911 M de contexte / 100 points de quota, 3,9× plus de quota par token que Sol. À effort MAX Standard, Astra a consommé 43 % de tokens en moins par tâche que Sol, mais 2,24× plus de quota par tâche. C’est une observation, pas un barème OpenAI. Elle colle pourtant au tarif officiel : Astra est plus cher au token, et le forfait ne le dit pas en messages.
Astra : parfois brillant, parfois bête, toujours plus cher
Le Help Center range Astra pour « investigating a difficult bug ». Sol pour implémenter une fonctionnalité. Terra pour le quotidien. Luna pour l’extraction. La même page ajoute : Astra en Low peut battre Sol en High. L’effort ne fixe ni la consommation, ni le résultat.
C’est là que le forfait devient illisible. Extra High sur Astra et Medium sur Luna, c’est le même abonnement, deux journées incomparables. Un modèle « parfois con, parfois smart » n’est pas seulement une humeur de forum. C’est le produit d’une fourchette 5–45 (Plus) ou 100–900 (Pro 20×), d’un effort qui « does not always produce a better result », et d’un modèle qui, une semaine après sa sortie, a déjà eu besoin d’un correctif public.
Le 11 septembre, Pranjal Paliwal, qui avait d’abord salué Astra, revient sur le code écrit (ouvre x.com dans un nouvel onglet) : « How can it be so smart and so dumb at the same time! » Decrypt a collé la phrase. Le 12 septembre, Sottiaux a nommé trois bugs — skills trop fréquentes, une expérience de context management, des engines mal configurés — et reset le pot. On a déroulé cette semaine. Ici, le point n’est pas le nerf du 11. C’est que la qualité et le quota bougent ensemble, sans que le reçu du 200 $ bouge.
L’abonnement face à l’API — surtout les compteurs chinois
La colonne « API Key » du tableau OpenAI n’est pas un autre modèle. C’est un autre régime. Pas de fenêtre cinq heures du plan ChatGPT. On paie les tokens. Astra Standard : 10 $ / 50 $ le million (entrée / sortie) jusqu’à 272 k d’entrée, 20 $ / 75 $ au-delà. Le compteur API ne « saute » pas de 11 points sans tokens. Il peut être cher. Il est lisible.
Les plans chinois que les gens collent dans Claude Code, Codex, OpenCode ou Cursor ne sont pas magiquement plus intelligents. Ils sont plus stables à lire.
GLM Coding Plan, page z.ai/subscribe (ouvre z.ai dans un nouvel onglet) du 20 septembre : Lite 18 $ / mois (10 000 crédits / semaine), Pro 80 $ (6× Lite), Max 168 $ (14× Lite). Promo annuelle affichée : 12,6 $ / 56 $ / 117,6 $. Les docs DevPack (ouvre docs.z.ai dans un nouvel onglet) publient les crédits : Lite 2 000 / 5 h et 10 000 / semaine ; Pro 12 000 et 60 000 ; Max 28 000 et 140 000. GLM-5.3 a un multiplicateur d’entrée / sortie 6,9 / 24. Le hors-pointe est à 50 %. Ce n’est pas un nombre de messages marketing. C’est un barème de crédits, avec reset à 5 h et à 7 jours.
DeepSeek, Models & Pricing (ouvre api-docs.deepseek.com dans un nouvel onglet) : deepseek-flash (V4.1-Flash) à 0,15 $ / 0,60 $ le million hors pointe (entrée cache miss / sortie), 0,30 $ / 1,20 $ en pointe. V4 Pro : 0,66 $ / 1,98 $ hors pointe, 1,32 $ / 3,96 $ en pointe. Pointe : 01:00–04:00 et 06:00–10:00 UTC, lundi–vendredi hors jours fériés chinois. Week-end et fériés : hors pointe toute la journée. Concurrence 2 500 (Flash) / 500 (Pro). On voit les tokens. On voit le cache.
MiniMax, Pay as You Go (ouvre platform.minimax.io dans un nouvel onglet) : MiniMax-M3 ≤ 512 k, remise permanente 50 %, 0,30 $ / 1,20 $ le million (entrée / sortie), cache lu 0,06 $. Au-dessus de 512 k, les tarifs doublent. Priority : 1,5×.
Kimi / Moonshot, tarifs officiels (ouvre platform.kimi.com dans un nouvel onglet) : K3 à 20 ¥ / 100 ¥ le million (entrée cache miss / sortie), cache hit 2 ¥, contexte 1 048 576 tokens. K2.6 : 6,50 ¥ / 27 ¥. K2.7 Code : même entrée 6,50 ¥, sortie 27 ¥. C’est du yuan, pas une fourchette de messages.
Aucun de ces barèmes n’interdit un modèle irrégulier. DeepSeek a même un prix qui double en pointe. GLM a des multiplicateurs selon le modèle. La différence, pour un abonné Codex qui voit 11 % partir en 50 minutes sans Fast mode, c’est qu’une ligne de tokens se recale. Un pourcentage Codex, non. Et quand OpenAI reset tout le monde un vendredi soir, ce n’est pas une fonctionnalité du 200 $. C’est l’aveu que le forfait n’a pas tenu la semaine.
Attention
Quatre choses distinctes. (1) La doc dit déjà que ce n’est pas un plafond fixe. (2) Des tickets GitHub et la war room de juin documentent des bugs de compteur, d’auto-review et d’affichage — pas « tout le monde est volé ». (3) Astra brûle plus que Sol, barème officiel 2,5× au crédit. (4) L’API OpenAI et les plans GLM / DeepSeek / MiniMax / Kimi sont un autre régime de facturation, pas la preuve qu’ils sont plus intelligents. Le 20× n’est plus en vente aux nouveaux. Les 200 $ en cours se renouvellent.
Le forfait Codex vend une sensation : travailler sans regarder le compteur. Le compteur, lui, est une fourchette, un hebdomadaire non chiffré, un modèle qui coûte 2,5 fois l’autre, des erreurs « at capacity » qui ne sont pas du quota, et des resets que le support n’a pas le droit de refaire. Face à ça, payer 200 $ pour 20× Plus, ou 10 $ le million sur l’API, ou 18 $ chez GLM, ce n’est plus la même question. C’est : est-ce qu’on achète de l’intelligence, ou un pourcentage qu’on ne peut pas recaler ?
Sources
- OpenAI, Learn / Pricing, Codex et ChatGPT Work (ouvre learn.chatgpt.com dans un nouvel onglet)
- OpenAI Help Center, Managing usage with GPT-6 Astra in Work and Codex (ouvre help.openai.com dans un nouvel onglet)
- OpenAI Help Center, About ChatGPT Pro tiers — pause Pro 200 $ (ouvre help.openai.com dans un nouvel onglet)
- OpenAI, tarifs API gpt-6-astra (ouvre developers.openai.com dans un nouvel onglet)
- Thibault Sottiaux, 29 juin 2026, war room et reset Codex (ouvre x.com dans un nouvel onglet)
- Business Insider, OpenAI explains Codex usage limit issue, 30 juin 2026 (ouvre businessinsider.com dans un nouvel onglet)
- GitHub openai/codex#38335, Pro 20×, 13 août 2026 (ouvre github.com dans un nouvel onglet)
- GitHub openai/codex#41220, meta-tracker déplétion, 27 août 2026 (ouvre github.com dans un nouvel onglet)
- Thibault Sottiaux, 10 septembre 2026, pause Pro 200 $ (ouvre x.com dans un nouvel onglet)
- PCMag, $200 ChatGPT Pro subscriptions paused, 11 septembre 2026 (ouvre pcmag.com dans un nouvel onglet)
- Thibault Sottiaux, 12 septembre 2026, bugs qualité Astra et reset (ouvre x.com dans un nouvel onglet)
- Pranjal Paliwal, 11 septembre 2026 (ouvre x.com dans un nouvel onglet)
- Decrypt, GPT-6 Astra users say the model got dumber, 12 septembre 2026 (ouvre decrypt.co dans un nouvel onglet)
- Codex Quota Observatory / Manetli (ouvre codex-quota.manetli.com dans un nouvel onglet)
- CodexRunway, historique des resets (ouvre codexrunway.com dans un nouvel onglet)
- z.ai, GLM Coding Plan (ouvre z.ai dans un nouvel onglet)
- Z.AI docs, GLM Coding Plan overview (ouvre docs.z.ai dans un nouvel onglet)
- DeepSeek API, Models & Pricing (ouvre api-docs.deepseek.com dans un nouvel onglet)
- MiniMax, Pay as You Go (ouvre platform.minimax.io dans un nouvel onglet)
- Moonshot / Kimi, tarifs (ouvre platform.kimi.com dans un nouvel onglet)
Laisser un avis
Avis des lecteurs
Aucun avis publié pour le moment.
À lire aussi
- MLX : les gros modèles tiennent enfin sur un MacLe 20 septembre 2026, MLX fait tourner en local ce qu’on envoyait au cloud. WWDC : cluster Thunderbolt, Kimi 2.6 à 1 T. Rapid-MLX : V4.1-Flash 2-bit sur un M3 Ultra 256 Go, 7,3 tok/s. Pas un MacBook 16 Go.
- RX 9050 4 Go : même nom, bus 64-bit, OEM onlyLe 19–20 septembre 2026, Hardware Unboxed et Clubic mesurent la RX 9050 4 Go OEM. Même GPU que la 8 Go, bus 64-bit, 144 Go/s. En 1080p Low, la 8 Go est 37 % plus vite. Pas au rayon.
- GLM Coding Plan : 18, 80 et 168 $, en créditsAu 20 septembre 2026, GLM Coding Plan : Lite 18 $, Pro 80 $, Max 168 $. Crédits 5 h + semaine, hors-pointe à 50 %. Pas une API générale. Campagne Flash jusqu’au 20.