5 points par GN⁺ 1 일 전 | 1 commentaires | Partager sur WhatsApp
  • Un site qui suit les annonces X de @thsottiaux pour consigner les moments de réinitialisation des limites d’utilisation de Codex ; la dernière réinitialisation date actuellement d’il y a 2 jours
  • 35 réinitialisations ont été recensées à ce jour, avec un délai d’attente moyen de 8,9 jours et le plus long intervalle sans réinitialisation de 67,7 jours
  • Les réinitialisations interviennent non seulement pour compenser des incidents, retards ou erreurs de calcul des limites, mais aussi lors de la croissance du nombre d’utilisateurs, de lancements produit, d’anniversaires ou pour encourager l’usage de nouvelles fonctionnalités
  • Certaines réinitialisations rétablissent à 100 % les limites hebdomadaires et horaires des forfaits payants, et proposent aussi une réinitialisation stockée (banked reset) applicable au moment souhaité
  • Avec la croissance de Codex et de ChatGPT Work, les réinitialisations sont devenues plus fréquentes ; les annonces récentes mentionnent aussi le cap des 7, 8 et 9 millions d’utilisateurs actifs ainsi que l’extension de l’infrastructure

Historique et statistiques des réinitialisations

  • Codex Resets collecte les annonces de réinitialisation des limites d’utilisation de Codex depuis le flux X de @thsottiaux
  • Le site conserve les intervalles entre réinitialisations et les annonces originales des 26 dernières semaines
  • Les statistiques sont les suivantes
    • 35 réinitialisations cumulées
    • Délai d’attente moyen de 8,9 jours
    • Plus long intervalle entre deux réinitialisations : 67,7 jours
    • Dernière réinitialisation il y a 2 jours

Réinitialisations liées à la croissance de Codex et de ChatGPT Work

  • La hausse rapide du nombre d’utilisateurs actifs a entraîné des réinitialisations successives
    • Au cap des 7 millions d’utilisateurs actifs, une réinitialisation stockée a été ajoutée à tous les comptes, utilisable depuis l’application de bureau ou le web pour recharger l’usage hebdomadaire
    • Au cap des 8 millions d’utilisateurs actifs, toutes les limites ont de nouveau été réinitialisées, sans appliquer non plus de limitation de vitesse sur 5 heures
    • Une réinitialisation a aussi eu lieu le jour du cap des 9 millions d’utilisateurs actifs, avec l’indication que des travaux étaient en cours pour maintenir la stabilité et la fiabilité du système
  • Plusieurs réinitialisations ont été effectuées pour tous les utilisateurs payants de Codex et ChatGPT Work, certaines annoncées comme devant être répercutées sous 30 minutes à 1 heure
  • Alors que le trafic augmentait à un rythme inédit, il y a aussi eu un cas où une réinitialisation supplémentaire a été annoncée le même jour après une première réinitialisation

Introduction et périmètre des réinitialisations stockées

  • Une réinitialisation stockée n’est pas appliquée de force immédiatement : elle est conservée sur le compte afin que l’utilisateur puisse recharger son quota hebdomadaire au moment de son choix
  • Elle n’était au départ utilisable que dans l’application de bureau, puis a été étendue au web et au mobile
  • Dans l’annonce ajoutant une réinitialisation stockée à 500 000 utilisateurs de ChatGPT Work et Codex, il était indiqué qu’un problème avait concerné moins de 10 % des personnes l’ayant utilisée
  • Certaines annonces rétablissent immédiatement toutes les limites tout en accordant une réinitialisation stockée supplémentaire utilisable dans les 24 heures suivantes
  • Lorsque des utilisateurs avaient déjà accumulé jusqu’à 3 réinitialisations stockées, une réinitialisation forcée (hard reset) a parfois été appliquée indépendamment du stock existant
  • Il existe aussi des cas de double réinitialisation (double reset) combinant une réinitialisation complète et une réinitialisation stockée librement utilisable

Compensation des incidents et problèmes de performance

  • Après trois petits incidents ayant affecté la fiabilité de Codex en 24 heures, les limites d’utilisation de tous les forfaits payants ont été réinitialisées et des mesures ont été engagées pour éviter les récidives
  • Après l’atténuation d’un incident d’environ 10 minutes et la confirmation du rétablissement, une réinitialisation a été annoncée
    • Codex a aidé aux travaux de rétablissement, mais l’indice décisif pour résoudre le problème a été trouvé par un humain
  • Après la résolution d’un autre incident et plusieurs heures de fonctionnement stable, les limitations de vitesse ont été réinitialisées ; dans un autre cas distinct où le service était redevenu stable, le bouton de réinitialisation a aussi été appliqué
  • Un problème où des requêtes étaient à tort classées comme présentant un risque cyber élevé, puis bloquées ou refusées, a été corrigé en environ 8 minutes, et les limites ont été réinitialisées après le rétablissement du service
  • Dans le cas d’un petit incident de 45 minutes qui s’est étendu en panne globale pendant les 30 dernières minutes, les limitations de vitesse ont été réinitialisées après le rétablissement
  • Pour compenser une latence anormalement élevée aux États-Unis ou dans les régions voisines, les limites de tous les utilisateurs de Codex ont été réinitialisées et l’usage de GPT-5.1-Codex-Max a aussi été recommandé
  • Pour compenser un ralentissement survenu pendant la préparation de GPU supplémentaires, les limites de gpt-5-codex ont été réinitialisées, avec l’indication que la capacité serait augmentée tout au long de la semaine
  • Il y a aussi eu un cas où la réinitialisation des limites de tous les utilisateurs a été utilisée comme mesure d’atténuation la plus rapide pendant la résolution de la cause racine, avec une prise en compte annoncée sous environ 10 minutes

Calcul de l’usage et problèmes d’épuisement des limites

  • Une optimisation appliquée à la compression des longues sessions a affecté le taux de cache hit, provoquant une consommation des limites plus rapide que prévu ; après rollback, les limites de tous les comptes ont été réinitialisées
  • Dans un cas où des signalements indiquaient que l’usage de Codex était consommé plus vite que prévu, sans qu’une cause centrale unique soit trouvée, une réinitialisation globale et une réinitialisation stockée supplémentaire ont été offertes en compensation
  • Même sans preuve d’un impact généralisé, le nombre de signalements ayant été jugé suffisant, les limitations de vitesse des abonnés Plus et Pro ont été réinitialisées et l’enquête devait être conclue sous 1 à 3 jours
  • Une autre enquête n’a pas non plus confirmé d’impact utilisateur à grande échelle, mais des mesures d’atténuation ont été appliquées, une réinitialisation gratuite a été offerte à tous les utilisateurs de Codex, puis la surveillance s’est poursuivie
  • Le tableau de bord montrait une hausse de la proportion d’utilisateurs atteignant leurs limites, mais la cause n’étant pas entièrement comprise, les limites de tous les forfaits ont été réinitialisées à titre préventif
  • Une erreur empêchant la limite promotionnelle x2 de s’appliquer à environ 9 % des utilisateurs Plus et Pro a été corrigée, et les limitations de vitesse de l’ensemble de ces forfaits ont été réinitialisées en compensation
  • Les limites ont été réinitialisées lors de la réécriture du système de suivi d’usage et de facturation de Codex ; au lieu de recréditer l’usage passé, de l’usage gratuit a été accordé

Forfaits, lancements produit et événements commémoratifs

  • Les limites Codex de tous les abonnés payants ChatGPT ont été réinitialisées, rétablissant les limites hebdomadaires et horaires à 100 %
  • Pour célébrer les résultats de la semaine et permettre de développer davantage avec GPT-5.5, une réinitialisation a été fournie à tous les forfaits payants
  • Pour le 1er anniversaire de Codex, Codex a été autorisé à réinitialiser lui-même les limitations de vitesse de tous les forfaits
  • Lors du lancement du nouveau forfait à 100 $, de l’usage Codex a été fourni et la réinitialisation des limites annoncée la veille a aussi été effectuée
  • Lorsque le nombre d’utilisateurs hebdomadaires de Codex est passé de 2 millions à 3 millions en moins d’un mois, les limitations de vitesse ont été réinitialisées pour célébrer ce cap
  • Les limites de tous les forfaits ont été réinitialisées pour permettre d’expérimenter un nouveau plugin
  • En fin d’année, les limitations de vitesse ont été réinitialisées et une limite d’usage doublée par rapport à l’habitude a été appliquée jusqu’au 1er janvier
  • Plusieurs annonces ont aussi simplement réinitialisé les limites d’utilisation de tous les forfaits payants à l’occasion du week-end

Mode de fonctionnement des réinitialisations

  • Les réinitialisations servent non seulement à compenser des incidents, mais aussi à accompagner la croissance du nombre d’utilisateurs, les lancements produit, les tests de nouvelles fonctionnalités, les anniversaires et les événements de week-end
  • Le périmètre varie selon la situation : tous les utilisateurs de Codex, tous les forfaits payants, tous les abonnés payants ChatGPT, Plus et Pro, ou les utilisateurs de Codex et ChatGPT Work
  • Le moment de prise en compte varie aussi selon les annonces : immédiat, sous 10 minutes, 30 minutes, 1 heure ou quelques heures
  • Bien que ces réinitialisations aient un coût, les limites sont restaurées de façon répétée pour compenser les problèmes de stabilité et permettre aux utilisateurs de développer davantage

1 commentaires

 
GN⁺ 1 일 전
Avis sur Hacker News
  • C’est un peu comme les tours gratuits d’une machine à sous. Un ami est obsédé par l’idée d’épuiser tout son quota Fable, qui se termine aujourd’hui, au point de lancer quantité de tâches à l’utilité douteuse simplement parce que cette ressource semble rare.

    • C’est l’impression que me donnent la moitié des projets créés avec l’IA. Des collègues gèrent leur infrastructure domestique avec OpenClaw et toute une équipe d’agents, mais je ne vois pas à quoi ça sert dans une maison déjà automatisée avec Home Assistant. En dehors du travail, je ressens très peu le besoin d’utiliser l’IA.
    • L’IA elle-même ressemble à une machine à sous, et je ne serais pas surpris que ce soit un facteur majeur de psychose. On tire le levier avec un prompt, on regarde l’écran tourner, et très rarement les pièces se mettent à tomber.
    • On dirait qu’on est entré dans la phase de gamification pour pousser à l’utilisation du produit.
    • Permafable a été annoncé plus tôt cette semaine, mais la sensation de machine à sous est bien là.
  • Les resets et la suppression de la limite d’utilisation de 5 heures ont, sans que je m’en rende compte, fortement relevé ma base de consommation. Je ne rationne plus et je lance plusieurs agents au rythme que je veux, car au moins la semaine dernière, des resets supplémentaires continuaient d’être fournis.
    Je crains que, le jour où les resets s’arrêtent, mon flux de travail habituel dépasse soudain les limites, et que même passer à une formule supérieure ressemble à une régression.

    • Ces resets sont fournis à cause de la concurrence avec les rivaux. Une fois le marché gagné, ils chercheront à en tirer le maximum d’argent.
    • Je me demande si c’était vraiment fait « discrètement ».
  • C’est impressionnant qu’ils offrent des resets aussi souvent. Claude Code et Grok Build en font aussi, mais pas à ce niveau ; paradoxalement, Antigravity de Google, une grande entreprise pourtant riche en infrastructure, ne l’a jamais fait à ma connaissance. Je me demande combien coûtent ces resets à OpenAI.

    • Certains resets servaient à apaiser les clients après un bug de la version 5.6 qui faisait consommer beaucoup trop de tokens aux utilisateurs de sous-agents.
      Cela dit, c’est impressionnant qu’ils aient la capacité d’absorber ça.
    • Si OpenAI peut le faire souvent, c’est parce qu’ils ont suffisamment de ressources de calcul ; et cette marge vient aussi du fait qu’ils sont nettement derrière Anthropic sur les grands clients entreprise. Ils disent avoir gagné des millions d’utilisateurs après la sortie de la 5.6, donc la croissance est forte, mais reste à voir s’ils resteront.
      Personnellement, je ne l’utilise plus pour les gros travaux après l’avoir vu tenter une opération très risquée pendant que je ne regardais pas, et mes connaissances ont aussi dépassé la lune de miel initiale : l’enthousiasme est retombé.
  • 7 millions il y a 5 jours, 8 millions il y a 4 jours, 9 millions il y a 3 jours : c’est une croissance stupéfiante.

    • Comme ils ont remplacé l’ancienne app ChatGPT macOS par Codex, les « nouveaux » utilisateurs de Codex peuvent simplement être des personnes qui ont mis à jour l’app ChatGPT.
    • Une offre aussi généreuse ressemble à un événement destiné à gonfler le récit de croissance en vue d’une IPO. Autant profiter au maximum des subventions IA tant que c’est possible.
    • Je me demande comment ils mesurent le nombre d’utilisateurs. Est-ce qu’ils comptent une personne à chaque mise à jour de l’app ChatGPT ?
    • Comme n’importe quelle startup, ils doivent compter les utilisateurs de façon assez absurde. Si une personne l’utilise sur deux ordinateurs et un téléphone, il y a de fortes chances qu’elle compte comme 3 utilisateurs.
      Les growth hackers et l’industrie du référencement ont rendu le monde difficile à supporter, et la guerre psychologique d’OpenClaw est désormais sans objet faute de résultat, mais je reconnais au moins que c’était du grand n’importe quoi inventif.
    • C’est un growth hack malin : fusionner l’app ChatGPT et l’app Codex en une super app.
  • En tenant compte des resets accumulés, le rapport qualité-prix est énorme en ce moment. Notre entreprise utilise Claude Enterprise au prix de l’API et a déjà consommé 10 000 dollars ce mois-ci ; quand c’est possible, nous utilisons les agents Opus 4.8 et Sonnet 5.
    Avec Codex Pro, je fais tourner 5.6 Sol tous les jours et j’utilise parfois le mode ultra ; converti en usage API réel, ce serait probablement intenable.

    • Les prix de l’API peuvent inclure une marge énorme par rapport au coût réel. D’après mes tests, avec Pro 20x à 200 dollars par mois, en n’utilisant que GPT 5.6 Sol, on obtient environ 2 200 dollars d’usage API par semaine, soit 9 000 à 10 000 dollars par mois, même si cela varie un peu selon les coûts de cache.
      Les forfaits Anthropic à 100 et 200 dollars ont une limite hebdomadaire doublée, mais l’écart sur la limite de 5 heures est plus important. En revanche, le Pro 20x d’OpenAI coûte deux fois plus cher que le Pro 5x, mais offre quatre fois plus d’usage, et toute la limite hebdomadaire Codex d’un compte Plus à 20 dollars ne représente que 5 % de celle de Pro 20x.
      Les resets accumulés disparaissent 30 jours après attribution ; pour maximiser l’usage supplémentaire, on peut donc épuiser volontairement tout son quota avant de les utiliser.
    • Je me demande comment on peut autant consommer. Mon entreprise utilise aussi le tarif Claude Enterprise, mais avec une limite mensuelle de 800 dollars, et même en utilisant Opus pour toutes les tâches, on ne s’approche de la limite qu’en fin de mois. J’ai du mal à imaginer utiliser 12 fois plus de tokens sans gaspiller volontairement de l’argent.
    • Je me demande si Anthropic impose le forfait Enterprise aux entreprises au-delà d’une certaine taille, ou si elles le choisissent volontairement pour les fonctions pro. Même en faisant tourner toute la journée 2 ou 3 instances VS Code avec Opus 4.8 Max via des sièges Premium Team, je n’atteins pas la limite.
    • C’est amusant de voir tout le monde considérer le prix de l’API comme le coût réel. L’API dégage probablement de fortes marges, et même si les abonnements perdent un peu d’argent, habituer les particuliers aux modèles GPT afin qu’ils les recommandent au travail peut rapporter gros.
      En moyenne sur l’ensemble des abonnés, la majeure partie du quota d’abonnement doit rester inutilisée. Quelques clients qui consomment 100 % chaque semaine en tirent un énorme bénéfice, mais la majorité utilise beaucoup moins.
      Le jeu des resets, qui met la pression pour consommer au maximum avant le prochain reset imprévisible, est un mécanisme pour rendre les utilisateurs clés encore plus accros au produit.
    • Je regrette de n’avoir utilisé aucun des 4 resets expirés, mais de toute façon tout le quota a été réinitialisé. Je me lance à fond avec 5.6-Sol-ultra dans un projet que je n’aurais normalement pas fait : remanier largement le roman de quelqu’un d’autre et y ajouter des illustrations.
  • J’ai appris à mes dépens que Codex supprime les resets détenus au début du cycle hebdomadaire.

  • J’aime bien, on dirait deux parents qui rivalisent pour savoir qui offrira le plus de cadeaux à leur enfant. C’est comme avoir deux Noëls.

    • Anthropic n’offre pas beaucoup de cadeaux.
  • Anthropic réinitialise régulièrement entre le jeudi et le vendredi, ce qui désavantage un peu les utilisateurs dont le reset tombait déjà à ce moment-là.

    • Si Anthropic offre aussi des resets gratuits, alors utiliser deux abonnements à 20 dollars par mois en parallèle semble être le meilleur rapport qualité-prix en ce moment.
  • Il serait utile qu’il existe un endpoint API officiel permettant de vérifier par programmation l’utilisation de Codex et l’heure de réinitialisation du quota. On pourrait alors créer en vibe coding une app qui signale quand l’utilisation revient à 100 % après une réinitialisation par OpenAI, ou quand il reste 10 % de l’utilisation sur 5 heures.
    Pour l’instant, il faut passer indirectement par le Codex App Server, ce qui n’est pas idéal.

    • L’heure de réinitialisation du quota peut être consultée via cet endpoint. En envoyant une requête GET avec le token d’authentification local de Codex comme Bearer token, la réponse inclut available_count et credits[].expires_at
      https://chatgpt.com/backend-api/wham/rate-limit-reset-credit...
    • Il suffit d’utiliser CodexBar
      https://github.com/steipete/CodexBar
    • Actuellement, la limite de 5 heures a disparu, il n’est donc plus nécessaire de la suivre. Pour le reste, on peut demander une fois à Codex de générer du code Python qui renvoie l’utilisation restante, la prochaine date de réinitialisation, etc.
      Le résultat utilise le Codex App Server, mais comme il s’agit d’un processus de courte durée communiquant via stdio, c’est plutôt acceptable.
    • Je mets cette page en favori et la consulte souvent
      https://chatgpt.com/codex/cloud/settings/analytics
    • La première partie semble pouvoir être vérifiée sur ce site. Il se peut qu’ils fournissent aussi une API de notifications.
  • C’est un site utile. J’aime bien la réinitialisation, et comme il me reste encore 3 réinitialisations non utilisées, je continue à utiliser 5.6 Sol Fast mode à raison d’un milliard de tokens par jour.
    Cela dit, Codex m’a confirmé qu’en supprimant la limite de 5 heures, ils ont discrètement abaissé le contexte de 5.6 Sol d’environ 354k à environ 258k.

    • Il existe quelques tweets à ce sujet, donc le changement n’a pas été totalement silencieux. En définissant model_context_window=YOUR_VALUE dans ~/.codex/config.toml, il semble possible de revenir à la taille d’origine.