Vous venez d’installer Codex sur Windows, de l’utiliser dans VS Code ou de lancer Codex CLI dans votre terminal et une question arrive rapidement : est-ce que chaque tâche consomme mon quota ChatGPT ?
La réponse courte est oui, si vous utilisez Codex en étant connecté avec votre compte ChatGPT.
Mais le fonctionnement est plus subtil qu’un simple compteur de messages. Le modèle choisi, la taille du projet, le nombre de fichiers analysés, le niveau de raisonnement ou encore les outils utilisés peuvent faire varier considérablement la consommation.
Voici comment fonctionne réellement le quota Codex avec ChatGPT Plus en 2026, et surtout comment éviter de le consommer inutilement.
Article mis à jour le 21 septembre 2026. Les modèles et limites de Codex évoluent régulièrement. Les chiffres indiqués ci-dessous correspondent aux informations publiées par OpenAI à cette date.
Codex est-il inclus dans ChatGPT Plus ?
Oui.
OpenAI permet d’utiliser Codex en se connectant directement avec son compte ChatGPT. Codex est accessible depuis plusieurs interfaces :
- l’application de bureau ChatGPT en mode Codex ;
- Codex CLI ;
- l’extension Codex pour VS Code et les IDE compatibles ;
- Codex sur le Web.
Les limites d’utilisation dépendent du forfait ChatGPT utilisé.
Pour un développeur, cela permet donc d’utiliser son abonnement ChatGPT sans avoir obligatoirement à créer une clé API OpenAI et à payer chaque token séparément.
Source officielle : Utiliser Codex avec votre offre ChatGPT
Utiliser Codex consomme-t-il réellement votre quota ?
Oui.
Lorsque vous lancez une tâche Codex en étant connecté avec votre compte ChatGPT, celle-ci consomme l’utilisation Codex incluse dans votre abonnement.
Mais il ne faut surtout pas raisonner ainsi :
1 prompt = 1 unité de quota.
Une demande très simple et une analyse complète d’un projet peuvent avoir des consommations radicalement différentes.
OpenAI indique que la consommation dépend notamment :
- du modèle utilisé ;
- de la complexité de la tâche ;
- de la quantité de contexte ;
- des fichiers lus ;
- des entrées et sorties produites ;
- du niveau de raisonnement ;
- des outils appelés ;
- du mode de vitesse utilisé ;
- du nombre d’étapes nécessaires pour terminer la tâche.
Une tâche longue peut donc consommer beaucoup plus de quota qu’une petite correction de code.
ChatGPT et Codex utilisent-ils exactement le même quota ?
Pas tout à fait.
Il faut distinguer l’utilisation classique de ChatGPT de l’utilisation agentique.
OpenAI indique actuellement que Codex et ChatGPT Work partagent le quota d’utilisation inclus dans le forfait. Selon l’offre, d’autres fonctions agentiques peuvent également utiliser cette réserve commune.
En revanche, discuter normalement avec ChatGPT n’est pas simplement décompté du compteur Codex.
C’est une distinction importante : passer une heure à poser des questions classiques à ChatGPT n’équivaut pas à demander pendant une heure à Codex d’analyser, modifier et tester un dépôt Git complet.
Deux limites à comprendre : 5 heures et quota hebdomadaire
Pour certains forfaits, dont ChatGPT Plus, OpenAI applique deux niveaux de limitation à Work et Codex :
- une fenêtre de 5 heures ;
- une limite hebdomadaire.
Pour continuer à travailler lorsque les deux s’appliquent, du quota doit rester disponible dans chacune des deux périodes.
La fenêtre de 5 heures
Attention à une confusion fréquente.
Cela ne signifie pas :
« Je peux utiliser Codex pendant exactement cinq heures. »
La fenêtre de cinq heures correspond à une période de consommation.
Vous pouvez atteindre votre limite avant la fin des cinq heures si vous lancez plusieurs tâches lourdes.
Inversement, quelques petites modifications peuvent consommer très peu de cette réserve.
Une nouvelle période commence lorsque vous envoyez votre premier message dans Work ou Codex après la fin de la période précédente.
La limite hebdomadaire
Une seconde limite mesure la quantité totale de travail incluse sur une période hebdomadaire.
Vous pouvez donc rencontrer deux situations :
- votre quota de cinq heures est épuisé, mais il vous reste du quota hebdomadaire ;
- votre quota hebdomadaire est épuisé même si une nouvelle fenêtre de cinq heures devrait normalement commencer.
Dans les deux cas, Codex peut vous empêcher de lancer de nouvelles tâches jusqu’à la prochaine réinitialisation ou jusqu’à l’utilisation d’une option supplémentaire proposée par votre compte.
Source officielle : Gérer l’utilisation de GPT-6 Astra dans Work et Codex
Combien de requêtes Codex peut-on faire avec ChatGPT Plus ?
OpenAI publie désormais des estimations plus concrètes.
Pour ChatGPT Plus, l’entreprise indique approximativement le nombre suivant de messages locaux pouvant être réalisés sur une période de cinq heures :
| Modèle | Estimation avec ChatGPT Plus / 5 h |
|---|---|
| GPT-6 Astra | environ 5 à 45 |
| GPT-5.6 Sol | environ 10 à 100 |
| GPT-5.6 Terra | environ 25 à 200 |
| GPT-5.6 Luna | environ 250 à 2 000 |
Ces chiffres ne sont pas des quotas fixes de messages.
OpenAI les présente comme des estimations. L’utilisation réelle varie selon la tâche, le modèle et les paramètres utilisés.
Un prompt très court peut coûter peu de ressources alors qu’un autre peut demander à Codex de :
- parcourir plusieurs centaines de fichiers ;
- comprendre l’architecture ;
- rechercher un bug ;
- modifier plusieurs classes ;
- lancer les tests ;
- analyser les erreurs ;
- corriger à nouveau le code ;
- relancer les tests.
Les deux actions peuvent correspondre à une seule demande utilisateur, mais leur coût informatique n’a évidemment rien de comparable.
Quel modèle Codex utiliser ?
Le choix du modèle peut avoir un impact considérable sur votre quota.
GPT-5.6 Luna : pour les petites tâches
Luna est le modèle le plus économique parmi les principaux niveaux actuellement proposés.
Il est adapté aux tâches ciblées ou répétitives :
- petite correction ;
- extraction d’information ;
- renommage ;
- modification simple ;
- génération de boilerplate ;
- transformation répétitive.
Avec ChatGPT Plus, OpenAI estime entre 250 et 2 000 messages locaux par fenêtre de cinq heures, selon la nature des tâches.
GPT-5.6 Terra : le bon compromis pour le développement quotidien
Terra cherche un équilibre entre vitesse, capacités et consommation.
Il peut être particulièrement adapté au travail quotidien :
- ajout d’une fonctionnalité ;
- modification d’une classe ;
- refactorisation ciblée ;
- ajout de tests ;
- correction d’un formulaire ;
- travail courant sur PHP, Laravel ou WordPress.
OpenAI estime actuellement entre 25 et 200 messages locaux par période de cinq heures avec Plus.
Pour beaucoup de développeurs, il peut donc constituer un bon modèle par défaut.
GPT-5.6 Sol : pour les tâches plus complexes
Sol offre davantage de capacités pour :
- l’implémentation de fonctionnalités complexes ;
- l’analyse de code ;
- la recherche ;
- les problèmes demandant plusieurs étapes ;
- les refactorisations importantes.
La contrepartie est une consommation plus élevée.
OpenAI donne actuellement une estimation d’environ 10 à 100 messages locaux sur cinq heures avec Plus.
GPT-6 Astra : à réserver aux problèmes difficiles ?
GPT-6 Astra est présenté par OpenAI comme son modèle destiné aux tâches les plus exigeantes en programmation, analyse, recherche et résolution de problèmes complexes.
Par exemple :
- bug difficile à reproduire ;
- problème d’architecture ;
- analyse d’un comportement inconnu ;
- investigation complexe sur un projet important.
Mais cette puissance se paie en quota.
Avec ChatGPT Plus, OpenAI estime actuellement environ 5 à 45 messages locaux sur cinq heures.
Il n’est donc pas forcément pertinent d’utiliser Astra pour modifier trois lignes de PHP.
Le niveau de raisonnement compte également
Le modèle n’est pas le seul paramètre.
Codex permet aussi de choisir le niveau de raisonnement.
OpenAI distingue notamment :
- faible : rapidité et économie de quota ;
- moyen : compromis entre rapidité et analyse ;
- élevé : problèmes complexes nécessitant davantage d’analyse.
Un raisonnement plus élevé peut consommer davantage et ne garantit pas systématiquement un meilleur résultat.
Pour une modification simple, utiliser systématiquement le modèle le plus puissant avec un raisonnement élevé peut gaspiller une partie importante du quota sans améliorer réellement le code produit.
Le mode Rapide consomme également davantage
OpenAI précise également que le mode Rapide fournit des réponses plus rapides mais consomme davantage du quota inclus.
Pour une tâche qui n’est pas urgente, il peut donc être intéressant de conserver le mode standard.
Codex Desktop, CLI et VS Code ont-ils des quotas séparés ?
Non, pas lorsque vous utilisez le même compte ChatGPT.
Changer d’interface ne permet pas de récupérer un nouveau quota.
Vous pouvez par exemple travailler successivement avec :
Application ChatGPT / Codex
↓
Extension VS Code
↓
Codex CLI
Les tâches restent associées à votre utilisation Codex lorsque ces outils utilisent le même compte ChatGPT.
OpenAI permet explicitement d’utiliser Codex depuis l’application de bureau, la CLI, l’extension IDE ou le Web avec le même compte ChatGPT.
À lire également sur Dixie Consulting : Codex est maintenant disponible sur VSCode
Comment voir son quota Codex restant ?
C’est probablement le réflexe le plus utile à prendre.
Depuis l’application
Ouvrez :
Paramètres → Utilisation
L’écran permet notamment de consulter :
- le quota restant ;
- la période concernée ;
- l’heure de réinitialisation ;
- éventuellement les crédits disponibles.
Depuis Codex CLI
Dans une session Codex CLI, utilisez simplement :
/status
La commande permet d’obtenir des informations sur votre utilisation actuelle.
Comment éviter de consommer inutilement son quota ?
Quelques changements dans la manière de travailler peuvent faire une grosse différence.
1. Limiter le périmètre demandé
Évitez autant que possible :
Analyse tout mon projet et améliore le code.
Sur un gros repository, Codex peut devoir parcourir énormément de fichiers avant même de commencer à modifier quoi que ce soit.
Un prompt plus ciblé sera souvent préférable :
Analyse uniquement :
src/Service/
tests/Service/
Recherche les incompatibilités PHP 8.4.
Ne modifie que les fichiers concernés et lance les tests associés.
Vous réduisez le contexte à analyser et vous donnez également à l’agent un objectif plus clair.
2. Utiliser le modèle adapté à la tâche
Une stratégie simple pourrait être :
| Type de tâche | Modèle à envisager |
|---|---|
| Modification minime | Luna |
| Développement quotidien | Terra |
| Fonctionnalité complexe | Sol |
| Bug ou architecture difficile | Astra |
Il ne s’agit évidemment pas d’une règle absolue.
Mais demander à Astra de renommer une variable revient un peu à utiliser un serveur de calcul pour effectuer une addition.
3. Commencer avec un raisonnement faible ou moyen
OpenAI recommande d’augmenter le niveau de raisonnement seulement lorsque cela apporte réellement quelque chose.
Une bonne méthode consiste donc à commencer par :
Terra + raisonnement faible ou moyen
puis à augmenter si le problème résiste.
4. Éviter les analyses globales répétitives
Supposons que Codex ait déjà analysé votre projet et identifié un problème.
Évitez ensuite de demander :
Réanalyse tout le projet et vérifie la correction.
Préférez :
Vérifie uniquement les fichiers modifiés et lance les tests concernés.
5. Fournir immédiatement les informations utiles
Si vous connaissez :
- le fichier concerné ;
- le message d’erreur ;
- la stack trace ;
- la commande qui échoue ;
- le test concerné ;
indiquez-les dès le départ.
Moins Codex doit explorer le projet pour comprendre le problème, plus l’intervention peut être efficace.
Et si j’utilise une clé API OpenAI ?
C’est un fonctionnement différent.
Lorsque Codex est utilisé avec votre propre clé API, la consommation ne repose pas sur le quota inclus dans votre abonnement ChatGPT de la même manière.
L’utilisation de l’API est facturée séparément selon la consommation et les tarifs de l’API OpenAI.
On peut donc résumer :
| Méthode | Facturation |
|---|---|
| Codex connecté à ChatGPT Plus | quota inclus dans Plus |
| Codex CLI connecté à ChatGPT Plus | quota inclus dans Plus |
| Extension IDE connectée à ChatGPT Plus | quota inclus dans Plus |
| Codex avec clé API personnelle | facturation API séparée |
Que se passe-t-il lorsque le quota est épuisé ?
OpenAI propose différentes possibilités selon le compte.
Vous pouvez notamment :
- attendre la prochaine réinitialisation ;
- utiliser une réinitialisation disponible ;
- acheter des crédits si cette option est disponible ;
- éventuellement changer de forfait.
Les utilisateurs Plus et Pro éligibles peuvent acheter des crédits supplémentaires sans nécessairement modifier leur abonnement.
Ces crédits constituent une consommation supplémentaire et ne sont pas des crédits API.
Attention aux réinitialisations
OpenAI propose également dans certains cas des réinitialisations de quota.
Une réinitialisation complète peut renouveler :
- la fenêtre de cinq heures ;
- la limite hebdomadaire.
Mais elle peut également modifier le début de votre nouvelle période hebdomadaire.
Il faut donc vérifier les informations affichées avant de l’utiliser.
Source officielle : Utiliser des crédits pour une utilisation flexible dans ChatGPT
ChatGPT Plus est-il suffisant pour utiliser Codex ?
Pour un développeur utilisant Codex ponctuellement ou quotidiennement sur des tâches ciblées, ChatGPT Plus peut offrir une quantité de travail importante, particulièrement avec Terra ou Luna.
La situation change lorsqu’on utilise intensivement :
- Astra ;
- un raisonnement élevé ;
- plusieurs agents ;
- de très gros dépôts ;
- des tâches longues ;
- des analyses répétitives ;
- de nombreuses exécutions de tests.
Dans ce cas, la limite hebdomadaire peut devenir beaucoup plus visible.
Le choix entre Plus et Pro dépend donc moins du nombre de prompts envoyés que du type de travail confié à l’agent.
Pour aller plus loin, consultez également notre article ChatGPT Pro passe à 103 € : ce qui change pour Codex.
Pour une comparaison plus générale des différentes formules ChatGPT, consultez notre guide ChatGPT prix : Gratuit ou payant, quelle option choisir ?.
FAQ
Codex CLI utilise-t-il mon quota ChatGPT Plus ?
Oui, si Codex CLI est connecté avec votre compte ChatGPT. Il utilise alors votre utilisation Codex incluse dans votre forfait.
L’application Codex et VS Code disposent-elles chacune de leur propre quota ?
Non. Utiliser plusieurs interfaces avec le même compte ChatGPT ne crée pas plusieurs réserves indépendantes.
Une grosse tâche consomme-t-elle plus qu’une petite ?
Oui.
La consommation varie notamment avec la taille du contexte, la complexité, le modèle, le raisonnement et les outils utilisés.
Puis-je utiliser ChatGPT normalement après avoir épuisé Codex ?
Oui. Les limites standard de Chat et le quota partagé de Work et Codex sont distincts.
Puis-je acheter du quota Codex supplémentaire ?
Pour les comptes Plus ou Pro éligibles, OpenAI peut permettre l’achat de crédits supplémentaires ou de réinitialisations selon le compte et le pays de facturation.
Puis-je utiliser l’API après avoir épuisé mon quota ChatGPT ?
Oui, si vous disposez d’un compte API configuré et d’une facturation API active.
La consommation API est distincte de l’utilisation incluse dans votre abonnement ChatGPT.
Quel modèle utiliser pour économiser son quota ?
Pour les petites tâches, Luna est actuellement le plus économique parmi les principaux modèles Codex.
Terra constitue un compromis intéressant pour le développement quotidien.
Sol et surtout Astra peuvent être réservés aux tâches nécessitant davantage de capacités.
Conclusion
Codex ne fonctionne donc pas comme un simple chatbot avec un nombre fixe de messages.
Avec ChatGPT Plus, vous disposez d’une enveloppe de calcul dont la consommation dépend directement du travail demandé.
Une modification de quelques lignes, un refactoring complet et l’analyse d’un dépôt entier n’ont pas le même coût.
Pour utiliser efficacement Codex, trois principes ressortent :
- choisir le modèle adapté à la difficulté ;
- limiter le périmètre des tâches lorsque c’est possible ;
- surveiller régulièrement Paramètres → Utilisation ou
/status.
Utilisé de cette manière, Codex peut devenir un véritable agent de développement sans nécessairement épuiser rapidement le quota inclus dans ChatGPT Plus.
Mais pour les utilisateurs qui lui délèguent quotidiennement de longues tâches agentiques, le quota devient désormais un paramètre à prendre en compte au même titre que les performances du modèle.
1 commentaire sur « Codex consomme-t-il votre quota ChatGPT ? Limites, modèles et astuces pour économiser son utilisation »