Prix de Codex : ce que ça coûte vraiment

Codex n'a pas de prix propre : il est inclus dans tous les plans ChatGPT, et depuis avril 2026 il se facture en crédits de tokens et non plus en messages. Ce que ça change pour votre facture.

Profile photo of Paul Irolla

Par Paul Irolla

Founder · AI & developer tools · Tokenade

Docteur en IA · conçoit des outils d'optimisation de tokens pour agents de code

Voir la page de l'auteur
8 min de lecture
Résumer avec l'IA
Citer cette page
Fait partie du pilier réduire l'usage de tokens des agents de code IA. Cette page traite de ce que coûte Codex ; le pilier traite de comment dépenser moins, quel que soit l'agent.

Combien coûte OpenAI Codex ?

Codex n'a pas de prix qui lui soit propre. Il est inclus dans tous les plans ChatGPT, Free et Go compris, et c'est votre plan qui décide de la quantité à laquelle vous avez droit. C'est pourquoi « combien coûte Codex » n'a pas de réponse chiffrée unique. Ce qui a changé en 2026, c'est la forme de cette réponse : depuis avril, l'usage est mesuré en crédits de tokens et non plus compté en messages. Cette distinction compte davantage que le prix du plan. Sous un quota de messages, une question d'une ligne et une refonte de quarante fichiers vous coûtaient la même chose. En crédits de tokens, non. Deux développeurs sur le même plan peuvent désormais l'épuiser à des rythmes complètement différents sans que ni l'un ni l'autre ne fasse quoi que ce soit d'inhabituel. Cette page couvre ce que vous achetez réellement, ce qui a changé et quand, et ce qui fait bouger le chiffre. Pour les tarifs des plans individuels, consultez directement la page de tarifs d'OpenAI plutôt qu'un guide, celui-ci compris : ils sont affichés en direct et ils bougent.

Quels plans ChatGPT incluent Codex ?

Tous. Le centre d'aide d'OpenAI indique que Codex est inclus dans l'ensemble des plans ChatGPT, y compris Free et Go, avec des limites d'usage qui varient selon le plan. Les paliers payants parlent d'« usage étendu de Codex » (Plus) et de « tâches Codex maximales » (Pro). Vous y accédez par quatre clients officiels, tous connectés avec le même compte ChatGPT :
  • l'application de bureau ChatGPT, en mode Codex
  • le CLI Codex, où se fait l'essentiel du travail agentique
  • l'extension IDE Codex
  • Codex sur le web
Le client que vous choisissez ne change pas vos droits. Il change la quantité de contexte que l'agent rassemble avant de démarrer, et c'est cette partie-là qui vous coûte.

Qu'est-ce qui a changé en avril 2026 ?

OpenAI a remplacé la tarification par message par une facturation en crédits de tokens sur Plus, Pro et Business. L'annonce, datée du 2 avril 2026, le dit sans détour : « Les sièges Codex-only n'ont pas de limite de débit, et l'usage est facturé à la consommation de tokens. Cela donne une vision plus claire de la façon dont l'usage se transforme en dépense. » C'est le fait le plus important sur le prix de Codex, et c'est aussi pourquoi la plupart des guides bien placés sur cette requête induisent en erreur. Tout ce qui a été écrit avant avril décrit un produit à quota de messages qui n'existe plus. Tout ce qui pose encore la question en « combien de messages ai-je droit » répond à propos d'un autre produit. La même annonce a abaissé le prix annuel de ChatGPT Business de 25 à 20 dollars par siège.

Et qu'est-ce qui a changé en juin ?

Les sièges Codex en paiement à l'usage ne sont plus proposés aux nouveaux clients Business depuis le 24 juin 2026. OpenAI a ajouté la note directement à l'annonce d'avril : « À compter d'aujourd'hui, les nouveaux sièges Codex en paiement à l'usage ne seront plus disponibles pour les plans Business. Les sièges existants ne sont pas affectés. » Si vous bénéficiez d'un siège en paiement à l'usage antérieur, rien ne change pour vous. Si vous évaluez Codex pour une équipe aujourd'hui, l'option sans limite de débit où l'on ne paie que les tokens — celle que décrivent la plupart des guides de 2026 — n'est pas sur la table : vous regardez des sièges Business standard, qui comportent bien des limites d'usage Codex. Cela vaut la peine d'être vérifié avant de bâtir un déploiement sur un modèle tarifaire lu dans un guide daté de juin ou juillet. Plusieurs des premiers résultats sur « codex pricing » présentent encore le paiement à l'usage comme accessible à tous.

Comment fonctionnent les crédits de tokens ?

Un crédit se consomme au volume de texte déplacé, pas au nombre de requêtes. Chaque tour envoie au modèle votre prompt plus ce que l'agent a décidé d'y joindre : contenu de fichiers, sorties de commandes, définitions d'outils, historique de conversation. L'ensemble est mesuré. La réponse l'est aussi, à un tarif par token plus élevé, mais il y en a bien moins. La conséquence pratique, c'est que le coût suit la taille du contexte, et que cette taille est décidée par l'agent à votre place. Vous tapez douze mots ; l'agent lit quatre fichiers, lance un test et charge trois manifestes d'outils. Tout vous est facturé. C'est pourquoi deux personnes sur un plan identique peuvent l'épuiser à des rythmes très différents : la différence ne tient pas à ce qu'elles écrivent, mais à ce que leur installation lit avant de répondre. Cela explique aussi pourquoi l'ancien quota de messages semblait plus équitable aux petits usages et pire pour tous les autres. Un quota de N messages facturait une question d'une ligne exactement comme une refonte de dépôt entier. Les crédits de tokens les facturent honnêtement, ce qui est mieux, mais supprime l'illusion d'un plafond mensuel prévisible tant que vous ne gérez pas activement ce qui entre en contexte. Deux habitudes en découlent, et il vaut mieux les prendre tôt. D'abord, traiter chaque « lire le fichier entier » comme un achat. Ensuite, traiter chaque serveur MCP connecté comme un abonnement permanent : son manifeste part à chaque tour, que vous appeliez ou non un seul de ses outils.

Pourquoi cela compte-t-il de plus en plus ?

Parce que l'usage de Codex croît plus vite que la compréhension qu'en ont les équipes. OpenAI indiquait le 2 avril 2026 que plus de 2 millions de développeurs utilisent Codex chaque semaine, que plus de 9 millions d'utilisateurs professionnels payants s'appuient sur ChatGPT au travail, et que le nombre d'utilisateurs Codex au sein de ChatGPT Business et Enterprise avait été multiplié par 6 depuis janvier. Une adoption à ce rythme, sur un modèle de facturation qui a changé en avril et s'est resserré en juin, c'est exactement le contexte dans lequel une équipe découvre trois mois trop tard que son modèle de coût était faux. Le plan choisi en février était tarifé en messages. Il ne l'est plus.

Qu'est-ce qui fait vraiment la facture Codex ?

L'entrée, pas la sortie. Pour presque toute charge agentique, les tokens qui entrent dans le modèle dominent ceux qui en sortent, généralement d'environ un ordre de grandeur. Ce seul fait décide de l'endroit où votre effort vaut la peine. Ce qui gonfle l'entrée est ennuyeux et constant sur tous les agents, pas seulement Codex :
  • Les lectures de fichiers entiers. L'agent ouvre un fichier de 2 000 lignes pour en modifier quatre, et les 1 996 autres sont facturées.
  • Les sorties de commandes. Un lancement de tests, un log d'installation ou un git diff repart en entier, essentiellement du bruit.
  • Les manifestes d'outils. Chaque serveur MCP connecté envoie ses définitions d'outils en contexte avant votre premier message, que vous les utilisiez ou non.
  • Les relectures. Le même fichier entrant quatre fois en contexte dans une session coûte quatre fois, et c'est le mode d'échec que vous remarquerez le moins.
Rien de tout cela n'apparaît comme une ligne de facture. Cela apparaît comme des crédits qui filent plus vite que le travail ne semble le justifier.

Codex est-il moins cher que Claude Code, Cursor ou Copilot ?

La question n'est pas soluble par une comparaison de prix de plans, et c'est la réponse honnête. Les quatre mesurent désormais l'usage d'une façon ou d'une autre : le prix affiché fixe un plafond, pas un coût. Ce que vous payez sous ce plafond dépend de la quantité de contexte que votre agent rassemble par tâche, ce qui est une propriété de votre façon de travailler, pas du logo de l'outil. Si vous voulez la même analyse pour les autres, elles sont ici : prix de Claude Code, prix de Cursor et prix de Copilot. La forme de la réponse est la même dans les quatre cas.

Comment appliquer ça aujourd'hui

  1. Mesurez votre consommation réelle avant de changer de plan. Monter en gamme pour acheter une marge que vous gaspillez est l'erreur la plus fréquente et la plus coûteuse de cette catégorie.
  2. Regardez d'abord la répartition entrée/sortie. Si l'entrée domine d'un facteur 10 — et c'est presque certainement le cas — alors les réglages côté sortie ne sont pas là où vit votre facture.
  3. Auditez ce que votre agent lit avant de raisonner. Lectures de fichiers entiers, sorties de commandes non filtrées et manifestes MCP toujours actifs sont les trois suspects habituels, dans cet ordre.
  4. Revérifiez la page de tarifs plutôt qu'un guide. Celui-ci compris. Avec le modèle en crédits de tokens, le prix du plan est le chiffre le moins intéressant de la page.
Si vous préférez ne pas faire les étapes 2 et 3 à la main, c'est le manque que comble Tokenade : il se place entre l'agent et ses outils, remplace les lectures de fichiers entiers par des lectures structure-d'abord et de la recherche sémantique, compresse les sorties de commandes, et diffère les manifestes MCP jusqu'à leur utilisation. Il prend en charge Codex nativement au même titre que les autres grands agents, et son offre gratuite couvre largement le travail en solo.

Ce qui tourne mal (anti-patterns)

Lire un guide antérieur à avril. Le cadrage en quota de messages est obsolète et vous fera dimensionner votre capacité dans la mauvaise unité. Bâtir un déploiement d'équipe sur le paiement à l'usage. Fermé aux nouveaux clients Business depuis le 24 juin 2026. Vérifiez votre type de siège avant d'en faire un budget. Optimiser la longueur des réponses. Plafonner la sortie donne l'impression de maîtriser le coût et ne change presque rien, parce que le trafic agentique est très majoritairement entrant. C'est le levier vers lequel on se tourne en premier et celui qui rapporte le moins. Prendre le prix du plan pour le coût. En crédits de tokens, le plan fixe un plafond. Deux personnes du même palier peuvent avoir des coûts effectifs très différents, et l'écart tient entièrement à ce que leur agent lit.
À lire aussi :

Classé n°1 au Token-Harness Optimizer Leaderboard.

Tokenade est classé n°1 au Token-Harness Optimizer Leaderboard — un benchmark de bout en bout des optimiseurs de tokens, mesuré sur de vraies sessions de code. Installez-le une fois, il agit sur chaque prompt. Compatible avec Claude Code, Cursor, Codex, Copilot et plus.