DevNews

OpenAI baisse GPT-5.6 Sol à 4 et 20 dollars le million

Sur cette page
  1. Ce qui change et ce qui ne change pas
  2. Faites le calcul sur votre propre trafic
  3. Le cadre concurrentiel
  4. Ce que nous ferions cette semaine

OpenAI a baissé le tarif d'interface de GPT-5.6 Sol, son modèle de tête, le vendredi vingt et un août 2026. L'entrée passe de cinq à quatre dollars le million de jetons, l'entrée mise en cache de cinquante à quarante centimes, et la sortie de trente à vingt dollars. La sortie est le vrai mouvement : un tiers de moins, pas un cinquième. Les nouveaux tarifs sont promotionnels et courent trois mois, jusqu'au vingt et un novembre 2026. Ils couvrent l'interface de programmation et les plans de crédits éligibles pour ChatGPT Work et Codex, tandis que les abonnements Pro, Plus et Business restent exactement où ils étaient. C'est la deuxième révision de prix de la famille 5.6 en moins d'un mois.

The short answer

OpenAI a revu le prix de GPT-5.6 Sol le 21 août 2026. L'entrée passe de 5 à 4 dollars le million de jetons, l'entrée en cache de cinquante à quarante centimes, et la sortie de 30 à 20 dollars. Le tarif est promotionnel et court trois mois, jusqu'au 21 novembre. Il couvre l'interface de programmation ainsi que les plans de crédits éligibles ChatGPT Work et Codex, et laisse intacts les abonnements Pro, Plus et Business. Votre économie réelle se situe entre 20 et 33 pour cent selon le poids de la sortie dans votre charge.

4 / 20 $nouveaux tarifs Sol, entrée et sortie, au million
33%la baisse du côté sortie
21 nov.fin du tarif promotionnel, 2026
Carte réponse : OpenAI a baissé le tarif de GPT-5.6 Sol le 21 août 2026, l'entrée passant de 5 à 4 dollars le million de jetons, l'entrée en cache de 0,50 à 0,40 dollar et la sortie de 30 à 20 dollars, un tarif promotionnel courant jusqu'au 21 novembre 2026 sur l'interface de programmation et sur les plans de crédits éligibles ChatGPT Work et Codex.
Le palier haut de gamme bouge pour la première fois depuis son lancement. PNG

Le chiffre intéressant de cette annonce n'est pas celui du titre. OpenAI parle de plus de 20 pour cent, ce qui est vrai du côté entrée. Le côté sortie a baissé d'un tiers, et pour la plupart de ceux qui exploitent un modèle de tête en production, c'est la sortie qui coûte.

L'annonce, depuis le compte officiel d'OpenAI.

Ce qui change et ce qui ne change pas

Trois nombres ont bougé, tous par million de jetons. L'entrée passe de 5,00 à 4,00 dollars. L'entrée en cache passe de 0,50 à 0,40 dollar. La sortie passe de 30,00 à 20,00 dollars. Le tarif de l'entrée en cache conserve son rapport de un à dix avec l'entrée fraîche : la mise en cache des invites vaut donc exactement ce qu'elle valait hier, c'est-à-dire beaucoup sur toute charge dotée d'une invite système stable.

Le périmètre est plus étroit que l'enthousiasme ne le laisse croire. Il s'agit du prix de l'interface de programmation, plus les plans de crédits éligibles pour ChatGPT Work et pour Codex. Les abonnements Pro, Plus et Business ont explicitement été laissés de côté. Si votre organisation achète des sièges plutôt que des jetons, cette annonce ne change rien pour vous.

La durée est le point à noter. OpenAI l'a présentée comme trois mois à compter du 21 août, ce qui place la fin au 21 novembre 2026. C'est un tarif promotionnel avec une échéance annoncée, pas un nouveau prix catalogue.

Faites le calcul sur votre propre trafic

L'économie sur votre facture n'est ni de 20 ni de 33 pour cent. C'est une moyenne pondérée, et le poids, c'est votre rapport entrée sur sortie.

Prenez un service orienté recherche documentaire qui envoie dix fois plus d'entrée que de sortie. Ancien coût pour onze millions de jetons : dix millions d'entrée à 5 dollars plus un million de sortie à 30 dollars, soit 80 dollars. Nouveau coût : 40 plus 20, soit 60 dollars. Vingt-cinq pour cent de moins.

Prenez maintenant une charge de génération proche de la parité. Ancien coût pour deux millions de jetons : 5 dollars plus 30, soit 35. Nouveau coût : 4 plus 20, soit 24. Trente et un pour cent de moins.

Le schéma se généralise. Plus votre dépense pèse sur le compteur de sortie, plus vous approchez du tiers complet. Les boucles d'agent qui lisent d'énormes contextes et émettent de courts appels d'outils se situent en bas de la fourchette. Tout ce qui écrit de longues réponses, de longs programmes ou de longs résumés se situe près du haut.

Graphique comparatif de l'économie effective sur une facture GPT-5.6 Sol selon le profil de charge, avec une charge orientée entrée à dix contre un économisant 25 pour cent, une charge à trois contre un économisant 29 pour cent, une charge de génération à parité économisant 31 pour cent, et une charge purement de sortie économisant les 33 pour cent complets.
Même baisse de prix, quatre factures différentes selon le profil de jetons. PNG

Le cadre concurrentiel

À 4 et 20 dollars, Sol passe désormais sous Claude Opus 5 sur les deux compteurs, ce modèle étant affiché à 5 et 25 dollars. Claude Fable 5 relève d'une autre proposition, à 10 et 50 dollars. C'est la deuxième révision de prix de la famille GPT-5.6 en moins d'un mois : le 30 juillet, OpenAI avait baissé Luna de 80 pour cent et Terra de 20 pour cent en laissant Sol intact. Sol les a rejoints.

Lisez cette séquence pour ce qu'elle est. Le bas de gamme est devenu bon marché en premier, ce qui a fait descendre d'un cran les charges de volume. Le haut de gamme vient de bouger à son tour, ce qui rend le maintien sur le modèle de tête moins arbitré par le budget. Si vous aviez détourné du trafic de Sol pour des raisons de coût en juillet, l'évaluation d'aiguillage que vous aviez menée reposait sur un compteur de sortie à 30 dollars qui n'existe plus.

Par ailleurs, GitHub mène sa propre promotion, divisant par deux le prix de Sol dans GitHub Copilot jusqu'au 3 septembre 2026. Il s'agit de facturation Copilot et non de l'interface de programmation, cela ne se cumule pas, et la fenêtre se referme bien plus tôt. Si votre évaluation se déroule dans Copilot, le délai est nettement plus court.

Ce que nous ferions cette semaine

Sortez du tableau de bord de consommation le comptage de jetons du mois dernier par modèle, et recalculez la facture à 4 et 20 dollars. Cela donne le chiffre réel plutôt que celui du titre, et demande une dizaine de minutes.

Ensuite, si vous avez déplacé des charges hors de Sol plus tôt cet été pour des raisons de coût, relancez la comparaison. Les frontières entre paliers ont bougé deux fois depuis juillet, et la réponse que vous gardez en tête est probablement périmée.

Questions fréquentes

Quels sont les nouveaux chiffres, exactement ?

Par million de jetons : l'entrée passe de 5,00 à 4,00 dollars, l'entrée en cache de 0,50 à 0,40 dollar, et la sortie de 30,00 à 20,00 dollars. L'entrée et l'entrée en cache baissent toutes deux de 20 pour cent, la sortie de 33 pour cent. OpenAI a annoncé le changement le 21 août 2026, avec effet immédiat, et le décrit comme valable les trois prochains mois, ce qui place l'échéance au 21 novembre 2026. Le chiffre affiché de plus de 20 pour cent est la lecture prudente, puisque l'économie réelle sur votre facture dépend entièrement de la part de votre dépense située côté sortie.

De combien notre facture va-t-elle baisser ?

Entre 20 et 33 pour cent, et votre position dépend de votre rapport entrée sur sortie. Faites le calcul sur votre propre consommation plutôt que sur le titre. Une charge orientée recherche documentaire qui envoie dix fois plus d'entrée que de sortie économise environ 25 pour cent, car l'essentiel de la dépense se trouve du côté qui n'a baissé que d'un cinquième. Une charge de raisonnement ou de génération à peu près à parité économise environ 31 pour cent. Une boucle d'agent qui lit un vaste contexte et produit un court appel d'outil se situe en bas de la fourchette. Si vous disposez d'un mois de comptage de jetons, multipliez les jetons d'entrée par 4 et ceux de sortie par 20, par million, puis comparez à ce que vous avez payé.

Est-ce que cela concerne notre abonnement ChatGPT ?

Non. OpenAI a précisé que l'usage des abonnements Pro, Plus et Business restait inchangé. La baisse couvre l'interface de programmation et se déploie sur les plans de crédits éligibles pour ChatGPT Work et pour Codex. Autrement dit, c'est un prix destiné aux développeurs et aux plateformes, à ceux qui achètent des jetons au million, pas aux formules par siège. Si votre équipe paie au siège, rien ne bouge sur votre facture.

Que se passe-t-il le 21 novembre ?

OpenAI s'est engagé sur trois mois et n'a pas dit ce qui suivrait. Considérez les anciens prix comme ceux qui peuvent revenir, car un tarif promotionnel est une promesse assortie d'une échéance, pas un prix catalogue permanent. Dans les faits, le haut de gamme a été revu à la baisse plusieurs fois au cours de 2026, si bien qu'un retour brutal à 5 et 30 dollars serait inhabituel. Cela dit, si vous bâtissez un dossier économique ou un modèle de marge par client sur ces chiffres, inscrivez-y la date de retour et regardez à quoi ressemblent vos coûts unitaires à l'ancien tarif.

Comment cela se situe-t-il face aux autres modèles ?

À 4 et 20 dollars, Sol passe désormais sous Claude Opus 5, affiché à 5 dollars le million en entrée et 25 en sortie, des deux côtés du compteur. Claude Fable 5 se situe bien au-dessus des deux, à 10 et 50 dollars, ce qui traduit une position différente dans la gamme plutôt qu'une comparaison à périmètre égal. Le prix n'est pas le seul axe, et pour le code et le travail d'agent, les écarts de résultats et d'outillage comptent davantage que quelques dollars par million. Mais l'écart qui justifiait de choisir un palier sur le seul critère du coût s'est resserré en haut du marché.

Y a-t-il autre chose en parallèle ?

Oui. GitHub a annoncé de son côté une promotion distincte et plus forte, divisant par deux le prix de GPT-5.6 Sol à l'intérieur de GitHub Copilot jusqu'au 3 septembre 2026. Il s'agit d'une promotion de facturation Copilot et non d'un changement de tarif d'interface OpenAI : elle ne se cumule pas avec les tarifs d'interface et se termine bien plus tôt. Si vous évaluez les modèles dans Copilot plutôt que par l'interface de programmation, c'est la fenêtre à utiliser pour une comparaison côte à côte.