Outils développeurActualité

GPT-5.6 Sol à 4 $/20 $ : calculer l’économie réelle

Sur cette page
  1. Lire les tarifs actuels et leurs conditions
  2. Un exemple avec la taille des requêtes
  3. Isoler le contexte long et la facturation du cache
  4. Recalculer un usage avant de le modifier

OpenAI a baissé les prix de GPT-5.6 Sol le 21 août. Le tarif API standard actuel est de 4 $ par million de jetons d’entrée hors cache et 20 $ en sortie. L’économie totale dépend du mélange d’entrées et de sorties.

Calcul original pour 100 requêtes de 10 000 jetons d’entrée hors cache et 2 000 de sortie facturés chacune : 11 $ avant, 8 $ au tarif standard actuel de Sol, soit environ 27,3 % de moins.
Calcul original pour 100 requêtes de 10 000 jetons d’entrée hors cache et 2 000 de sortie facturés chacune : 11 $ avant, 8 $ au tarif standard actuel de Sol, soit environ 27,3 % de moins. Graphique : PeopleAreGeek. Source des données.
Agrandir l’image

Lire les tarifs actuels et leurs conditions

La fiche officielle du modèle indique 4 $ en entrée, 0,40 $ pour les lectures en cache et 20 $ en sortie par million de jetons. La promotion est annoncée au moins jusqu’au 21 novembre 2026. Cela n’annonce pas un retour automatique aux anciens prix le 22 novembre.

L’annonce du 21 août décrit une réduction de 20 % en entrée et 33 % en sortie, également déclinée dans d’autres modes de traitement. Elle concerne l’API et les crédits Work/Codex éligibles ; l’usage inclus dans les abonnements Pro, Plus et Business reste inchangé.

Un exemple avec la taille des requêtes

Supposons 100 requêtes distinctes, chacune avec 10 000 jetons d’entrée hors cache et 2 000 jetons de sortie facturés. Le total atteint un million de jetons en entrée et 200 000 en sortie. Aucune requête individuelle ne dépasse le seuil de contexte long.

Aux anciens tarifs standard de 5 $/30 $, l’entrée coûte 5 $ et la sortie 6 $, soit 11 $ au total. Avec 4 $/20 $, les mêmes volumes coûtent 4 $ + 4 $ = 8 $. L’économie vaut 3 $ ÷ 11 $, soit environ 27,3 %.

Cet exemple original calcule un coût en jetons ; ce n’est ni une facture de production mesurée ni une prédiction de qualité. Il suppose des volumes inchangés et exclut les frais distincts d’outils, de stockage et d’autres services. Si un nouveau fonctionnement produit davantage de sortie facturable, le prix unitaire réduit ne garantit pas la même baisse de facture.

Isoler le contexte long et la facturation du cache

La fiche indique qu’au-delà de 272 000 jetons d’entrée, les multiplicateurs sont 2× en entrée et 1,5× en sortie pour toute la requête. Les écritures du cache coûtent 1,25× le tarif d’entrée hors cache. Une requête unique d’un million de jetons ne peut donc pas remplacer celles de l’exemple en conservant ses tarifs.

Lectures et écritures du cache sont des événements de facturation distincts. Un texte répété ne suffit pas à classer tous les jetons d’entrée comme des lectures à prix réduit. Utilisez les catégories d’usage des requêtes réelles et les règles du mode de traitement choisi.

Recalculer un usage avant de le modifier

Pour comparer utilement, conservez un relevé daté du nombre de requêtes, des catégories d’entrée, de la sortie facturée et du mode de traitement. Appliquez d’abord les deux grilles au même usage. Les changements de comportement du modèle, les tentatives supplémentaires ou les modifications de l’application pourront être évalués séparément.

Le 21 novembre constitue une date utile pour vérifier la prolongation de l’offre. La source n’établit ni expiration obligatoire ni tarif ultérieur : tout montant retenu après la promotion dans un budget doit rester identifié comme un scénario.

Revue du 8 septembre : sources et évolutions vérifiées, explications et illustration reprises.