Anthropic a publié Claude Fable 5.1 le 1er septembre 2026, et le prix qui a bougé est celui que presque personne ne regarde. L'entrée reste à dix dollars le million de jetons et la sortie à cinquante. Le tarif de lecture de cache tombe d'un dollar à vingt cinq cents, une baisse de soixante quinze pour cent, ce qui veut dire que votre facture réelle dépend désormais de la part de contexte que vous arrivez à garder en cache entre deux appels. Anthropic évalue l'effet à environ vingt cinq pour cent d'économie sur un usage courant et près de quarante cinq pour cent sur les boucles d'agents. Nous avons regardé d'où vient ce gain et comment restructurer un prompt pour l'encaisser.
The short answer
Anthropic a publié Claude Fable 5.1 et Claude Mythos 5.1 le 1er septembre 2026. Il s'agit du même modèle derrière deux réglages de garde-fous, Fable 5.1 étant disponible pour tous et Mythos 5.1 réservé à des programmes d'accès vérifiés. Les prix d'entrée et de sortie ne changent pas, dix et cinquante dollars le million de jetons, mais la lecture de cache tombe d'un dollar à vingt cinq cents, ce qui représente selon Anthropic environ vingt cinq pour cent de coût en moins sur un usage courant et près de quarante cinq pour cent sur les boucles d'agents. Les tests progressent sur toute la série publiée, notamment Terminal-Bench 4.0 à 55,8 pour cent et Terminal-Bench-Science 0.1 à 52,6 pour cent. L'identifiant d'API est claude-fable-5-1.
La plupart des lancements de modèles vous invitent à comparer deux chiffres et à choisir. Celui-ci non, puisque les deux chiffres en question sont identiques à ceux de la version précédente. Claude Fable 5.1 coûte dix dollars le million de jetons en entrée et cinquante en sortie, exactement le tarif de Fable 5. Si vous vous arrêtez là sur la page de tarification, vous concluez que rien n'a changé.
Le seul chiffre qui bouge est celui que vous maîtrisez
Anthropic a réduit le tarif de lecture de cache d'un dollar à vingt cinq cents le million de jetons. Une lecture de cache, c'est un jeton d'entrée que le modèle a déjà traité et stocké lors d'un appel antérieur de la même conversation ou de la même exécution d'agent. Dans une session longue, cela représente l'essentiel de ce que vous envoyez. Le prompt système, les définitions d'outils, les documents récupérés, chaque tour précédent : tout repasse sur le fil à chaque requête, et tout peut être servi depuis le cache.
C'est pourquoi une seule baisse de prix produit deux économies très différentes. Anthropic l'évalue à environ vingt cinq pour cent sur un usage courant et près de quarante cinq pour cent sur du travail très agentique. L'écart entre ces deux chiffres n'est pas une question d'arrondi, c'est le taux de succès du cache. Un appel de classification unique avec un prompt court ne réutilise presque rien et n'y gagne quasiment rien. Un agent qui enchaîne quarante appels d'outils sur le même contexte de dépôt réutilise presque tout et encaisse la remise entière.
Les écritures de cache restent plus chères que l'entrée simple, à douze dollars cinquante le million pour la durée de vie de cinq minutes et vingt dollars pour la variante d'une heure. C'est la partie à modéliser avant de se réjouir. La mise en cache est un pari : celui de relire un préfixe assez souvent pour amortir son écriture. Le nouveau tarif de lecture déplace nettement le point d'équilibre en votre faveur. À vingt cinq cents la lecture, une écriture de cache de cinq minutes se rentabilise plus vite qu'avant, et une longue session d'agent l'amortit plusieurs fois.
Des gains larges plutôt qu'un pic isolé
Anthropic annonce des progrès sur l'ensemble de sa série publiée. Terminal-Bench 4.0 passe de 42,0 pour cent avec Fable 5 à 55,8 pour cent, Mythos 5.1 atteignant 60,9 pour cent. Terminal-Bench-Science 0.1 fait plus que doubler, de 24,7 à 52,6 pour cent. AutomationBench passe quasiment du simple au double, de 17,1 à 31,4 pour cent. CursorBench 3.2.0 monte de 70,5 à 73,4 pour cent et GDPval-AA v2 de 1723 à 1853. Sur OSWorld 2.0, le score strict passe de 36,1 à 41,7 pour cent.
Ce sont des chiffres d'éditeur, et la lecture honnête d'un tableau de tests maison est qu'il vous dit ce que le laboratoire a optimisé. Le signal le plus intéressant se trouve dans les retours clients publiés à côté, parce qu'ils décrivent des formes de travail plutôt que des scores. Browserbase indique que le modèle a terminé 82 pour cent de son jeu de tâches le plus difficile, contre 74 pour cent pour Opus 5 et 57 pour cent pour Fable 5. MongoDB décrit des exécutions non surveillées de plusieurs heures avec boucles de vérification. Datadog cite le diagnostic d'incidents en production. Tout cela pointe la même propriété, des exécutions autonomes longues qui tiennent la distance, c'est-à-dire exactement la charge que vise la baisse du prix du cache.
Les niveaux d'effort deviennent un vrai levier de dépense
Fable 5.1 expose cinq réglages d'effort, bas, moyen, haut, très haut et maximum, avec le niveau haut par défaut dans Claude Code. Anthropic affirme que le modèle égale ou dépasse Fable 5 aux niveaux bas et moyen, et se détache davantage aux niveaux supérieurs.
C'est la moitié sous-estimée de cette version. L'effort gouverne surtout les jetons de sortie, et la sortie est le côté cher du compteur à cinquante dollars le million. Si une tâche exigeait auparavant Fable 5 à plein régime, il y a de bonnes chances qu'elle passe désormais au niveau moyen, lequel coûte moins par tentative et répond plus vite. La bonne réaction à cette sortie n'est pas de tout basculer au maximum sous prétexte que le modèle s'est amélioré, mais de rejouer votre jeu d'évaluation à chaque niveau et de retenir le plus bas qui passe encore. C'est la même discipline qui rendait Opus 5 intéressant à la moitié du prix de Fable 5.
Ce qu'il faut vérifier avant de changer la chaîne du modèle
L'identifiant est claude-fable-5-1, et la disponibilité couvre l'API Claude, Claude.ai, Claude Code, Claude Enterprise et Claude Cowork, ainsi qu'Amazon Bedrock et la plateforme Claude sur AWS, Google Agent Platform et Microsoft Foundry. Remplacer la chaîne est un petit changement. Les deux choses à faire d'abord le sont moins.
Auditez le préfixe de vos prompts. La mise en cache repose sur une correspondance exacte de préfixe : la remise n'arrive que si la partie réutilisée de votre prompt est identique octet pour octet entre deux appels. Un horodatage dans le prompt système, un identifiant de requête injecté en tête, ou une liste d'outils sérialisée dans un ordre non déterministe invalident silencieusement le cache à chaque requête. Vous obtenez quand même une réponse, vous la payez simplement au plein tarif d'entrée, et rien dans la réponse ne vous signale ce qui s'est passé. Journalisez vos jetons servis depuis le cache et observez le ratio pendant une journée avant de conclure que l'économie est bien là.
Refaites la ligne de base de votre niveau d'effort. Une lecture de cache moins chère et un modèle plus solide en effort bas signifient que votre configuration actuelle n'est probablement plus l'optimum de coût. Anthropic indique aussi que ses garde-fous produisent beaucoup moins de faux positifs sur les demandes techniques légitimes que la génération précédente, ce qui compte surtout si vous aviez bâti une logique de réessai autour des refus sur du travail parfaitement normal.
Côté données, Anthropic a annoncé Enterprise Frontier Safeguards, un dispositif qui stocke les données de supervision dans l'environnement AWS, Azure ou Google Cloud du client, sous ses propres clés de chiffrement, plutôt que dans l'infrastructure d'Anthropic. Il n'y a pas de facturation séparée, même si vous payez votre propre hébergeur pour le stockage, les opérations et la sortie réseau. Le déploiement arrive par phases à partir de l'automne 2026, et jusque-là les clients éligibles de Fable 5.1 et Fable 5 peuvent travailler en rétention zéro. Pour les équipes dont la revue achats bloquait sur la formulation de la rétention, c'est le paragraphe à transmettre, et il complète le filigrane qu'Anthropic applique désormais aux sorties de Claude pour qui suit la surface de conformité.
Sources et pour aller plus loin
- Introducing Claude Fable 5.1 and Claude Mythos 5.1, Anthropic, 1er septembre 2026
- Anthropic's new Fable release is cheaper, less restrictive, TechCrunch, 1er septembre 2026
- Anthropic's Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache reads, VentureBeat, 1er septembre 2026
- Anthropic Launches Claude Fable 5.1 With Lower Costs and Fewer False Positives, MacRumors, 1er septembre 2026
Questions fréquentes
Qu'est-ce qui a changé exactement dans le prix de Claude Fable 5.1 ?
Uniquement le tarif de lecture de cache. L'entrée reste à dix dollars le million de jetons et la sortie à cinquante, comme pour Fable 5. Une lecture de cache, c'est-à-dire un jeton déjà traité et stocké lors d'un appel précédent, passe d'un dollar à vingt cinq cents le million. Les écritures de cache coûtent douze dollars cinquante pour la durée de vie de cinq minutes et vingt dollars pour la variante d'une heure. Le traitement par lots divise par deux l'entrée et la sortie, à cinq et vingt cinq. Anthropic estime l'effet net à environ vingt cinq pour cent de moins sur un usage courant et près de quarante cinq pour cent sur du travail très agentique, où le même contexte long est rejoué à chaque tour.
Comment obtenir concrètement cette remise ?
En rendant stable la partie réutilisée de votre prompt et en la plaçant en premier. La mise en cache s'appuie sur une correspondance exacte de préfixe : tout ce qui change entre deux appels doit donc se situer après tout ce qui ne change pas. En pratique, les instructions système, les définitions d'outils, les documents récupérés et les tours précédents vont en tête dans un ordre fixe, et le nouveau message utilisateur va en fin. Les équipes qui glissent un horodatage, un identifiant de requête ou une liste d'outils sérialisée dans un ordre aléatoire en tête paient le plein tarif d'entrée à chaque appel sans jamais s'en apercevoir, car la facture ne dit pas quels jetons ont manqué le cache.
Fable 5.1 est-il vraiment meilleur, ou seulement moins cher ?
Anthropic annonce des gains sur l'ensemble des tests publiés. Terminal-Bench 4.0 passe de 42,0 pour cent avec Fable 5 à 55,8 pour cent avec Fable 5.1, contre 52,3 pour cent pour Opus 5 et 37,3 pour cent pour GPT-5.6 Sol. Terminal-Bench-Science 0.1 fait plus que doubler, de 24,7 à 52,6 pour cent. CursorBench 3.2.0 monte de 70,5 à 73,4 pour cent, AutomationBench de 17,1 à 31,4 pour cent, et GDPval-AA v2 de 1723 à 1853. Ce sont des chiffres publiés par l'éditeur : traitez-les comme une tendance et non comme une mesure indépendante, et faites tourner votre propre évaluation avant de basculer du trafic de production.
Que sont les niveaux d'effort et pourquoi comptent-ils maintenant ?
Fable 5.1 expose cinq réglages d'effort : bas, moyen, haut, très haut et maximum, avec le niveau haut par défaut dans Claude Code. Anthropic affirme que le modèle égale ou dépasse Fable 5 aux niveaux bas et moyen, et creuse l'écart aux niveaux supérieurs. Cela transforme l'effort en véritable levier de coût plutôt qu'en curseur de qualité que l'on pousse toujours au maximum. Si une tâche exigeait Fable 5 à plein régime, il y a de bonnes chances qu'elle passe désormais au niveau moyen, et le niveau moyen consomme moins de jetons de sortie, c'est-à-dire le côté cher du compteur à cinquante dollars le million.
Où l'exécuter et qu'advient-il de mes données ?
L'identifiant d'API est claude-fable-5-1, disponible via l'API Claude, Claude.ai, Claude Code, Claude Enterprise et Claude Cowork, ainsi que sur Amazon Bedrock, Google Agent Platform et Microsoft Foundry. Côté rétention, Anthropic a annoncé Enterprise Frontier Safeguards, qui conserve les données de supervision dans le compte AWS, Azure ou Google Cloud du client, sous ses propres clés de chiffrement, sans facturation séparée au-delà du stockage et de la sortie réseau que vous payez déjà à votre hébergeur. Le déploiement se fait par phases à partir de l'automne 2026, et les clients éligibles de Fable 5.1 et Fable 5 peuvent utiliser la rétention zéro en attendant.