Opus 5 constitue le point de départ pour le travail courant ; Fable 5.1 mérite un essai sur les tâches qui résistent. Le cache change désormais la comparaison : Fable coûte plus cher en entrée nouvelle et en sortie, mais moins cher en lecture du cache.

Ce qui change dans ce comparatif
Cette page comparait initialement Fable 5 à Opus 4.8. Elle porte désormais sur Fable 5.1 et Opus 5, avec des informations vérifiées le 8 septembre 2026. La date de publication d'origine reste affichée : une révision ne doit pas se faire passer pour une nouvelle annonce.
La documentation de Fable conseille de commencer la plupart des tâches sur Opus 5, puis d'évaluer Fable 5.1 sur le raisonnement difficile et les agents qui travaillent longtemps. Les deux acceptent un contexte de 1 million de tokens et jusqu'à 128 000 tokens de sortie. Payer davantage n'agrandit donc pas la fenêtre de contexte.
| Modèle API | Identifiant | Point de départ |
|---|---|---|
| Opus 5 | claude-opus-5 | Établir une référence de qualité et de coût |
| Fable 5.1 | claude-fable-5-1 | Reprendre les cas difficiles et mesurer le gain |
L'annonce d'Opus 5 décrit des progrès par rapport à Opus 4.8. Ce sont des évaluations de l'éditeur, pas des essais réalisés par PeopleAreGeek. Les anciens scores Fable 5 contre Opus 4.8 ne permettent pas de départager les modèles actuels sur votre dépôt.
Le cache change la facture
Tarifs standards de l'API Claude en dollars américains par million de tokens, hors taxes, majorations des plateformes et services optionnels. Source : tarification Anthropic.
| Catégorie de tokens | Fable 5.1 | Opus 5 |
|---|---|---|
| Entrée sans cache | 10 $ | 5 $ |
| Écriture du cache, 5 minutes | 12,50 $ | 6,25 $ |
| Écriture du cache, 1 heure | 20 $ | 10 $ |
| Lecture du cache | 0,25 $ | 0,50 $ |
| Sortie | 50 $ | 25 $ |
Dire que Fable coûte « deux fois plus cher » est juste pour l'entrée nouvelle et la sortie, pas pour toutes les catégories de tokens. Voici deux exemples volontairement simples, à volumes identiques pour les deux modèles. Ils isolent la facturation et ne prédisent pas leur consommation réelle.
- Sans cache : 1 million de tokens d'entrée et 100 000 de sortie coûtent 15 $ avec Fable et 7,50 $ avec Opus.
- Contexte réutilisé : 1 million de tokens écrits une fois dans un cache de cinq minutes, 30 millions lus depuis ce cache et 100 000 de sortie coûtent 25 $ avec Fable et 23,75 $ avec Opus. Les lectures doivent avoir lieu pendant la validité du cache ; une nouvelle écriture modifie le calcul.
Le second exemple donne 12,50 + 30 × 0,25 + 0,1 × 50, contre 6,25 + 30 × 0,50 + 0,1 × 25. Il ne suppose ni que Fable consomme moins de tokens, ni qu'il évite un échec, ni qu'il économise une heure de travail humain. Ces gains éventuels demandent des mesures.
La distinction compte pour un agent de code qui renvoie régulièrement le même contexte de dépôt. Elle pèse moins pour une demande courte et isolée. Comptez aussi les tentatives ratées et les écritures de cache, pas seulement la dernière réponse réussie. Notre explication du prompt caching détaille ces catégories.
Vérifier l'intégration avant de changer de modèle
Le guide de migration Fable 5.1 signale des incompatibilités au-delà du nom du modèle. Forcer l'appel d'un outil avec any ou tool est refusé. Le raisonnement adaptatif de Fable reste actif ; le désactiver n'est pas pris en charge. Les blocs de raisonnement conservés dépendent aussi du modèle et de l'historique : testez une session neuve et une conversation existante.
L'ancienne affirmation selon laquelle toute demande sensible devient automatiquement une réponse Opus ne doit pas être conservée. La documentation des refus et modèles de secours décrit la gestion explicite des refus et une configuration de repli optionnelle. Pour comparer les réponses et les coûts, journalisez le modèle qui a effectivement répondu.
Une comparaison reproductible sur votre travail
Choisissez dix tâches représentatives avant de lancer les modèles : petites corrections, refonte plus large, portion de code inconnue, documentation et tâche nécessitant plusieurs outils. Conservez les mêmes fichiers de départ et consignes. Définissez les critères de réussite avant de lire les réponses.
Relevez l'identifiant du modèle, l'effort, la durée, les catégories de tokens, les frais d'outils, les vérifications réussies et les corrections manuelles. Répétez les cas difficiles : une réussite isolée prouve peu de choses. Gardez les mêmes outils et conditions d'arrêt, puis faites une seconde passe avec des réglages ajustés séparément pour chaque modèle.
Un indicateur utile est le coût total par résultat accepté, en suivant séparément le temps de relecture. Si Opus satisfait régulièrement vos critères, gardez-le pour cette tâche. Si Fable récupère suffisamment d'échecs pour justifier son surcoût mesuré, réservez-le à ces cas. Un meilleur score de benchmark ne tranche pas à lui seul cet arbitrage.
Comparatif repris pour Fable 5.1 et Opus 5 à partir de la documentation officielle actuelle. Anciennes impressions de lancement et comparaisons de benchmarks retirées. Les coûts sont des calculs, pas des mesures de performance.