Ce qui se passe
Anthropic publie Claude Fable 5.1 et Claude Mythos 5.1. C'est le même modèle sous deux régimes de garde-fous : Fable 5.1 est disponible pour tous, Mythos 5.1 seulement via des programmes d'accès vérifiés, avec des protections taillées pour la cybersécurité et les sciences du vivant.
L'identifiant API est claude-fable-5-1, disponible immédiatement sur l'API
Claude, AWS, Google Cloud et Azure.
Le prix, avant les scores
Le changement le plus actionnable est tarifaire, et il est ciblé :
| Poste | Fable 5 | Fable 5.1 |
|---|---|---|
| Lecture de cache | 1,00 $/M | 0,25 $/M (-75 %) |
| Entrée | 10 $/M | 10 $/M |
| Sortie | 50 $/M | 50 $/M |
Anthropic annonce -25 % sur une charge typique et jusqu'à -45 % sur du travail fortement agentique, mesuré sur quatre semaines d'usage réel en août 2026 à effort par défaut. La logique est simple : dans une boucle d'agent, le contexte déjà traité est relu à chaque tour, et cette relecture finit par dominer la facture. Baisser le prix du cache, c'est baisser le prix des agents.
Le niveau d'effort joue le même rôle : à effort Low ou Medium, Fable 5.1 atteint des résultats comparables ou supérieurs à Fable 5, pour bien moins cher. Par défaut, l'effort est High dans Claude Code et Medium dans Claude Cowork et sur claude.ai.
Les capacités
| Banc d'essai | Fable 5.1 | Fable 5 | Opus 5 |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6 % | 24,7 % | 29,0 % |
| Terminal-Bench 4.0 | 55,8 % | 42,0 % | 52,3 % |
| OSWorld 2.0 (strict) | 41,7 % | 36,1 % | 39,6 % |
| AutomationBench | 31,4 % | 17,1 % | 26,9 % |
| CursorBench 3.2.0 | 73,4 % | 70,5 % | 70,0 % |
Mythos 5.1 monte à 60,9 % sur Terminal-Bench 4.0. L'écart le plus net est sur Terminal-Bench-Science, qui double. À noter : les modèles ont été évalués garde-fous de production actifs, et les tâches où ceux-ci sont intervenus comptent zéro — ce qui tire les scores vers le bas plutôt que l'inverse.
Le changement qui casse quelque chose
C'est le point à vérifier avant de basculer. Les comptes API créés à partir d'aujourd'hui ne peuvent plus modifier le contexte antérieur d'une conversation multi-tours tout en préservant la transcription du raisonnement. La mesure vise une technique de distillation publiquement documentée. Elle est appliquée progressivement : les comptes existants ne sont pas encore affectés, mais le seront.
Si votre outillage réécrit l'historique entre deux tours — pour élaguer, résumer ou réinjecter du contexte — il rencontrera une erreur signalant qu'un bloc est lié à une autre conversation.
À retenir
claude-fable-5-1: cache reads à 0,25 $/M, entrée et sortie inchangées.- Le gain dépend de votre profil d'usage : maximal sur les tâches longues et outillées, minimal sur les appels ponctuels sans cache.
- Tester la réécriture de contexte avec thinking préservé avant de créer un nouveau compte API.
Source : Anthropic