veilletech.fr
2 sept. Feed du jour
#04 IA Article

Fable 5.1 : le cache lu à moins 75 %

La baisse est sur le cache. C'est là que passe l'agent.

Claude Fable 5.1 et Mythos 5.1 sortent : même modèle, garde-fous différents. Les lectures de cache baissent de 75 % (0,25 $/M tokens), soit environ -25 % sur une charge typique et jusqu'à -45 % en agentique. Un changement d'API accompagne la sortie et casse la réécriture de contexte avec thinking préservé.

3 min de lectureintermédiairevidéo 1:19
Partager
Sommaire5 sections
  1. Ce qui se passe
  2. Le prix, avant les scores
  3. Les capacités
  4. Le changement qui casse quelque chose
  5. À retenir

Ce qui se passe

Anthropic publie Claude Fable 5.1 et Claude Mythos 5.1. C'est le même modèle sous deux régimes de garde-fous : Fable 5.1 est disponible pour tous, Mythos 5.1 seulement via des programmes d'accès vérifiés, avec des protections taillées pour la cybersécurité et les sciences du vivant.

L'identifiant API est claude-fable-5-1, disponible immédiatement sur l'API Claude, AWS, Google Cloud et Azure.

Le prix, avant les scores

Le changement le plus actionnable est tarifaire, et il est ciblé :

Poste Fable 5 Fable 5.1
Lecture de cache 1,00 $/M 0,25 $/M (-75 %)
Entrée 10 $/M 10 $/M
Sortie 50 $/M 50 $/M

Anthropic annonce -25 % sur une charge typique et jusqu'à -45 % sur du travail fortement agentique, mesuré sur quatre semaines d'usage réel en août 2026 à effort par défaut. La logique est simple : dans une boucle d'agent, le contexte déjà traité est relu à chaque tour, et cette relecture finit par dominer la facture. Baisser le prix du cache, c'est baisser le prix des agents.

Le niveau d'effort joue le même rôle : à effort Low ou Medium, Fable 5.1 atteint des résultats comparables ou supérieurs à Fable 5, pour bien moins cher. Par défaut, l'effort est High dans Claude Code et Medium dans Claude Cowork et sur claude.ai.

Les capacités

Banc d'essai Fable 5.1 Fable 5 Opus 5
Terminal-Bench-Science 0.1 52,6 % 24,7 % 29,0 %
Terminal-Bench 4.0 55,8 % 42,0 % 52,3 %
OSWorld 2.0 (strict) 41,7 % 36,1 % 39,6 %
AutomationBench 31,4 % 17,1 % 26,9 %
CursorBench 3.2.0 73,4 % 70,5 % 70,0 %

Mythos 5.1 monte à 60,9 % sur Terminal-Bench 4.0. L'écart le plus net est sur Terminal-Bench-Science, qui double. À noter : les modèles ont été évalués garde-fous de production actifs, et les tâches où ceux-ci sont intervenus comptent zéro — ce qui tire les scores vers le bas plutôt que l'inverse.

Le changement qui casse quelque chose

C'est le point à vérifier avant de basculer. Les comptes API créés à partir d'aujourd'hui ne peuvent plus modifier le contexte antérieur d'une conversation multi-tours tout en préservant la transcription du raisonnement. La mesure vise une technique de distillation publiquement documentée. Elle est appliquée progressivement : les comptes existants ne sont pas encore affectés, mais le seront.

Si votre outillage réécrit l'historique entre deux tours — pour élaguer, résumer ou réinjecter du contexte — il rencontrera une erreur signalant qu'un bloc est lié à une autre conversation.

À retenir

  1. claude-fable-5-1 : cache reads à 0,25 $/M, entrée et sortie inchangées.
  2. Le gain dépend de votre profil d'usage : maximal sur les tâches longues et outillées, minimal sur les appels ponctuels sans cache.
  3. Tester la réécriture de contexte avec thinking préservé avant de créer un nouveau compte API.

Source : Anthropic