Le 1er septembre 2026, Anthropic a publié Claude Fable 5.1 dans les notes officielles de la version de la plateforme Claude, le positionnant comme une programmation d’agents de longue durée, travail de connaissance et recherche, avec le modèle identifié comme claude-fable-5-1. Le même jour, Claude Mythos 5.1 n’était disponible que pour les participants du Projet Glasswing et ne doit pas être confondu avec Fable 5.1 accessible au public.
L’accent mis à niveau ne porte pas seulement sur le contexte du million de jetons
Fable 5.1 fournit un contexte par défaut de 1 million de jetons, jusqu’à 128 000 sorties de jetons, et une pensée adaptative activée en continu. Elle a été introduite dans Claude API, Amazon Bedrock, Claude Platform sur AWS, Google Cloud et Microsoft Foundry, adaptée aux équipes qui croisent de gros fichiers, utilisent des outils pendant de longues périodes ou maintiennent des états de tâche.
Un contexte plus long ne signifie pas que vous pouvez empiler les données à l’infini. Le tri des entrées, le découpage de retour d’outils, la compression historique et l’isolement des permissions déterminent toujours si les tâches longues sont stables. Les projets existants peuvent d’abord utiliser l’explication du coût de mise en cache contextuelle du site pour estimer les entrées dupliquées puis décider quel contenu mérite d’être conservé à long terme.
Lors de la migration, vérifiez d’abord trois points de compatibilité
- tool_choice any et ne sont pas pris en charge sur Fable 5.1 et Mythos 5.1, et les requêtes rendent 400 ; le code existant doit être basculé en automatique ou aucun, ou bien des appels stricts d’outils et une sortie structurée doivent garantir que les paramètres respectent le schéma.
- Le bloc de réflexion ne peut pas se rejouer arbitrairement entre les anciens modèles. Pour les nouveaux comptes créés à partir du 31 août 2026, si des invites système, des listes d’outils ou des messages antérieurs ont été modifiés avant la lecture, l’interface peut également afficher des erreurs.
- Les ajustements de messages basés sur l’effort, les messages système à tour unique et les mises à jour de progression sont encore en bêta et nécessitent des en-têtes de requête bêta correspondants. Vous ne pouvez pas supposer que tous les canaux cloud, SDK et comptes sont pris en charge de manière synchrone.
Ces changements sont plus susceptibles de provoquer de vraies défaillances que de remplacer les noms de modèles. Claude Code ou des agents de programmation personnalisés encapsulent souvent la sélection d’outils et la relecture historique dans le cadre ; les journaux de requêtes et la gestion des erreurs doivent être vérifiés avant la migration. Lorsque le contexte s’élargit soudainement, référez-vous à la méthode de dépannage contextuel de Claude Code.
Les coûts n’ont pas augmenté, mais les prix de lecture de cache ont fortement chuté
Les prix d’entrée et de sortie de Fable 5.1 restent à 10 et 50 dollars par million de jetons, identiques à ceux de Fable 5 ; La lecture du cache des prompts tombe à 0,25 $ par million de jetons, avec des prix d’écriture inchangés. Les préfixes stables et les données dupliquées valent plus la peine d’être mis en cache, mais ce n’est que lorsque le taux de réussite est suffisamment élevé que de réelles économies peuvent être réalisées.
Une autre limite est la conservation des données sur 30 jours : sauf autorisation explicite d’Anthropic, Fable 5.1 ne garantit pas une rétention nulle des données. Les équipes doivent d’abord effectuer des tests de régression avec des tâches représentatives longues, confirmer que les appels d’outils, les impacts de cache, les lectures de blocs de réflexion et les exigences en données passent tous, puis augmenter progressivement le trafic.