Anthropic a présenté Claude Fable 5.1 et Claude Mythos 5.1, deux versions du même modèle orientées vers la programmation, les agents, le travail professionnel et la recherche scientifique. La différence réside dans leurs contrôles de sécurité. Fable 5.1 est accessible au grand public, tandis que Mythos 5.1 est initialement réservé aux professionnels vérifiés en cybersécurité et sciences de la vie.

Les points clés de Claude Fable 5.1 en 30 secondes

  • Fable 5.1 excelle particulièrement en programmation orientée agents, recherche scientifique, automatisation et utilisation de l’ordinateur.
  • Anthropic estime un coût inférieur de 25 % pour les charges courantes et jusqu’à 45 % pour des processus intensifs en contexte et en outils.
  • Les lectures en cache diminuent de 75 %, passant à 0,25 dollars par million de tokens.
  • Mythos 5.1 partage le même modèle que Fable, mais propose des contrôles différents pour les professionnels vérifiés.
  • Fable 5.1 permet de rechercher des vulnérabilités logicielles, tout en maintenant des restrictions sur la génération d’exploits et autres activités à double usage.

Ce lancement dévoile également la direction dans laquelle la concurrence entre modèles avancés semble évoluer. La performance ne se limite plus uniquement à répondre correctement à une question ou à générer du code lors d’un test. Anthropic met désormais l’accent sur des tâches prolongées, l’utilisation d’outils, la recherche, l’interaction avec des ordinateurs, et notamment sur le coût de maintien d’un agent actif sur de longues périodes.

Ce dernier point explique un des changements apparemment mineurs de Fable 5.1 qui pourrait avoir un impact significatif en production : la réduction du prix de la mémoire cache.

Fable 5.1 est particulièrement performant lorsque l’IA doit travailler sur une longue durée

Anthropic présente Fable 5.1 comme une évolution majeure par rapport à Fable 5, avec des résultats validés par divers tests.

Dans Terminal-Bench-Science 0.1, destiné à évaluer la recherche scientifique via agents, Fable 5.1 atteint un score de 52,6 %, contre 24,7 % pour Fable 5. Dans les tests réalisés par Anthropic, Opus 5 obtient 29,0 % et GPT-5.6 Sol, 22,4 %.

En programmation orientée agents via Terminal-Bench 4.0, Fable 5.1 obtient 55,8 %. Mythos 5.1 atteint 60,9 %, tandis que Fable 5 affiche 42,0 % et Opus 5, 52,3 %.

Les écarts sont plus restreints sur d’autres tests, mais restent importants et témoignent d’améliorations par rapport à la génération précédente.

Benchmark Fable 5.1 Fable 5 Opus 5 GPT-5.6 Sol
Terminal-Bench-Science 0.1 52,6 % 24,7 % 29,0 % 22,4 %
Terminal-Bench 4.0 55,8 %* 42,0 % 52,3 % 37,3 %
AutomationBench 31,4 % 17,1 % 26,9 % 19,6 %
CursorBench 3.2.0 73,4 % 70,5 % 70,0 % 67,2 %

* Mythos 5.1 atteint 60,9 % dans Terminal-Bench 4.0.

Les résultats proviennent des évaluations publiées par Anthropic et doivent être interprétés en tenant compte des configurations et méthodologies précisées par l’entreprise. Tous les modèles n’ont pas été évalués dans l’ensemble des tests.

Ce qui est potentiellement le plus intéressant, ce n’est pas uniquement la différence de points, mais l’attitude du modèle lors de processus prolongés.

Les agents programmatiques actuels peuvent ouvrir des fichiers, modifier du code, effectuer des tests, consulter la documentation et revenir sur leurs propres modifications. Plus le processus se prolonge, plus il devient probable que le modèle perde le fil du problème, prenne une mauvaise direction ou applique une solution superficielle.

Anthropic affirme que Fable 5.1 possède une meilleure capacité à rechercher la cause initiale d’un problème. Par exemple, il cite Millennium, où le modèle aurait identifié l’origine d’un dysfonctionnement peu fréquent de ses systèmes internes, résolu depuis plusieurs années, sans explication claire préalable.

Il s’agit d’un cas fourni par un client en accès anticipé, et non d’un benchmark indépendant, mais qui illustre bien le type de problème pour lequel ces modèles sont conçus.

La mémoire cache, un atout économique croissant pour les agents

Fable 5.1 maintient le prix initial de Fable 5 : 10 dollars par million de tokens en entrée et 50 dollars par million en sortie.

Ce qui change, c’est la réutilisation du contexte précédent.

Anthropic réduit de 75 % le coût des lectures en cache, qui passent à 0,25 dollars par million de tokens.

Cela peut paraître une modification mineure par rapport au prix d’entrée et de sortie, mais les agents réutilisent de grandes quantités d’informations.

Un agent de développement peut conserver dans le contexte des fichiers de dépôt, de la documentation, des instructions, des résultats antérieurs, des conversations et des réponses d’outils. Si ce contenu doit être consulté à plusieurs reprises sur plusieurs étapes, le coût total peut varier considérablement en fonction du prix de la mémoire cache réduite.

D’après quatre semaines d’utilisation observées par Anthropic en août 2026, Fable 5.1 serait environ 25 % moins coûteux que Fable 5 pour une charge typique.

Dans des charges très orientées agents, intensives en contexte et en outils, la réduction pourrait atteindre près de 45 %.

Cela ne signifie pas que l’utilisation de Fable 5.1 coûtera automatiquement 45 % de moins. L’économie dépendra de la quantité de contexte réutilisable et de la répartition entre tokens d’entrée, de sortie et de cache.

Mais cela souligne une question de plus en plus cruciale : pour évaluer économiquement un modèle utilisé comme agent, il ne suffit plus de regarder le prix nominal par million de tokens.

Fable peut détecter des vulnérabilités ; Mythos élargit l’accès défensif

La cybersécurité constitue une autre différence majeure de cette génération.

Anthropic autorise désormais l’utilisation de Claude Fable 5.1 pour identifier des vulnérabilités logicielles, élargissant ainsi les tâches défensives réalisables sans activer les contrôles du système.

La société affirme avoir renforcé ses mesures de sécurité, et estime que les utilisateurs de Claude Code constateront environ 60 % de visites en moins en matière de sécurité par session comparé aux protections antérieures de Fable.

Ce n’est pas une suppression totale des restrictions.

Certaines activités à double usage, telles que la génération d’exploits, certains tests d’intrusion ou analyses de vulnérabilités sur des binaires, restent soumis à des contrôles additionnels.

Pour des travaux nécessitant plus de liberté, il existe Claude Mythos 5.1.

Anthropic précise que Fable 5.1 et Mythos 5.1 sont le même modèle, mais que Mythos utilise des mesures de sécurité adaptées aux professionnels précédemment vérifiés.

L’accès à Mythos se fait via le Cyber Verification Program et le Life Sciences Verification Program. Initialement, Mythos 5.1 est disponible pour un nombre restreint d’organisations américaines, avec l’ambition d’étendre le programme par la suite.

Claude Security, l’outil de la société qui analyse des dépôts pour repérer les vulnérabilités et propose des correctifs soumis à relecture humaine, utilise désormais Mythos 5.1.

Ce distinguo entre capacité technique et permissions d’utilisation pourrait devenir une caractéristique fréquente des modèles avancés. Un même modèle pourrait ainsi offrir des comportements différents selon l’identité et l’objectif de l’utilisateur, notamment dans des domaines à double usage.

Anthropic vise à étendre l’utilisation des agents à la recherche scientifique

L’une des autres dimensions majeures de cette annonce concerne la science.

Anthropic a testé Fable 5.1 et Mythos 5.1 en conception moléculaire, analyse scientifique et optimisation de modèles en biologie computationnelle.

Dans l’un des expérimentations, Mythos 5.1 a généré des designs de molécules de liaison, validés par des tests expérimentaux externes. Anthropic affirme qu’à trois objectifs, ces designs ont atteint des affinités dix fois supérieures à ce qui avait été obtenu lors de compétitions d’Adaptyv Bio, avec un taux de designs exploitables approchant les 50 % sur 12 cibles.

Dans un autre cas, Fable 5.1 a entraîné un réseau de neurones chargé de construire une carte d’altitude d’un tiers de Vénus à partir d’images radar de la mission Magellan de la NASA, il y a plus de trente ans.

La résolution de cette carte atteint, selon Anthropic, des détails allant de deux à trois kilomètres, contre 10-20 km pour les travaux antérieurs, avec une amélioration de jusqu’à 25 % de la précision des altitudes.

Mythos 5.1 a également généré des kernels personnalisés pour GPU et mis en œuvre des techniques de cache pour accélérer sept modèles de deep learning en génomique et protéines. Les gains publiés oscillent entre 1,4 et 2,5 fois sur une NVIDIA H100.

Anthropic estime que ces optimisations pourraient réduire de 30 à 60 % le coût en GPU pour certains analyses.

Il s’agit d’expériences ciblées et sélectionnées par la société, mais elles montrent que l’objectif de ces modèles dépasse la simple conversation : il s’agit d’intervenir sur des problèmes complexes, en utilisant des logiciels spécialisés, produisant des résultats et maintenant des processus de travail de plus en plus longs.

Confidentialité d’entreprise et une marque invisible pour le contenu

Anthropic introduit également Enterprise Frontier Safeguards (EFS), un système conçu pour combiner contrôles contre les abus avec des exigences de confidentialité pour l’entreprise.

Avec EFS, les données seront stockées dans une infrastructure cloud contrôlée par le client, et non chez Anthropic. La société compare ce niveau de confidentialité à un accord de rétention zéro.

Son déploiement débutera par phases cet automne. Anthropic indique avoir travaillé avec plus de 100 clients et prévoit d’étendre cette solution sur Claude Code, Claude Enterprise, Claude Platform, ainsi que sur plusieurs plateformes cloud.

Fable 5.1 intègre également une capacité peu courante : une marque d’eau invisible dans le contenu généré.

Anthropic lie cette mesure à ses engagements dans le cadre du Code de bonnes pratiques sur la transparence du contenu généré par IA, en accord avec le Règlement européen sur l’intelligence artificielle.

Cette marque n’est pas visible visuellement dans le document. Elle permet à une API d’estimer si Claude a participé à la création du contenu, sans divulguer d’informations sur l’utilisateur, l’organisation ou les conversations.

L’API de détection, actuellement en preview privée pour certains organismes, notamment régulateurs, médias, vérificateurs, chercheurs et autres entités, vise à vérifier cette origine.

Fable 5.1 est accessible via les plateformes d’Anthropic et sous la forme claude-fable-5-1 dans leur API. Mythos 5.1 restera initialement réservé à des programmes d’accès contrôlé.

Au-delà des performances sur benchmarks, ce lancement met en avant trois grandes tendances pour la prochaine génération de modèles : la capacité à travailler en autonomie prolongée, le coût de maintien, et la possibilité d’offrir différents niveaux d’accès selon l’utilisateur.

Questions fréquentes

Quelle est la différence entre Claude Fable 5.1 et Mythos 5.1 ?

Anthropic affirme utiliser le même modèle de base. La différence principale réside dans les contrôles : Fable 5.1 est accessible au grand public, tandis que Mythos 5.1 offre des accès plus permissifs pour des professionnels vérifiés en cybersécurité et sciences de la vie.

Quel est le prix de Claude Fable 5.1 ?

Le prix de base est de 10 dollars par million de tokens d’entrée et 50 dollars par million de tokens de sortie. Les lectures en cache coûtent 0,25 dollars par million, soit 75 % de moins qu’auparavant.

Fable 5.1 peut-il être utilisé pour rechercher des vulnérabilités ?

Oui. Anthropic autorise son emploi pour identifier des vulnérabilités logicielles à des fins défensives. Les activités telles que la génération d’exploits ou certains tests d’intrusion restent toutefois soumises à des restrictions supplémentaires.

Pourquoi Fable 5.1 pourrait être moins cher pour des tâches avec agents ?

Les agents réutilisent souvent en boucle de grandes quantités de contexte. En réduisant le prix des lectures en cache, Anthropic estime une économie d’environ 25 % sur les charges classiques et jusqu’à 45 % pour des processus très intensifs en contexte et en outils.