Aller au contenu
Actualité

Claude Fable 5.1 et Mythos 5.1 : Anthropic pousse son duo coding & recherche

Anthropic lance Claude Fable 5.1 et Mythos 5.1 : même base, garde-fous différents, prix token en baisse estimée et scores en forte hausse sur plusieurs bancs.

5 septembre 2026

Claude Fable 5.1 et Mythos 5.1, nouvelles versions du modèle Anthropic

Anthropic a dévoilé deux mises à jour majeures de sa gamme Claude : Fable 5.1 et Mythos 5.1. Ces versions affinent les capacités de raisonnement, d’automatisation et de recherche scientifique de leurs prédécesseurs, tout en introduisant une baisse de 25 % sur le coût des lectures cache et de nouvelles garanties de confidentialité via le chiffrement EFS. Les garde-fous (safeguards) ont également été renforcés pour les déploiements en entreprise et les usages sensibles.

Fable 5.1 : raisonnement et agents

Fable 5.1 se positionne comme le modèle optimisé pour le raisonnement complexe, la résolution de problèmes multi-étapes et l’exécution de tâches d’agent autonomes. Anthropic met l’accent sur les gains mesurables par rapport à Fable 5 et aux modèles concurrents sur une série de benchmarks exigeants, notamment ceux qui simulent des environnements réels — terminaux, bureaux virtuels, bases de code.

Les améliorations portent autant sur la précision des réponses que sur la robustesse face aux tâches longues. Fable 5.1 maintient une cohérence accrue sur les séquences de plusieurs dizaines d’étapes, réduisant les dérives et les abandons prématurés observés sur les versions antérieures.

Mythos 5.1 : créativité et nuance

Mythos 5.1 complète Fable en couvrant les usages où la nuance narrative, la créativité structurée et la compréhension contextuelle fine priment sur la pure performance en benchmark technique. Mythos excelle sur Terminal-Bench 4.0 avec un score de 60,9 %, dépassant Fable 5.1 sur ce test spécifique, ce qui illustre la spécialisation des deux lignées au sein de la même génération.

Benchmarks comparatifs

Le tableau suivant synthétise les performances de Fable 5.1, Fable 5, Opus 5 et GPT-5.6 Sol sur les principaux benchmarks publiés par Anthropic :

Benchmark Fable 5.1 Fable 5 Opus 5 GPT-5.6 Sol
Terminal-Bench-Science 52,6 % 24,7 % 29,0 % 22,4 %
Terminal-Bench 4.0 55,8 % 42,0 % 52,3 % 37,3 %
Terminal-Bench 4.0 (Mythos 5.1) 60,9 %
GDPval-AA 1 853 1 723 1 824 1 711
OSWorld (partial) 77,9 72,9 75,4
OSWorld (strict) 41,7 36,1 39,6
HLE (sans outils) 60,9 57,8 56,6
HLE (avec outils) 65,0 63,8 63,6
AutomationBench 31,4 17,1 26,9 19,6
CursorBench 73,4 70,5 70,0 67,2

Les progressions les plus marquantes concernent Terminal-Bench-Science, où Fable 5.1 plus que double le score de Fable 5 (52,6 % contre 24,7 %), et AutomationBench, où le gain passe de 17,1 % à 31,4 %. Sur CursorBench, dédié à l’assistance au développement dans un IDE, Fable 5.1 atteint 73,4 %, confirmant son orientation vers les workflows d’ingénierie logicielle.

Tarification et cache

Anthropic annonce une réduction de 25 % sur le coût des lectures cache pour Fable 5.1 et Mythos 5.1. Le mécanisme de prompt caching permet aux applications qui réutilisent un contexte stable — documentation, base de code, instructions système — de ne payer qu’une fraction du coût d’inférence sur les tokens déjà traités. Cette baisse de prix rend les déploiements à contexte long plus économiquement viables, en particulier pour les agents qui maintiennent un état persistant sur des sessions de plusieurs heures.

Confidentialité EFS

Le chiffrement EFS (Encrypted File System) étend les garanties de confidentialité aux données traitées par Claude en entreprise. Les requêtes et réponses peuvent être chiffrées de bout en bout, avec des clés gérées par le client, limitant la capacité d’Anthropic à accéder au contenu des interactions. Cette fonctionnalité répond aux exigences des secteurs réglementés — finance, santé, défense — où la localisation et la protection des données sensibles sont des conditions préalables au déploiement de modèles cloud.

Safeguards renforcés

Les garde-fous de Fable 5.1 et Mythos 5.1 couvrent plusieurs dimensions : refus de contenu dangereux, détection de tentatives de jailbreak, limitation des outputs en contexte sensible, et journalisation configurable pour les administrateurs. Anthropic propose des niveaux de strictesse ajustables selon le profil d’usage, permettant par exemple un filtrage plus permissif en recherche académique et plus strict en interface grand public.

Recherche scientifique : protéines et climat

Au-delà des benchmarks synthétiques, Anthropic met en avant des résultats concrets en recherche scientifique. Fable 5.1 a contribué à la conception de protéine binders (molécules capables de se lier selectivement à des cibles protéiques), accélérant des cycles de recherche qui prenaient auparavant plusieurs semaines en laboratoire. Le modèle propose des séquences candidates, évalue leur plausibilité structurale et suggère des modifications itératives.

Sur Venus DEM, un projet de modélisation climatique haute résolution, Claude a assisté l’optimisation de kernels GPU, produisant des speedups significatifs sur les routines de calcul les plus coûteuses. Ces gains se traduisent directement en réduction du temps de simulation et en consommation énergétique des clusters de calcul — un argument pertinent pour les centres de recherche soumis à des contraintes budgétaires et environnementales.

Témoignage Jane Street

Jane Street, société de trading quantitative reconnue pour son exigence technique, a partagé un retour d’expérience positif sur l’intégration de Claude dans ses workflows d’analyse et de développement. L’équipe y souligne la capacité du modèle à naviguer des bases de code OCaml volumineuses, à formuler des hypothèses testables sur des données de marché et à maintenir une rigueur formelle compatible avec les standards de la firme. Ce témoignage illustre l’adoption de Claude au-delà des usages généralistes, dans des environnements où la précision et la reproductibilité sont non négociables.

Positionnement face à la concurrence

Sur GDPval-AA, Fable 5.1 (1 853) se rapproche d’Opus 5 (1 824) tout en restant derrière sur certains tests de créativité où Mythos 5.1 prend le relais. GPT-5.6 Sol (1 711) reste compétitif mais ne domine pas l’ensemble du spectre. La stratégie d’Anthropic consiste à proposer une gamme spécialisée plutôt qu’un modèle unique polyvalent, permettant aux clients de choisir Fable pour l’automation et Mythos pour la nuance.

Conclusion

Fable 5.1 et Mythos 5.1 consolident la position d’Anthropic sur le segment des modèles premium orientés entreprise et recherche. Les gains sur Terminal-Bench-Science, AutomationBench et CursorBench démontrent une progression réelle, pas seulement marketing. Couplées à la baisse des coûts cache, au chiffrement EFS et aux safeguards configurables, ces versions répondent aux attentes des organisations qui cherchent à déployer l’IA à grande échelle sans compromettre confidentialité ni rigueur. Les avancées en design de protéines et en optimisation GPU confirment que Claude n’est plus seulement un assistant conversationnel, mais un outil de recherche à part entière.

Construisons l'IA de confiance, ensemble.

Comparez, testez et choisissez les meilleurs outils IA — en français, en euros, sans compromis.

Voir les comparatifs