Si Opus 5 est le cheval de trait fiable sur lequel vous comptez pour 90 % de votre travail quotidien de connaissance, Fable 5.1 est le spécialiste que vous engagez pour les 10 % restants qui vous empêchent vraiment de dormir. Anthropic ne présente pas ici une toute nouvelle architecture ; Fable 5.1 est une version de mise au point qui resserre les classificateurs du Fable 5 original et, plus important encore, réduit considérablement le coût de la mise en cache du contexte. Il partage les mêmes poids que le Mythos 5.1, très restreint, mais est livré avec la couche de sécurité qui le rend généralement disponible pour le public.
Le saut de capacité est réel, mais il se mesure en endurance plutôt qu’en pics bruts. Fable 5.1 a pris la première place de l’Artificial Analysis Intelligence Index lors de son lancement avec un score de 66 à l’effort maximum, battant Opus 5 (63) et GPT-5.6 Sol (61). Il a également affiché un dominant 1853 au GDPval-AA v2. Mais le changement le plus significatif ne réside pas dans le réseau neuronal — il se trouve sur la page des prix. Alors que les coûts de base des jetons restent à 10 $/50 $, les prix de lecture du cache ont été réduits de 75 % à 0,25 $ par million de jetons. Pour les flux de travail qui dépendent d’une fenêtre de contexte chaude de 1M — comme l’interrogation de bases de code massives ou la synthèse de centaines de documents — cela change fondamentalement l’économie de l’utilisation d’un modèle de raisonnement frontière.
Cependant, utiliser Fable 5.1 n’est pas gratuit. Le modèle dispose d’une pensée adaptative toujours active, ce qui signifie qu’il mâchera un problème jusqu’à ce qu’il soit satisfait. Le résultat est une faim intense de jetons ; Fable 5.1 écrit environ 1,7 fois plus de jetons par tâche que son prédécesseur. Sur Artificial Analysis, l’effort maximum coûte 3,76 $ par tâche contre 2,34 $ pour Opus 5. Et ironiquement, plus d’efforts n’équivaut pas toujours à de meilleurs résultats. La carte du système révèle que l’effort maximum peut conduire à une “sur-édition” — l’ajout de documentation inutile, des modifications de fichiers au passage, ou des tâches CI complexes là où une simple correction aurait suffi.
Il y a aussi les réalités opérationnelles d’un Covered Model. Fable 5.1 conserve vos données pendant 30 jours, sauf si vous avez mis en place des accords Enterprise Frontier Safeguards (EFS) ou Zero Data Retention (ZDR). De plus, les classificateurs de sécurité restent agressifs. Bien qu’il puisse identifier les vulnérabilités dans votre code, il refusera d’écrire des exploits, et les requêtes de recherche biologique complexes déclencheront silencieusement un repli vers le modèle Opus. Et si vous frappez fréquemment l’API avec un contexte froid de 1M, ces lectures froides à 10 $/MTok puniront rapidement vos limites d’utilisation.
Les propres conseils de routage d’Anthropic résument le mieux la place de Fable 5.1 dans l’écosystème : commencez par Opus 5. Mais lorsque Opus échoue à vos évaluations privées — lorsque vous faites face à des recherches de plusieurs heures, des tâches de codage à long horizon ou des documents complexes qui doivent maintenir une cohérence stricte — Fable 5.1 est le modèle de repli le plus performant au monde. C’est le modèle pour lequel vous payez un supplément lorsque faire les choses correctement du premier coup est la seule chose qui compte.