Classé #3 Écosystème du quotidien — Les assistants IA leaders
Anthropic

Claude Fable 5

Le premier modèle de classe Mythos d'Anthropic rendu accessible à tous. La même architecture que le Mythos 5 restreint, mais avec des garde-fous conservateurs qui redirigent les requêtes sensibles vers Opus 4.8. Il délivre des performances frontière sur tous les benchmarks qui comptent — SWE-Bench Pro 80,3%, FrontierCode Diamond 29,3%, Hebbia Finance n°1 — et l'écart se creuse à mesure que les tâches se complexifient. Pour ceux qui peuvent assumer un tarif premium, c'est le modèle IA le plus puissant accessible au grand public.

Mis à jour 1er juillet 2026 Mythos-class1M ContextReasoning
9.8sur 10
Site officiel
Idéal pour

Le premier modèle de classe Mythos d'Anthropic rendu accessible à tous. La même architecture que le Mythos 5 restreint, mais avec des garde-fous conservateurs qui redirigent les requêtes sensibles vers Opus 4.8. Il délivre des performances frontière sur tous les benchmarks qui comptent — SWE-Bench Pro 80,3%, FrontierCode Diamond 29,3%, Hebbia Finance n°1 — et l'écart se creuse à mesure que les tâches se complexifient. Pour ceux qui peuvent assumer un tarif premium, c'est le modèle IA le plus puissant accessible au grand public.

Pourquoi ça Gagne

SWE-Bench Pro 80,3% (SOTA — écrase les 58,6% de GPT-5.5). FrontierCode Diamond 29,3% (5× GPT-5.5). Hebbia Finance Benchmark n°1. CursorBench SOTA. Stripe a migré une base de code de 50M de lignes en une journée. Complétion de Pokémon Rouge Feu en vision seule. 3× mieux à Slay the Spire avec mémoire persistante vs Opus 4.8. 10 $/50 $ par M de tokens. Contexte d'1M. Disponible sur claude.ai, API, Bedrock, Vertex, Foundry.

À surveiller

Tarif premium à 10 $/50 $ par M de tokens (2× Opus 4.8). Les garde-fous conservateurs redirigent <5% des sessions vers Opus 4.8 sur les sujets signalés (cybersécurité, biologie, chimie). Ce n'est pas le Mythos 5 sans restriction (réservé au Project Glasswing). Les benchmarks indépendants sont encore en cours le jour du lancement. Limites d'utilisation sur les plans Pro/Max en période de forte demande.

01

Ce que c'est réellement

Mise à jour du 25 juillet : Claude Opus 5 passe désormais devant Fable 5. Fable garde de petites victoires maximales sur FrontierCode, CursorBench, HLE sans outils et un test juridique ; Opus 5 mène des évaluations plus larges d’agents et de travail professionnel à moitié prix et avec moins de contraintes. Le texte ci-dessous conserve les preuves du lancement de juin ; lisez ses superlatifs dans ce contexte historique.

Si Opus 4.8 était la promotion, Fable 5 est le bureau d’angle. Le changement de nomenclature d’Anthropic, des registres musicaux (Haiku, Sonnet, Opus) aux registres littéraires (Fable, Mythos), n’est pas juste du branding — il signale une nouvelle classe de modèle. Fable 5 tourne sur la même architecture de classe Mythos qui propulse le Mythos 5 restreint, mais avec des classifieurs de sécurité qui le rendent utilisable par tous. Imaginez une supercar avec le limiteur de vitesse enclenché — toujours la plus rapide sur la route, juste avec des garde-fous dans certains virages.

Les chiffres parlent d’eux-mêmes. SWE-Bench Pro à 80,3% ne se contente pas de battre GPT-5.5 (58,6%) — il humilie tout le peloton. FrontierCode Diamond à 29,3% signifie que Fable 5 écrit du code de qualité production cinq fois plus efficacement que GPT-5.5 (5,7%). Sur le Hebbia Finance Benchmark — raisonnement documentaire de niveau senior, lecture de graphiques, analyse des causes racines — il est n°1. Sur CursorBench, il a ouvert « une classe de problèmes à long horizon qui étaient hors de portée des modèles précédents. »

Mais les démonstrations les plus parlantes ne sont pas des benchmarks. Stripe a migré une base de code Ruby de 50 millions de lignes en une seule journée — un travail qui aurait pris deux mois à une équipe complète. Le modèle a complété Pokémon Rouge Feu en utilisant uniquement des captures d’écran brutes — pas de cartes, pas d’outils auxiliaires, pas de données d’état du jeu. Et avec une mémoire persistante basée sur des fichiers en jouant à Slay the Spire, ses performances se sont améliorées 3× de plus que celles d’Opus 4.8.

L’histoire de la sécurité mérite d’être comprise. Les requêtes touchant à la cybersécurité, la biologie, la chimie ou la distillation de modèles sont automatiquement redirigées vers Opus 4.8 — toujours un modèle de premier plan, mais pas l’architecture Mythos complète. Cela se produit dans moins de 5% des sessions, et Anthropic reconnaît quelques faux positifs sur des requêtes inoffensives. C’est le prix à payer pour publier un modèle aussi capable rapidement et en toute sécurité. Le Mythos 5 sans restriction est réservé aux partenaires accrédités via le Project Glasswing — où il contribue déjà à défendre des infrastructures logicielles critiques.

La vraie question est de savoir si le prix en vaut la peine. À 10 $/50 $ par million de tokens, Fable 5 coûte environ 2× ce que coûte Opus 4.8. Mais l’efficacité en tokens compense partiellement — atteindre les meilleurs résultats FrontierCode à effort modéré signifie moins de calcul par tâche. Pour les professionnels dont le temps vaut plus que leur facture API, le calcul est simple. Pour tous les autres, Opus 4.8 reste excellent. Mais si vous voulez le meilleur modèle IA généralement disponible sur la planète — celui dont l’avance se creuse à mesure que la tâche se complexifie — c’est celui-là.

02

Forces et limites honnêtes

Points Forts

  • Déploiement mondial et preuve de sécurité Zero-Day : Suite à la validation de la conformité commerciale internationale le 30 juin 2026, Fable 5 est de nouveau accessible à l’échelle mondiale sans restriction régionale de VPN. Lors de tests en production, les équipes de cybersécurité d’Amazon ont confirmé que Fable 5 a identifié et corrigé en toute autonomie une vulnérabilité Zero-Day d’usurpation de token OAuth2 sur 40 microservices en moins de 3 minutes, prouvant son niveau de sécurité entreprise.
  • Bascule de cybersécurité Opus 4.8 & Faux positifs : Bien que Fable 5 exécute nativement ~95% des tâches de codage standard, les classificateurs de sécurité d’Anthropic redirigent automatiquement les requêtes de cybersécurité complexes ou à haut risque vers Claude Opus 4.8 pour un alignement strict des politiques. Remarque : des classificateurs agressifs peuvent parfois déclencher de faux positifs sur des scripts d’administration système légitimes.
  • Résistant aux jailbreaks agentiques structurés : Contrairement aux concurrents à poids ouverts qui cèdent face à des frameworks de persuasion automatisés multi-tours (ex. jailbreaks MoA ou attaques Crescendo), l’entraînement de sécurité hiérarchique de Fable 5 maintient des frontières strictes sans dégrader la qualité du code créatif.
  • Capacité de classe Mythos pour tous : Même architecture sous-jacente que le Mythos 5 restreint, mais avec des classifieurs de sécurité qui le rendent largement disponible. Fable 5 est à l’état de l’art sur pratiquement tous les benchmarks testés — et l’écart avec les concurrents grandit à mesure que les tâches se complexifient. Ce n’est pas incrémental ; c’est un saut générationnel.
  • Un agent autonome qui tient ses promesses : Stripe a comprimé des mois d’ingénierie en quelques jours — migrant une base de code Ruby de 50 millions de lignes en une seule journée. Le modèle planifie, délègue à des sous-agents, se vérifie avec ses propres tests et continue jusqu’à ce que le travail soit fait. Les sessions autonomes de plusieurs jours sont la nouvelle norme.
  • Percée en vision : État de l’art sur les tâches visuelles. Capable d’extraire des chiffres précis de figures scientifiques, de reconstruire des applications web à partir de captures d’écran seules, et de compléter Pokémon Rouge Feu en vision uniquement — sans cartes auxiliaires, sans outils, sans données d’état du jeu. Les modèles précédents nécessitaient un échafaudage complexe ; Fable 5 n’a besoin que de ses yeux.
  • Mémoire sur des millions de tokens : La mémoire persistante basée sur des fichiers a amélioré ses performances à Slay the Spire 3× de plus qu’Opus 4.8. Le modèle reste concentré sur des sessions d’un million de tokens et améliore réellement ses résultats grâce à ses propres notes. Le contexte long n’est pas juste une spécification — c’est une fonctionnalité qui marche.
  • L’efficacité en tokens change le calcul : Malgré un prix par token 2× supérieur à Opus 4.8, Fable 5 obtient le meilleur score FrontierCode même à effort modéré. Plus de travail accompli par token signifie un coût réel par tâche souvent compétitif. Le modèle cher qui fait économiser de l’argent sur les problèmes difficiles.

Limites Honnêtes

  • Faux positifs en cybersécurité : Des classificateurs de sécurité très agressifs peuvent parfois signaler des scripts légitimes d’administration système, de tests d’intrusion ou de débogage bas niveau comme malveillants, déclenchant une redirection vers Opus 4.8 ou bloquant l’exécution.
  • Risque résiduel de jailbreak dans l’industrie : Bien que résistant aux attaques standards, aucun modèle frontière n’est totalement immunisé contre les nouveaux jailbreaks agentiques structurés ; un red-teaming continu reste nécessaire pour les déploiements en entreprise.
  • Le tarif premium est réel : 10 $ par million de tokens en entrée, 50 $ par million de tokens en sortie — environ 2× les tarifs d’Opus 4.8. Les abonnés Pro bénéficient d’un accès inclus jusqu’au 22 juin, puis les crédits d’utilisation prennent le relais. Les utilisateurs intensifs sentiront la facture.
  • Redirection de sécurité conservatrice : Les garde-fous se déclenchent dans <5% des sessions, redirigeant les requêtes signalées vers Opus 4.8. Quelques faux positifs sur du travail professionnel légitime (recherche en cybersécurité, chimie, biologie). Les garde-fous reflètent la puissance à double usage du modèle sous-jacent.
  • Ce n’est pas le Mythos 5 complet : La version sans restriction est verrouillée derrière le Project Glasswing pour les cyberdéfenseurs et chercheurs accrédités. Ce que vous obtenez est explicitement une version encadrée — extrêmement capable, mais avec des stabilisateurs sur certains sujets.
  • Benchmarks indépendants en attente : Les résultats du jour du lancement sont détaillés et riches en exemples, mais les résultats complets de LMSYS Arena, Artificial Analysis et les mises à jour tierces de SWE-Bench émergent encore. Vérifiez avant de couronner.
03

Aperçu des Benchmarks

SWE-Bench Pro — 80,3% (SOTA)

Ingénierie logicielle en conditions réelles. Écrase GPT-5.5 (58,6%) de 21,7 points et son prédécesseur Opus 4.8 (69,2%) de 11,1 points. L'avance la plus large jamais détenue par un modèle.

FrontierCode Diamond — 29,3% (SOTA)

Code de production de haute qualité, économe en tokens. Score de 29,3% contre 13,4% pour Opus 4.8 et 5,7% pour GPT-5.5. Atteint les meilleures performances même à effort de raisonnement modéré.

Hebbia Finance Benchmark — n°1

Raisonnement documentaire de niveau senior, interprétation de graphiques et analyse des causes racines. Le score le plus élevé de tous les modèles testés. IMC a confirmé qu'il a excellé sur les évaluations d'analyse de trading pratiquement sur toute la ligne.

CursorBench — SOTA

État de l'art sur le benchmark de Cursor. « A ouvert une classe de problèmes à long horizon qui étaient hors de portée des modèles précédents. » — Michael Truell, CEO de Cursor.

04

Le Verdict

La frontière vient de se déplacer. Claude Fable 5 n’est pas une itération d’Opus 4.8 — c’est un saut générationnel enveloppé de garde-fous de sécurité. L’avance sur SWE-Bench Pro (80,3% contre 58,6% pour GPT-5.5) n’est pas une erreur d’arrondi — c’est un gouffre. L’écart sur FrontierCode est encore plus large. Et contrairement aux modèles qui gagnent des benchmarks mais trébuchent en pratique, Fable 5 a les preuves : Stripe migrant 50 millions de lignes de code en une journée, complétion de jeu en vision seule, et mémoire persistante qui fonctionne réellement sur les longues sessions. Le bémol, c’est le prix — 10 $/50 $ par million de tokens, ce n’est pas de l’argent de poche — et la redirection de sécurité conservatrice vous enverra occasionnellement vers Opus 4.8 sur des requêtes légitimes. Mais pour les professionnels qui ont besoin du cerveau IA le plus puissant accessible au public, et dont le travail implique de l’ingénierie complexe, de la recherche approfondie ou des tâches agentiques à long horizon — c’est celui-là. Le meilleur modèle IA que vous puissiez réellement utiliser.

05

Foire aux questions