Anthropic lance Claude Fable 5 : le premier modèle universel de classe Mythos avec garde-corps de sécurité
Anthropic lance les modèles de classe Mythos Claude Fable 5 (version universelle avec garde-corps de sécurité) et Mythos 5 (version cyberdéfense sans restriction). Au prix de 10 $/50 $/million de jetons, Stripe peut effectuer deux mois de travail en une journée, et la conception du médicament d'Evozyne est 10 fois plus rapide.
Anthropic lance officiellement le modèle Claude le plus puissant à ce jour : Claude Fable 5 est le premier modèle de niveau Mythos (avec garde-corps de sécurité) ouvert aux utilisateurs généraux. Il atteint SOTA sur presque tous les tests de test dans les domaines du génie logiciel, du travail de connaissances, de la vision, de la recherche scientifique, etc. Plus la tâche est complexe et longue, plus l'avance est évidente. Claude Mythos 5 est une version sans garde-fous de sécurité et n'est disponible que pour les organisations de cyberdéfense via le projet Glasswing. Une version améliorée du classificateur de sécurité a été lancée simultanément, qui, selon les tests officiels, a éliminé 95 % des vecteurs de danger. Prix 10 $/50 $ par million de jetons.
Évaluation en ligne (Chatbot Arena) : Fable 5 se classe premier dans toutes les catégories, devant la deuxième place 70 ELO - équivalent à l'écart entre GPT-5.4 et GPT-5.5. Le taux de victoire atteint 86 % et le taux de victoires en match nul et en match est de 96 %. La capacité de programmation ELO atteint 1794, le score de la tâche de style de codage est de 96,8.
Tarif : saisissez 10 $/million de jetons, produisez 50 $/million de jetons.
Conception de garde-corps de sécurité
Les capacités du modèle de niveau Mythos comportent des risques : les capacités de Fable 5 dans des domaines tels que la cybersécurité pourraient être exploitées à des fins malveillantes. Par conséquent, les classificateurs de garde déployés par Anthropic (Guard Classifiers) pour Fable 5 et les requêtes pour certaines catégories seront gérées par Claude Opus 4.8. Ces garde-corps de sécurité sont réglés pour être conservateurs : ils se déclenchent en moyenne dans moins de 5 % des sessions.
Classificateur de sécurité amélioré
Tout en maintenant un taux de réussite de plus de 92 % des invites bénignes, le nouveau classificateur peut éliminer 95 % des vecteurs nocifs dans les données de test officielles, ce qui représente une amélioration significative par rapport au niveau précédent de 60 %. L’AI Security Institute (AISI) a évalué de manière indépendante qu’il était suffisamment robuste.
Mythe 5 + Projet Glasswing
Mythos 5, qui est la même sous-couche que Fable 5 mais supprime les garde-fous de sécurité, n'est disponible que pour une poignée d'organisations de cyberdéfense et de fournisseurs d'infrastructures via le programme de partenariat Project Glasswing. Anthropic sera déployé en partenariat avec le gouvernement américain.
Cas d'application pratiques
- Stripe : réalisation de deux mois de travail traditionnel en une seule journée (pour la première fois, une alarme de sécurité interne s'est déclenchée en raison d'une "capacité excessive")
- Evozyne Drug Design : Concevoir de nouvelles protéines 10 fois plus rapidement
Le Claude Fable 5 est le modèle le plus radical d'Anthropic à ce jour. Les capacités de niveau mythe fournissent un accès universel au monde extérieur grâce à un mécanisme de rétrogradation de « classificateur de sécurité », tout en limitant la version sans restriction aux scénarios de défense du réseau – cette stratégie de « classification de capacités » représente un nouveau paradigme pour le déploiement de l'IA de pointe. Les cas réels de Stripe accomplissant deux mois de travail en une journée et de la conception de médicaments d'Evozyne accélérée par 10 illustrent que les capacités de l'IA en matière de programmation au niveau de l'entreprise et de développement de médicaments se rapprochent rapidement du « niveau de remplacement ».
Actuellement, DeepSeek V4 Pro, GPT-5.5 et Claude Fable 5 ont formé une compétition tripartite en termes de capacités de programmation, mais l'avance globale de Fable 5 dans le benchmark global montre qu'Anthropic a établi un avantage significatif au niveau Mythos.
Des orientations dignes de suite :
- Performances réelles des classificateurs de garde : Acceptabilité d'un taux de déclenchement de 5 % dans des scénarios de production réels
- Extensions du projet Glasswing : l'accès à Mythos 5 sera-t-il étendu ?
- IMPACT DU CONTRÔLE DES EXPORTATIONS : L'impact réel des contrôles à l'exportation du gouvernement américain sur l'accès mondial à la famille de modèles Claude
Avis