Anthropic lance les modèles d’IA Fable et Mythos 5.1 avec des capacités améliorées
Ce mardi, Anthropic a dévoilé les modèles Fable et Mythos 5.1, des versions jumelées du modèle d’IA le plus avancé de l’entreprise, incluant des améliorations de performance ainsi que des modifications visant à réduire les coûts liés aux tokens et à minimiser les fausses alertes des protections existantes.
Mythos 5.1 reste exclusivement accessible aux partenaires enregistrés d’Anthropic impliqués dans la cybersécurité ou la recherche en sciences de la vie. En revanche, Fable 5.1, la version sans restrictions, est désormais disponible sur les plateformes cloud et via l’API d’Anthropic.
Parmi les améliorations les plus notables figure l’adoption par l’entreprise d’une politique de non-conservation des données, permettant aux clients d’exploiter les modèles d’Anthropic sur leur propre infrastructure sans envoyer de données à l’extérieur. Cette fonctionnalité, auparavant indisponible en raison de problèmes de sécurité, sera complétée par un service de haute confidentialité dénommé Enterprise Frontier Safeguards, prévu pour être lancé cet automne. Ce système continuera de surveiller les abus tout en permettant aux clients de gérer la manière dont cette supervision se déroule.
Dans le cadre de ce lancement, Anthropic a rassuré ses clients en matière de sécurité des données, déclarant : “Anthropic n’a jamais utilisé de données d’entreprise sans autorisation explicite, et ne le fera jamais.”
Les nouveaux modèles ont atteint des scores records dans divers benchmarks, tels que Terminal-Bench 4.0 pour la programmation CLI et Humanity’s Last Exam pour les tâches de raisonnement général. De plus, Anthropic a publié trois résultats scientifiques dérivés des modèles avant leur lancement, incluant une optimisation GPU personnalisée et une carte haute résolution de Vénus créée à partir d’images existantes.
Accompagnant la sortie, les modèles sont fournis avec une carte système complète détaillant leurs fonctionnalités. La carte système classe Mythos comme “à faible risque” concernant le développement automatisé de l’IA, indiquant que “sa capacité à accélérer les progrès internes de R&D en IA est en phase avec les tendances actuelles.”
Cependant, en termes de comportements indésirables, Mythos présente une propension légèrement plus élevée que le modèle Opus, probablement en raison de ses fonctionnalités avancées. La carte système décrit ce changement : “Mythos 5.1 représente un léger recul en termes de comportement global mal aligné par rapport à Opus 5, tout en étant une amélioration par rapport à Mythos 5 et Claude Sonnet 5.” Elle reconnaît que bien qu’il soit plus coopératif face aux abus potentiels et accepte des affirmations d’autorisation non vérifiables plus facilement que l’Opus 5, il reste moins enclin à ignorer des contraintes explicites, à halluciner des entrées ou à revendiquer de manière inexacte l’achèvement des tâches par rapport aux modèles précédents.