Aller au contenu

Claude Fable 5.1 et Mythos 5.1 : Les Nouveaux Modèles d'Anthropic pour le Codage et la Recherche Scientifique

Claude Fable 5.1 et Mythos 5.1 : Les Nouveaux Modèles d'Anthropic pour le Codage et la Recherche Scientifique

Key takeaways

  • Claude Fable 5.1 et Mythos 5.1 sont les modèles d'IA les plus avancés d'Anthropic, optimisés pour le codage, la recherche scientifique et les tâches complexes.
  • Fable 5.1 est accessible au grand public, tandis que Mythos 5.1 est réservé aux programmes d'accès sécurisé pour des domaines sensibles comme la cybersécurité et la biologie.
  • Les coûts sont réduits de 25 % en moyenne, avec des économies pouvant atteindre 45 % pour les tâches agentiques.
  • Les Enterprise Frontier Safeguards (EFS) garantissent une confidentialité totale des données en les stockant dans une infrastructure cloud contrôlée par le client.
  • Les performances en codage, recherche scientifique et raisonnement multidisciplinaire surpassent celles des versions précédentes.
  • Claude Mythos 5.1 est conforme à l'EU AI Act, avec des sauvegardes adaptées aux applications critiques.

Une nouvelle frontière de performance pour l'IA

Anthropic, leader en intelligence artificielle axée sur la sécurité, lance Claude Fable 5.1 et Claude Mythos 5.1, deux versions d'un même modèle conçu pour repousser les limites du codage, de la recherche scientifique et des tâches complexes. Ces modèles marquent une avancée significative dans la manière dont l'IA peut contribuer à des domaines aussi variés que la cybersécurité, la biologie ou le développement logiciel.

Bien qu'ils partagent la même architecture sous-jacente, Fable 5.1 et Mythos 5.1 se distinguent par leurs niveaux de sauvegardes. Fable 5.1 est disponible pour le grand public, tandis que Mythos 5.1 est réservé aux programmes d'accès sécurisé, notamment pour les applications en cybersécurité et en sciences de la vie. Cette distinction permet à Anthropic de répondre aux besoins spécifiques de secteurs sensibles tout en maintenant un haut niveau de sécurité et de conformité.

Des performances inégalées en codage et recherche scientifique

Claude Fable 5.1 établit un nouveau standard en matière de performance pour les tâches de codage, de recherche scientifique et de résolution de problèmes complexes. Selon les benchmarks publiés par Anthropic, Fable 5.1 surpasse largement son prédécesseur, Fable 5, tout en offrant des résultats similaires ou supérieurs à un coût réduit.

Benchmarks clés

  • Recherche scientifique agentique : Fable 5.1 atteint 52,6 % sur Terminal-Bench-Science 0.1, contre 24,7 % pour Fable 5.
  • Codage agentique : Sur Terminal-Bench 4.0, Fable 5.1 obtient 55,8 %, tandis que Mythos 5.1 atteint 60,9 %.
  • Raisonnement multidisciplinaire : Sur Humanity's Last Exam, Fable 5.1 affiche 60,9 % sans outils et 65,0 % avec outils.
  • Flux de travail professionnels : Sur AutomationBench, Fable 5.1 atteint 31,4 %, contre 17,1 % pour Fable 5.

Ces résultats démontrent une amélioration significative de la capacité du modèle à éviter les raccourcis et à résoudre des problèmes complexes avec une précision accrue. Par exemple, dans un cas rapporté par le fonds d'investissement Millennium, Fable 5.1 a identifié la cause d'un crash logiciel rare qui avait échappé à tous les ingénieurs et autres modèles d'IA pendant plusieurs années.

Réduction des coûts et innovations en matière de sécurité

Anthropic a pris en compte les retours de ses clients pour améliorer l'accessibilité et la sécurité de ses modèles. Voici les principales innovations :

Réduction des coûts

Fable 5.1 réduit les coûts d'environ 25 % pour les charges de travail typiques, grâce à une baisse des prix sur les lectures de cache. Pour les tâches hautement agentiques, les économies peuvent atteindre 45 %. Cette réduction rend le modèle plus accessible aux entreprises et aux développeurs, tout en maintenant un haut niveau de performance.

Confidentialité des données

Anthropic introduit les Enterprise Frontier Safeguards (EFS), un système qui permet aux clients de stocker leurs données dans une infrastructure cloud entièrement contrôlée par eux-mêmes. Cela garantit une confidentialité totale, équivalente à une politique de rétention zéro des données, tout en prévenant les utilisations malveillantes. Ce système sera déployé progressivement à partir de l'automne 2024.

Amélioration des sauvegardes

Les sauvegardes de Fable 5.1 ont été optimisées pour réduire les faux positifs, notamment dans le domaine de la cybersécurité. Par exemple, le modèle bloque désormais 60 % de faux positifs en moins qu'auparavant. De plus, Fable 5.1 peut être utilisé pour découvrir des vulnérabilités logicielles, sans pour autant permettre le développement d'exploits malveillants.

Pour les applications en biologie, Anthropic a mis en place un programme d'accès sécurisé, développé en partenariat avec le gouvernement américain, pour permettre aux scientifiques d'utiliser les capacités avancées de Mythos 5.1. Les inscriptions pour ce programme devraient s'ouvrir prochainement.

Conformité et accessibilité

Conformité avec l'EU AI Act

Claude Mythos 5.1 est conçu pour être conforme à l'EU AI Act, une réglementation européenne visant à encadrer l'utilisation de l'IA dans les applications sensibles. Ses sauvegardes renforcées en font un outil adapté aux domaines critiques comme la cybersécurité et la biologie, où la conformité réglementaire est essentielle.

Accès sécurisé pour Mythos 5.1

Mythos 5.1 n'est accessible que via des programmes d'accès sécurisé, garantissant que son utilisation reste contrôlée et adaptée aux besoins des secteurs sensibles. Cette approche permet à Anthropic de maintenir un équilibre entre innovation et sécurité, tout en répondant aux exigences des régulateurs et des clients.

Retours des partenaires et applications concrètes

Les premiers utilisateurs de Fable 5.1, parmi lesquels des entreprises comme Jane Street Capital, Cognition et MongoDB, ont souligné les améliorations qualitatives et quantitatives du modèle. Voici quelques retours marquants :

  • Jane Street Capital : "Claude Fable 5.1 résout plus de problèmes de codage que Fable 5 ou Opus 5, et atteint l'état de l'art en intuition de trading. Contrairement aux modèles précédents, il reste lisible même sur des tâches longues et multi-étapes."
  • Cognition : "Nous basculons notre trafic Opus 5 vers Claude Fable 5.1 dès son lancement. Il offre des performances similaires ou supérieures à Fable 5, à un coût réduit, et avec les nouvelles tarifications de cache, il devient économique pour nos charges de travail."
  • Millennium : "Un code présentait un crash extrêmement rare, inexpliqué depuis quatre à cinq ans. Aucun modèle, y compris Fable 5, n'avait pu l'identifier. Claude Fable 5.1 a été le premier à le découvrir en analysant une bibliothèque externe et en traçant le bug."
  • MongoDB : "Claude Fable 5.1 a construit un prototype complexe en trois jours, avec une recherche initiale approfondie et une implémentation autonome, incluant des boucles de vérification robustes."

Ces témoignages illustrent la capacité de Fable 5.1 à résoudre des problèmes complexes, à améliorer l'efficacité des équipes techniques et à offrir un retour sur investissement tangible pour les entreprises.

FAQ

Quelle est la différence entre Claude Fable 5.1 et Claude Mythos 5.1 ?

Claude Fable 5.1 et Mythos 5.1 sont le même modèle sous-jacent, mais avec des niveaux de sauvegardes différents. Fable 5.1 est accessible au grand public, tandis que Mythos 5.1 est réservé aux programmes d'accès sécurisé pour des domaines comme la cybersécurité et les sciences de la vie.

Quels sont les avantages de Claude Fable 5.1 en termes de coûts ?

Claude Fable 5.1 réduit les coûts d'environ 25 % pour les charges de travail typiques grâce à une baisse des prix sur les lectures de cache. Pour les tâches hautement agentiques, les économies peuvent atteindre jusqu'à 45 %.

Comment Anthropic garantit-elle la sécurité des données avec ces modèles ?

Anthropic propose des Enterprise Frontier Safeguards (EFS), un système qui stocke les données dans une infrastructure cloud contrôlée par le client, offrant une confidentialité totale tout en prévenant les utilisations malveillantes.

Quelles sont les performances de Claude Fable 5.1 en codage et recherche scientifique ?

Claude Fable 5.1 surpasse son prédécesseur sur plusieurs benchmarks, notamment en codage agentique, recherche scientifique et raisonnement multidisciplinaire. Il évite les raccourcis et résout des problèmes complexes avec une précision accrue.

Claude Mythos 5.1 est-il conforme à l'EU AI Act ?

Oui, Claude Mythos 5.1 est conçu pour être conforme à l'EU AI Act, notamment grâce à ses sauvegardes renforcées pour les applications sensibles comme la cybersécurité et la biologie.

À lire aussi

Modifier l'article

Image actuelle : Image actuelle

Paisible AI