// LES NUMÉRIQUES — INTELLIGENZA ARTIFICIALE
Actualité : Anthropic prouve l’efficacité de Claude Mythos et décide de l’offrir à plus de monde : ce qu’on appelle jouer avec le feu
Fort de 129 000 failles de sécurité débusquées, Anthropic vante les prouesses de son IA Claude Mythos, mais prend le risque inconsidéré d’ouvrir cette arme redoutable à plus grande échelle.
© FotoField/Shutterstock - Claude Mythos s'étend à davantage d'utilisateurs, laissant craindre un retournement des modèles d'Anthropic pour faciliter le piratage
En dévoilant le bilan spectaculaire de Claude Mythos, Anthropic impressionne avec un modèle d’intelligence artificielle axé sur la cybersécurité, dont les performances dépassent toutes les attentes. Pourtant, cette éclatante réussite ravive une inquiétude immédiate : une technologie capable de trouver et combler les moindres failles de sécurité peut tout aussi facilement servir à les exploiter. En ouvrant ainsi ses vannes, la firme de Dario Amodei prend un pari particulièrement périlleux sur l’avenir.
Jusqu’ici réservé à une poignée d’entreprises et organisations triées sur le volet avec le Projet Glasswing, Claude Mythos a permis d’identifier plus de 129 000 vulnérabilités en quelques mois, dont un quart jugé critique. Un saut technologique qui fait gagner des années de travail aux experts en cybersécurité, mais suscite de vives craintes. Au lieu de maintenir un accès limité à ce modèle, Anthropic a décidé en effet d’en élargir la diffusion.
Le Cyber Verification Program, qui propose des versions aux filtres de sécurité allégés, devient en effet accessible à bien plus d’acteurs, sous réserve de montrer patte blanche lors d’un audit de vérification. Trois niveaux d’accès voient au passage le jour : Defense, Red Team et Specialized. Si le dernier échelon reste sous la surveillance étroite du gouvernement étasunien pour protéger les infrastructures vitales, les deux premiers ouvrent grand les portes du système à des structures bien moins encadrées.
Des hôpitaux aux collectivités locales, en passant par de simples PME et des chercheurs en cybersécurité indépendants, davantage d’utilisateurs vont désormais pouvoir exploiter la puissance brute de Claude Mythos 5.1 et Opus 5.5.
C’est précisément là que réside le danger. L’entreprise nord-américaine l’admet d’ailleurs sans détour dans son communiqué : “La cybersécurité est par nature à double usage : les mêmes capacités qui permettent à une équipe de sécurité de trouver et corriger une vulnérabilité peuvent aussi aider un acteur malveillant à l’exploiter.” Pour preuve, lors de simulations d’attaques informatiques réelles via le benchmark CyScenarioBench, Anthropic a constaté qu’avec les garde-fous allégés du palier Red Team, l’IA ne bloquait plus aucune consigne et exécutait avec succès 68 % des cyberattaques complexes.
En voulant aider à éprouver les défenses d’un logiciel ou d’une entreprise, l’éditeur met en réalité à disposition un outil de piratage prêt à l’emploi. Prétendre maîtriser une telle puissance par de simples vérifications préalables et de la rétention de données paraît bien léger pour garantir une sécurité sans faille. En multipliant imprudemment les points d’entrée vers ces versions débridées, Anthropic prend ainsi le risque majeur de voir ses modèles tôt ou tard détournés à des fins malveillantes.
Suivez toute l'actualité des Numériques sur Google Actualités et sur la chaîne WhatsApp des Numériques
Envie de faire encore plus d'économies ? Découvrez nos codes promo sélectionnés pour vous.