Aller au contenu
Dernière publication
Archive
23 764 articles · 12 rubriques

Le média d'information nouvelle génération

Technologie

Anthropic reporte le déploiement de Claude Mythos après la découverte présumée de milliers de failles zero day détectées par l’IA, décision prise pour renforcer les garde‑fous et éviter des usages malveillants

Anthropic retarde Claude Mythos après des détections massives de vulnérabilité IA. Le modèle reste limité aux partenaires pour renforcement des garde‑fous.

Anthropic a annoncé le report de la mise sur le marché de Claude Mythos après des tests internes ayant révélé, selon la startup, « des milliers » de vulnérabilités informatiques potentiellement exploitables. La décision — communiquée le mardi 7 avril — vise à limiter les risques que la diffusion du modèle n’accélère ou ne facilite des cyberattaques si celui-ci était rendu accessible au grand public sans protections supplémentaires.

Ce que revendique Anthropic

D’après le communiqué interne cité dans l’article d’origine, Claude Mythos aurait identifié un grand nombre de failles « zero-day » dans des logiciels grand public lors d’essais réalisés en interne. Plutôt que de lancer immédiatement une version publique, Anthropic a choisi une mise à l’échelle progressive : le modèle est partagé pour l’instant avec une cinquantaine d’organisations via le « Projet Glasswing ». Ce consortium réunit, toujours selon le texte initial, des acteurs majeurs de la cybersécurité et du cloud comme Amazon, Google, Nvidia, Apple et Microsoft, qui testent Mythos sur leurs propres infrastructures afin de repérer et corriger des failles.

La société indique que l’objectif à terme reste un déploiement à grande échelle — pour des usages de cybersécurité mais aussi pour d’autres applications —, mais qu’il faut d’abord « ajouter des garde-fous supplémentaires » et « empêcher les utilisations les plus dangereuses ». Ce positionnement illustre la volonté d’Anthropic d’adopter un déploiement contrôlé pour réduire les risques d’abus.

Réactions d’experts : entre alarmes et réserves

Plusieurs spécialistes cités dans l’article saluent l’efficacité affichée par Mythos. Adam Meyers, vice-président de CrowdStrike et participant au Projet Glasswing, affirme que Mythos « a trouvé une faille qui dormait depuis 27 ans » dans un élément fondamental (BSD) utilisé par des appareils grand public. Selon ce retour, la découverte serait d’autant plus notable qu’elle n’aurait pas été détectée par des inspections humaines répétées au fil des décennies.

Malgré ces témoignages impressionnés, d’autres voix appellent à la prudence. Heidy Khlaaf, chercheuse en IA à l’AI Now Institute, rappelle que la démonstration d’Anthropic n’a pas encore été rendue publique et que des éléments importants manquent : notamment l’absence de comparaison avec des outils d’analyse existants et l’absence de données sur le taux de faux positifs — c’est‑à‑dire la proportion de traitements erronément signalés comme vulnérables. Elle souligne que, sans accès public au modèle, les affirmations d’Anthropic ne peuvent être répliquées indépendamment.

Ces réserves mettent en lumière un enjeu majeur : la vérifiabilité. Lorsqu’un acteur privé présente des résultats potentiellement « disruptifs » pour la sécurité, la démonstration technique et la possibilité d’une reproduction indépendante sont des critères essentiels pour évaluer la portée réelle des découvertes.

Le report décidé par Anthropic reflète ce dilemme. Publier un outil capable d’automatiser la recherche de vulnérabilités accélérerait la découverte et la correction de failles, mais ouvrirait aussi la voie à des acteurs malveillants souhaitant exploiter ces mêmes vulnérabilités si des protections et des contrôles d’accès ne sont pas en place.

Le cas soulève enfin une question éthique et réglementaire : comment concilier l’innovation en cybersécurité rendue possible par l’IA et le besoin de prévenir la diffusion d’outils qui pourraient être détournés ? Les réponses ne relèvent pas uniquement des entreprises ; elles impliquent aussi les standards industriels, les autorités de régulation et les communautés techniques capables d’auditer ces systèmes.

En l’état, plusieurs enseignements peuvent être tirés sans extrapoler au-delà des faits rapportés : Anthropic a détecté et rapporté, selon ses propres dires, un volume important de vulnérabilités ; l’accès au modèle est pour l’instant restreint à un groupe d’organisations partenaires ; et la communauté scientifique et de la cybersécurité reste partagée entre adhésion aux conclusions et demande de preuves vérifiables.

Relevé · Fiabilité des sources citées

Chaque article de Commons se termine par cet examen. Il porte sur les sources citées dans le texte et vous permet de juger sur pièce.

  1. – Anthropic (communiqué interne) : source primaire pour l’annonce et les chiffres avancés. Fiabilité modérée à condition d’être corroborée par des tiers indépendants, ce qui n’est pas encore le cas d’après le texte original.

  2. – Adam Meyers / CrowdStrike : témoignage d’un acteur reconnu de la cybersécurité participant au Projet Glasswing. Apporte un signal fort, mais reste un témoignage lié au consortium ; la vérification indépendante est souhaitable.

  3. – Heidy Khlaaf / AI Now Institute : critique méthodologique et demande de transparence. Sa position renforce la nécessité d’accès public ou d’audits indépendants avant de tirer des conclusions définitives.

  4. En conclusion, l’annonce d’Anthropic mérite d’être prise au sérieux mais requiert des éléments de validation supplémentaires. La prudence affichée par la startup et la demande d’audits indépendants apparaissent comme des étapes nécessaires avant toute mise à disposition large de Claude Mythos.

L’évaluation porte sur les sources citées dans le texte, pas sur la véracité des faits rapportés. Là où les autres médias placent une bio d’auteur, Commons place sa méthode.

La rédaction de Commons

Partager

Votre assistant

Le titre et le lien de l’article partent dans l’adresse du moteur, et sont copiés dans votre presse-papiers. Ouverture dans un nouvel onglet.

À lire aussi

Même rubrique, dates absolues