Aller au contenu
Veille IA

Lecture · veille du 12 septembre 2026

Les utilisateurs de Claude ont trouvé des moyens de contourner les garde-fous pour la recherche sur les armes biologiques

Ars Technica - AI Publié le 11 septembre 2026 à 13:02 Angle juridique Article en anglais pertinence 4 sur 5

Lire l'article original sur Ars Technica - AI, dans une nouvelle fenêtre

Des scientifiques ont tenté d'utiliser le modèle Claude d'Anthropic pour la recherche sur les armes biologiques, malgré les garde-fous mis en place.

  • Anthropic a rapporté plusieurs tentatives par des chercheurs de contourner ses contrôles pour des recherches liées à des bioweapons.
  • Ces tentatives provenaient principalement de scientifiques basés en Russie, Chine et Iran, nations interdites d'accéder aux modèles d'Anthropic.
  • Un cas concernait un chercheur d'une région non spécifiée qui a utilisé Claude pour planifier des expériences avec l'influenza aviaire pendant plusieurs semaines.
  • Anthropic a mis en place des filtres de sécurité limitant l'accès aux modèles les plus performants, mais n'a pas pu certifier l'intention malveillante des chercheurs.
  • Les comptes des personnes impliquées ont été bannis par Anthropic.

Anthropic a mis en lumière une inquiétude croissante concernant le potentiel de manipulation de ses modèles d'IA pour des activités néfastes, notamment la recherche sur les armes biologiques. L'entreprise a documenté plusieurs incidents où des individus ont cherché à exploiter Claude pour des recherches qui pourraient être utilisées à des fins malveillantes.

Ces tentatives, signalées par Anthropic, impliquaient des chercheurs provenant de pays restreints, comme la Russie, la Chine et l'Iran, et visaient notamment à étudier l'influenza aviaire. Malgré les restrictions mises en place par les filtres de sécurité du modèle, certains utilisateurs ont réussi à contourner ces garde-fous.

Il est important de noter que Anthropic n’a pas pu confirmer l’intention malveillante des chercheurs et que la même technologie pourrait être utilisée pour développer des vaccins. L'entreprise a pris des mesures immédiates en bannissant les comptes impliqués, tout en soulignant la nécessité d'un dialogue plus large au sein de l'industrie de l'IA et avec les gouvernements concernant ces risques émergents.

Mots-clés : Claudebioweaponssécurité

Transparence : synthèse en français produite automatiquement par un modèle de langage local (gemma3:4b (Ollama, local sur le VPS)), non révisée. Le texte intégral reste chez l'éditeur d'origine.

Retour à l'édition du 12 septembre 2026