Face aux inquiétudes croissantes sur la sécurité des systèmes d'intelligence artificielle, l'entreprise Anthropic a publié un rapport détaillé documentant des détournements inédits de son modèle Claude. Entre décembre 2025 et août 2026, la technologie a été exploitée par divers acteurs pour concevoir des armements, manipuler des agents pathogènes et orchestrer des opérations de surveillance à grande échelle.
Des usages militaires et biologiques détournés
Le rapport met en lumière des tentatives d'utilisation de l'IA à des fins de prolifération d'armes. Au Yémen, des cellules rebelles ont sollicité Claude pour la conception de roquettes guidées et de missiles balistiques d'une portée supérieure à 2 000 km, allant jusqu'à analyser les causes d'échecs de tirs. Parallèlement, des développeurs en Russie ont utilisé l'outil pour programmer des essaims de drones kamikazes autonomes. Sur le plan sanitaire, des requêtes ont visé à accroître la dangerosité et la transmissibilité du virus du chikungunya via des mutations génétiques, illustrant les risques biologiques posés par l'accès à une intelligence artificielle avancée.
Surveillance de masse et cyberespionnage
L'IA a également été détournée pour des opérations de contrôle social et d'espionnage. Au Mali, les services de renseignement ont mis au point un dispositif exploitant l'IA pour surveiller environ 25 millions de cartes SIM sans cadre judiciaire. Dans le domaine numérique, des réseaux de propagande basés en Russie, en Iran et en Turquie ont utilisé Claude pour automatiser la création de faux profils. Le rapport souligne également le vol de données sensibles, incluant des identifiants du ministère russe de la Défense et des flux vidéo de sites militaires chinois, ainsi que le décompilage massif d'applications Android par des acteurs malveillants.
Les limites des garde-fous face à la puissance des modèles
Si Anthropic affirme avoir renforcé ses systèmes de sécurité, la majorité des activités illicites identifiées ont fonctionné pendant plusieurs semaines avant d'être neutralisées. L'entreprise reconnaît une réalité préoccupante : la montée en puissance des capacités des modèles d'IA accroît proportionnellement les risques de détournement. En outre, le secteur technologique lui-même est sous tension, avec des entreprises comme DeepSeek ou Alibaba accusées d'avoir siphonné des millions d'échanges de Claude pour entraîner leurs propres modèles, posant ainsi un défi majeur en matière de propriété intellectuelle et de contrôle des flux de données à l'échelle mondiale.