Ce document de 154 pages, qui fait suite à trois publications précédentes depuis mars 2025, couvre huit mois d’enquête interne, de décembre 2025 à août 2026. Parmi les cas les plus troublants figurent cinq tentatives distinctes de détournement de Claude à des fins de recherche pouvant faciliter la mise au point d’armes biologiques. Mais le rapport va bien au-delà de ce seul volet, décrivant également des tentatives de conception de missiles, des opérations d’espionnage militaire et des campagnes de surveillance visant des minorités.
Cinq recherches suspectes liées aux armes biologiques
Anthropic affirme avoir identifié et bloqué cinq tentatives de chercheurs cherchant à utiliser Claude pour des travaux susceptibles de faciliter la mise au point d’armes biologiques. L’un des cas, daté de mai 2026, implique un scientifique affilié à un institut de recherche militaire, qui aurait demandé de l’aide pour rédiger une demande de financement portant sur une expérience de gain de fonction concernant le virus du chikungunya, un pathogène transmis par les moustiques pour lequel il n’existe aucun traitement homologué. Un autre cas concerne un programme de recherche visant à adapter une souche hautement pathogène de grippe aviaire à la transmission chez les mammifères, un scénario redouté par les épidémiologistes depuis des années. Dans ce dernier cas, Claude aurait refusé de poursuivre la recherche la plus sensible, ce qui aurait poussé les opérateurs à se tourner vers un autre modèle d’intelligence artificielle pour continuer leurs travaux.
Anthropic précise ne pas toujours être en mesure de distinguer une recherche scientifique légitime d’un projet réellement dangereux, mais indique avoir banni les comptes concernés par précaution dans chacun des cas. L’entreprise souligne également que les versions plus anciennes de ses modèles n’auraient pas offert un niveau d’assistance suffisant pour représenter un risque réel dans ce domaine, ce qui l’a conduite à renforcer ses garde-fous à mesure que ses modèles gagnaient en capacité.
Un missile balistique conçu au Yémen avec l’aide de Claude
Le rapport documente également six affaires liées au développement d’armements conventionnels, une catégorie de menace qu’Anthropic dit observer pour la première fois : trois en Chine, deux en Russie et une au Yémen. Le cas le plus détaillé concerne une cellule basée dans le nord du Yémen, qui aurait mené de front trois programmes : une roquette guidée reposant sur un ordinateur de vol de qualité grand public, un missile balistique à plusieurs étages visant une portée supérieure à 2 000 kilomètres, et une famille de missiles comprenant une variante à planeur hypersonique. Les opérateurs se seraient servis de Claude Code, l’outil de programmation d’Anthropic, en substitution d’ingénieurs humains pour écrire les logiciels de guidage, de navigation et de contrôle, intégrer un pilote automatique et effectuer des simulations de vol. Un tir d’essai de la roquette guidée aurait eu lieu et semble avoir échoué ; les opérateurs seraient revenus vers Claude dans les heures suivantes pour analyser cet échec. Anthropic précise n’avoir trouvé aucune preuve que les opérateurs soient parvenus à déployer une arme réellement opérationnelle, tout en reconnaissant que ses garde-fous n’avaient bloqué qu’une partie de leurs requêtes.
La Chine cible Taïwan, la Russie construit des essaims de drones
En Chine, un acteur associé par Anthropic à un industriel de la défense aurait utilisé Claude pour rédiger une spécification technique de plus de deux cents pages consacrée à un système de lutte anti-torpilles, en vue d’une homologation. Un second cas chinois, plus préoccupant, concerne la construction d’une suite logicielle de guerre électronique et de neutralisation de défenses aériennes, qui modélisait le brouillage radar et classait des cibles par priorité. En cours de projet, le scénario par défaut aurait été modifié pour cibler des objectifs situés à Taïwan, dont un centre de commandement, un site radar d’alerte avancée et des batteries de missiles Patriot et Tien Kung. Un troisième cas chinois porte sur la collecte de renseignements liés aux armes à énergie dirigée.
Côté russe, une équipe vraisemblablement indépendante de l’État aurait développé, à l’aide de Claude Code, un essaim de drones kamikazes de type FPV entièrement autonome, dont le modèle embarqué aurait été entraîné à reconnaître plusieurs catégories de cibles, y compris une catégorie « personne », et à déclencher lui-même l’engagement sans validation humaine, à partir d’images de combat glanées sur le conflit ukrainien.
La traque des Ouïghours en Syrie
Le rapport détaille aussi une opération de surveillance attribuée à un acteur aligné sur le gouvernement chinois, répertoriée sous l’identifiant GTG-14010. Selon Anthropic, cet acteur, dépourvu de compétences en langue arabe, se serait servi de Claude pour repérer, dans plus d’une centaine de groupes WhatsApp et plusieurs dizaines de canaux Telegram, des ressortissants ouïghours présents en Syrie, notamment au sein de formations armées récemment intégrées à la nouvelle armée nationale syrienne. Le modèle aurait ensuite aidé à rédiger, en arabe syrien, des messages destinés à approcher les personnes jugées vulnérables financièrement ou personnellement, à traduire leurs réponses en temps réel, et à jouer le rôle d’un réviseur expert chargé de vérifier la crédibilité de l’opération, dans le but d’obtenir des informations en échange d’argent sur ces unités. Pékin considère de longue date certains groupes armés ouïghours comme une menace sécuritaire directe.
L’Iran cible la marine américaine
Le rapport documente par ailleurs un cas impliquant un acteur lié à l’Iran, qui aurait utilisé Claude pour compiler des « manuels de ciblage » visant les forces navales américaines déployées au Moyen-Orient, croisant identifiants de transpondeurs, images satellite commerciales et listes de sites publics exposant des mouvements de la marine américaine, enrichies d’une liste de personnels identifiés à partir de légendes de photographies militaires publiques. Anthropic dit avoir banni le compte et transmis ses éléments aux autorités gouvernementales américaines.
Quelques repères chiffrés résument l’ampleur du rapport :
- Huit mois d’activité couverts, de décembre 2025 à août 2026
- Six opérations distinctes liées au développement d’armements conventionnels, réparties entre la Chine, la Russie et le Yémen
- Cinq tentatives documentées de détournement à des fins biologiques
- Neuf opérations d’influence recensées, originaires de Russie, d’Iran, de Turquie et d’ailleurs, touchant des publics sur six continents
Washington et Pékin renouent un dialogue sur l’IA
Ce climat de tension a débouché, à la mi-septembre, sur un premier geste diplomatique. Le secrétaire au Trésor américain Scott Bessent a annoncé le 21 septembre que Washington et Pékin avaient formalisé un cadre baptisé « USA-China AI Dialogues », à l’issue d’une session de négociation de douze heures avec le vice-Premier ministre chinois He Lifeng. Les deux délégations se sont donné rendez-vous à Shenzhen dans deux mois. Il s’agit du premier dialogue bilatéral consacré exclusivement à l’intelligence artificielle depuis la réélection de Donald Trump, et il porte notamment sur le partage d’informations relatives aux cyberattaques pilotées par IA, un thème directement nourri par des rapports comme celui d’Anthropic.
Les limites d’une régulation qui n’intervient qu’après coup
Ce que ce rapport met en lumière, au-delà des cas individuels, c’est la difficulté structurelle à encadrer un usage détourné de l’intelligence artificielle. Dans la quasi-totalité des cas cités, la détection est intervenue après que l’activité malveillante avait déjà produit des résultats concrets. Le blocage d’un compte, une fois l’infraction constatée, ne garantit en rien l’arrêt du projet sous-jacent. Cette asymétrie entre la rapidité de détournement et la lenteur de la détection nourrit, depuis plusieurs mois, un débat plus large sur la nécessité d’une régulation internationale de l’intelligence artificielle.
FAQ
Le rapport d’Anthropic est-il public ?
Oui, il est accessible sur le site d’Anthropic, accompagné d’indicateurs techniques de compromission destinés aux professionnels de la cybersécurité.
Ces armes biologiques ont-elles été effectivement fabriquées ?
Non. Le rapport documente des phases de recherche et de planification bloquées avant tout résultat concret, sans qu’aucun agent biologique n’ait été mis au point.
Anthropic a-t-elle confirmé l’identité de tous les groupes impliqués ?
Rarement de façon complète. L’entreprise attribue les activités à des zones géographiques et, dans certains cas, à des profils d’acteurs, sans toujours nommer précisément les organisations responsables.
Pourquoi Anthropic publie-t-elle ce type de rapport ?
L’entreprise indique vouloir donner de la visibilité à des schémas de détournement afin d’aider d’autres développeurs d’IA et les pouvoirs publics à reconnaître des activités similaires sur leurs propres plateformes.