Anthropic : l’IA est passée de l’assistance aux cyberattaques à leur orchestration autonome

Anthropic a publié vendredi son troisième rapport de renseignement sur les menaces, détaillant comment des acteurs malveillants ont tenté de weaponiser ses modèles Claude entre décembre 2025 et août 2026 — et comment l'entreprise a contrecarré ces tentatives dans sept catégories de préjudices.
L'escalade la plus significative documentée est le passage de l'IA de simple assistant à orchestrateur d'attaques. Une opération qu'Anthropic suit sous le nom GTG-20006 — dont les tactiques correspondent au groupe russe Midnight Blizzard — a déployé des workflows pilotés par IA sur toute la chaîne d'attaque : reconnaissance, infrastructure de phishing, exploitation, vol de credentials, mouvement latéral et exfiltration de données. Dans un cas distinct, des agents IA ont surveillé les détections de leurs propres logiciels malveillants par les outils de sécurité et ont automatiquement reconstruit le code pour échapper à la détection.
Tentatives d'armes biologiques bloquées
Anthropic a bloqué cinq tentatives d'utiliser Claude pour de la recherche potentiellement liée aux armes biologiques, impliquant le chikungunya, la grippe aviaire et la variole. Un cas comprenait une demande d'aide pour rédiger une demande de subvention pour de la recherche gain-of-function visant à augmenter la transmissibilité du chikungunya.
En réponse, Anthropic a restreint l'accès à ses modèles de biologie les plus avancés aux organisations vérifiées et a partagé ses résultats avec les autorités gouvernementales et les partenaires industriels.
Sept laboratoires chinois ont tenté une distillation illicite
Le rapport documente également la distillation illicite du modèle par sept laboratoires d'IA basés en Chine. Les modèles Claude Haiku, Sonnet et Opus ont été impliqués dans la plupart des cas ; un cas de distillation a impliqué un modèle de classe Fable ou Mythos.
Au-delà des opérations cyber et des armes biologiques, le rapport couvre les opérations d'influence, les systèmes de surveillance de dissidents, les arnaques et la recherche sur les armes conventionnelles.
L'avertissement général
La préoccupation centrale d'Anthropic est la démocratisation des capacités offensives : à mesure que les modèles IA deviennent plus puissants, des attaques sophistiquées n'exigeront plus de compétences techniques avancées, permettant à des individus isolés de tenter des menaces auparavant réservées à des équipes bien financées.
Source : Rapport de renseignement sur les menaces d'Anthropic, septembre 2026
Initialement rapporté par Anthropic. Lisez l'article original pour plus de détails.
Voir la source originale