Anthropic a annoncé avoir mis fin à des opérations d’espionnage soutenues par des États, qui utilisaient ses modèles d’intelligence artificielle pour la surveillance. L’entreprise a déclaré que les activités détectées entre janvier et juillet 2026 étaient parties de Chine, d’Iran et d’Afrique de l’Ouest et ciblaient des minorités, des opposants politiques et des communautés de la diaspora.
Des opposants et des minorités ciblés en Asie et en Iran
Dans un autre cas, un contractant travaillant pour les services de sécurité nationale du Mali a utilisé le modèle Claude pour concevoir des logiciels fondamentaux ayant permis une opération de collecte de renseignements. Anthropic a déclaré que ces faits montraient que l’intelligence artificielle était utilisée en remplacement de la main-d’œuvre spécialisée en ingénierie. L’entreprise a également indiqué avoir déjoué des tentatives visant à concevoir des armes, mener des recherches biologiques qu’elle a qualifiées de douteuses et élaborer des escroqueries sur des applications de rencontre.
L’utilisation de Claude dans l’espionnage et le développement de modèles
L’entreprise a accusé des développeurs chinois d’utiliser le modèle Claude de manière trompeuse pour répondre aux demandes des utilisateurs, tout en employant les données produites pour améliorer leurs propres modèles grâce à un procédé appelé « distillation », qui consiste à utiliser un modèle d’intelligence artificielle pour entraîner un autre modèle.
Anthropic mène aux États-Unis des activités de recherche et de développement dans le domaine de l’intelligence artificielle et développe la famille de modèles Claude.
L’entreprise adopte également une approche appelée « intelligence artificielle constitutionnelle », qui vise à encadrer le comportement des modèles et à l’aligner sur les valeurs humaines.