L’entreprise Anthropic a annoncé jeudi avoir stoppé plusieurs opérations de surveillance menées contre des dissidents et des minorités ethniques à l’aide de son assistant d’intelligence artificielle (IA) Claude.Ces incidents, détectés et neutralisés entre janvier et juillet, provenaient de Chine, d’Iran et d’Afrique de l’Ouest, selon un rapport d’Anthropic consacré aux différents détournements de ses modèles.Ces campagnes de surveillance « ont visé les mêmes communautés de la diaspora et les mêmes dissidents que ces régimes ciblent historiquement, notamment des figures prodémocratie à Hong Kong, les communautés tibétaines et du Falun Gong à travers l’Asie, ainsi que des minorités iraniennes et des opposants au régime iranien à l’étranger », indique le rapport.Dans un cas, des acteurs iraniens ont mis au point un moyen d’identifier des personnes à partir de leurs comptes sur les réseaux sociaux. Dans un autre, un prestataire travaillant pour les autorités de sécurité nationale du Mali a utilisé Claude « pour concevoir le logiciel sur lequel reposait la collecte de renseignements ».Anthropic rapporte également avoir déjoué des tentatives de concevoir des armes, de mener des recherches biologiques douteuses ou de créer de fausses applications de rencontre afin d’escroquer les utilisateurs.L’entreprise de San Francisco accuse aussi nommément les chinois Moonshot et DeepSeek d’avoir utilisé Claude en cachette pour répondre aux questions de leurs utilisateurs, tout en récupérant les résultats pour améliorer leurs propres modèles.Des développeurs chinois avaient déjà été accusés de recourir sans autorisation à cette pratique, la « distillation », aux dépens de laboratoires américains comme Anthropic et OpenAI.
Anthropic dit avoir stoppé des opérations de surveillance en Chine et en Iran
Des tentatives de concevoir des armes et de créer de fausses applications de rencontre ont été déjouées.
Anthropic a stoppé opérations de surveillance en Chine, Iran et Afrique de l'Ouest contre dissidents et minorités; Moonshot a aussi détourné 300.000 requêtes de clients via 5.380 comptes frauduleux. Signal critique pour les manager IT: risque majeur de détournement et abuse des modèles distribués sans gouvernance appropriée – durcir la compliance et le monitoring API est urgent.










