Le site web d’Anthropic, le 26 février 2026. PATRICK SISON/AP

La société américaine d’intelligence artificielle (IA) Anthropic a affirmé dans un communiqué, jeudi 30 juillet, que ses modèles avaient « obtenu un accès non autorisé » à trois organisations, lors de tests pourtant censés les empêcher d’accéder à des systèmes « réels ».

Cette annonce intervient quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.

Anthropic a analysé plus de 141 000 tests et a constaté que trois versions différentes de son modèle Claude avaient accédé aux systèmes de trois organisations, dont les noms n’ont pas été divulgués.

Lire aussi | Article réservé à nos abonnés Deux agents d’IA d’OpenAI se sont échappés et ont piraté plusieurs entreprises : le point sur les faits et les questions qui se posent