Publié le 31 juillet 2026 à 03:30.

2 min. de lecture

La start-up américaine d’intelligence artificielle (IA) Anthropic a affirmé jeudi dans un communiqué que ses modèles avaient «obtenu un accès non autorisé» à trois organisations lors de tests pourtant censés les empêcher d’accéder à des systèmes «réels».Cette annonce intervient quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.

Lire aussi: La créature de Frankenstein, une IA extrême et maudite

Anthropic a analysé plus de 141 000 tests et a constaté que trois versions différentes de son modèle Claude avaient accédé aux systèmes de trois organisations, dont les noms n’ont pas été divulgués.Contrairement à l’incident impliquant OpenAI, les modèles d’Anthropic ont eu accès à Internet «en raison d’un malentendu entre nous et notre partenaire d’évaluation», Irregular, a expliqué le groupe dans le communiqué. «Dans aucune de ces situations, Claude ne s’est échappé ni n’a délibérément tenté de s’échapper de son environnement de test», a-t-il ajouté.