La jeune pousse américaine d’intelligence artificielle (IA) Anthropic a affirmé jeudi dans un communiqué que ses modèles avaient « obtenu un accès non autorisé » à trois organisations lors de tests pourtant censés les empêcher d’accéder à des systèmes « réels ».Cette annonce intervient quelques jours seulement après que son rival OpenAI a révélé que deux de ses modèles étaient sortis, de leur propre initiative, du milieu confiné dans lequel ils étaient testés pour attaquer le site Hugging Face.Anthropic a analysé plus de 141 000 tests et a constaté que trois versions différentes de son modèle Claude avaient accédé aux systèmes de trois organisations, dont les noms n’ont pas été divulgués.Contrairement à l’incident impliquant OpenAI, les modèles d’Anthropic ont eu accès à Internet « en raison d’un malentendu entre nous et notre partenaire d’évaluation », Irregular, a expliqué le groupe dans le communiqué.« Dans aucune de ces situations, Claude ne s’est échappé ni n’a délibérément tenté de s’échapper de son environnement de test », a-t-il ajouté.
In a review of our cybersecurity evaluations, we found three incidents in which a Claude model reached the internet from within or while interacting with a third-party evaluation environment, and then gained unauthorized access to the real systems of three different…— Anthropic (@AnthropicAI) July 30, 2026










