Les deux géants américains OpenAI et Anthropic ont dévoilé publiquement des failles de sécurité survenues en environnement contrôlé. Une stratégie de communication qui leur permet d’appeler à réguler l’IA tout en démontrant sa puissance

La start-up assure qu'il s'agit d'une erreur de configuration, et non d'une tentative de son IA de quitter son environnement de test.

Anthropic révèle que plusieurs versions de son IA Claude ont accédé à des systèmes réels lors de tests de sécurité, à la suite d’une erreur dans l’environnement d’évaluation.