Contrairement à l’incident impliquant OpenAI, Claude n’aurait, selon ses créateurs, pas « délibérément tenté de s’échapper de son environnement de test » mais seulement eu accès à Internet « en raison d’un malentendu » avec un partenaire d’évaluation.

Anthropic a révélé jeudi que trois versions de son modèle Claude avaient obtenu un accès non autorisé à trois organisations lors de tests censés les confiner. Cet incident…

Falha deu ao modelo de IA acesso à internet durante exercícios de segurança isolados