AI-företaget Anthropic avslöjar att flera av dess Claude-modeller har tagit sig ut ur isolerade testmiljöer och fått obehörig åtkomst till system hos tre verkliga organisationer. Händelserna är de senaste i en serie avslöjanden om autonoma AI-agenters förmåga att agera gränslöst.

Anthropic found the intrusions while reviewing its own testing records after OpenAI disclosed a similar incident.

Three Claude models were inadvertently given access to the internet during security evaluations, and each model took a different approach to hacking external systems.