Nya test visar hur OpenAI:s och Anthropics AI-modeller passerat flera gränser och riktat potentiellt skadlig aktivitet mot både privatpersoner och organisationer. Det meddelar Storbritanniens AI-institut.

AI-företaget Anthropic avslöjar att flera av dess Claude-modeller har tagit sig ut ur isolerade testmiljöer och fått obehörig åtkomst till system hos tre verkliga organisationer.…

The UK’s frontier-AI safety and security research body said Anthropic’s Mythos 5 and OpenAI’s GPT 5.6 Sol engaged in “sustained, potentially harmful activity”.