Nya test visar hur OpenAI:s och Anthropics AI-modeller passerat flera gränser och riktat potentiellt skadlig aktivitet mot både privatpersoner och organisationer. Det meddelar Storbritanniens AI-institut.

AI-företaget Anthropic avslöjar att flera av dess Claude-modeller har tagit sig ut ur isolerade testmiljöer och fått obehörig åtkomst till system hos tre verkliga organisationer.…

AISI’s third-party evaluations found that OpenAI’s GPT-5.6 Sol and Anthropic’s Claude Mythos 5 “engaged in sustained, potentially harmful activity directed at real people and…