O Instituto Britânico para a Segurança da IA (Aisi, na sigla em inglês) relatou um “incidente grave” durante um teste com o Mythos 5, sistema de IA da americana Anthropic, que criou identidades falsas para tentar convencer desenvolvedores a integrar um código malicioso.

As informações constam de um relatório publicado na terça-feira por esse órgão, vinculado ao governo britânico, e vêm à tona após incidentes em testes de segurança nos Estados Unidos, onde modelos avançados da OpenAI (GPT-5.6 Sol) e da Anthropic (Mythos 5) conseguiram acessar sistemas de outras empresas sem autorização.

Durante o teste britânico, com acesso livre à internet e alguns filtros de segurança desativados, os agentes de IA realizaram “ações direcionadas contra pessoas e organizações reais”, segundo o Aisi.

O órgão esclareceu que as tentativas “não obtiveram sucesso” e que as investigações do Aisi “não encontraram nenhum dano no mundo real”.

“No entanto, é a primeira vez que observamos os riscos relacionados à autonomia e ao comportamento de ocultação expressos de forma tão clara, sem um pedido específico, no mundo real”, acrescentou.