A Anthropic disse nesta quinta-feira (30) que seu modelo de inteligência artificial Claude invadiu os sistemas de três empresas durante testes após um erro de configuração ter dado ao modelo acesso à internet. O ataque ocorre dias após a rival OpenAI ter divulgado um episódio semelhante envolvendo a empresa de IA Hugging Face.
A Anthropic afirmou que uma falha de configuração permitiu que os modelos Claude acessassem a internet a partir de ambientes de teste que deveriam estar isolados. Isso levou ao acesso não autorizado aos sistemas de três organizações.
Os casos mais antigos remontam a abril e ocorreram em ambientes de avaliação que careciam do que a empresa descreveu como salvaguardas padrão.
Ícone do Claude na tela de um celular - Dado Ruvic - 5.jun.26/Reuters
A empresa disse ter identificado os incidentes após revisar 141.006 sessões de teste. O processo de revisão começou após a divulgação do caso envolvendo a OpenAI. Na semana passada, um agente autônomo da dona do ChatGPT, alimentado por seus modelos de IA, escapou de um ambiente isolado durante um teste de segurança e realizou uma invasão que comprometeu a infraestrutura da Hugging Face.










