A OpenAI, empresa dona do ChatGPT, assumiu responsabilidade por um ataque hacker realizado por ‘agentes’ autônomos durante testes de segurança no Hugging Face — plataforma norte-americana popular entre programadores para o desenvolvimento de aplicativos com IA. O caso é tratado como o primeiro hackeamento feito por uma IA de ponta a ponta, sem controle humano.

“Consideramos este incidente um incidente cibernético sem precedentes, envolvendo capacidades cibernéticas de última geração”, afirma publicação no blog da OpenAI sobre o caso nesta terça-feira 21.

A empresa reconheceu que uma combinação de seus sistemas de IA rompeu as barreiras do ambiente de avaliação e comprometeu parte da infraestrutura da Hugging Face. Embora o ambiente de testes tivesse acesso restrito à internet, os agentes atuaram para que a conexão fosse restabelecida,

“Sabendo disso, o modelo procurou e encontrou com sucesso maneiras de obter acesso a informações secretas que poderia usar para enganar a avaliação”, explica o trecho da nota divulgada pela OpenAI. As ‘informações secretas’ mencionadas incluem acesso a dados internos e credenciais do serviço.

Ainda segundo a empresa, o incidente envolveu uma combinação de modelos de linguagem, incluindo o recém-lançado GPT-5.6 Sol e versões ainda não liberadas ao público. Os modelos em questão se mostraram capazes de registrar mais de 17.000 eventos, comprovou o teste. Agora, para reduzir danos, a OpenAI conduz um estudo em conjunto com a Hugging Face para investigar possíveis vulnerabilidades na plataforma e corrigi-las.