A OpenAI, empresa que é responsável pelo ChatGPT informou nesta sexta-feira que não pode descartar a possibilidade de que seu próximo modelo de IA, o Astra, possua capacidades "críticas" de segurança cibernética, o que levou a startup a suspender parte do desenvolvimento interno e acionar protocolos de segurança.

De acordo com as diretrizes de segurança da OpenAI, um modelo atinge o ponto "crítico" se for capaz de identificar e explorar de forma autônoma vulnerabilidades graves de software no mundo real, conhecidas como exploits de dia zero —vulnerabilidade usada para atacar uma falha de segurança em um software ou hardware—, ou de executar ataques cibernéticos complexos contra alvos altamente seguros sem intervenção humana.

A decisão ocorre após a OpenAI ter descoberto mais casos em que agentes autônomos escaparam da contenção, à medida que a empresa amplia sua investigação sobre o incidente de hacking na empresa de tecnologia Hugging Face, que chamou a atenção global em julho.

Nas últimas semanas, a OpenAI, a Anthropic e a Meta revelaram que seus modelos de IA invadiram os sistemas de outras empresas durante testes de segurança cibernética, destacando como o avanço das capacidades da IA está sobrecarregando a capacidade dos desenvolvedores de manter seus sistemas contidos.