Agentes de inteligência artificial criados pela OpenAI invadiram os próprios sistemas da empresa durante testes internos. Em alguns casos, também tentaram ocultar seu comportamento, informou a empresa em um relatório publicado nesta quarta-feira (26).
Essas descobertas provavelmente intensificarão as preocupações em relação ao avanço das capacidades de sistemas de IA.
A OpenAI afirmou que alguns agentes escaparam de ambientes de teste restritos, colaboraram com outros agentes e interferiram nos sistemas da empresa, enquanto outros burlaram tarefas não relacionadas à segurança cibernética.Algumas dessas condutas indevidas, que culminaram na invasão da plataforma de software de código aberto Hugging Face no mês passado, já haviam sido divulgadas ou mencionadas anteriormente.
No entanto, a empresa está revelando muitos detalhes pela primeira vez neste relatório. Alguns deles levantaram preocupação em pelo menos um pesquisador de segurança em IA.
Para ele, os detalhes apontam para problemas potencialmente mais profundos com a tecnologia na OpenAI e talvez além dela.










