Criadora do ChatGPT afirmou que trabalhará com agências governamentais e organizações de segurança de IA para testar as capacidades do modelo Astra 0.5x 1x 1.25x 1.5x 2x 00:00 00:00 A OpenAI suspendeu alguns trabalhos internos relacionados a um de seus futuros modelos de inteligência artificial para implementar medidas de segurança mais rigorosas, após o sistema ter se mostrado significativamente mais eficiente em tarefas de segurança cibernética. Nesta sexta-feira (7), a empresa criadora do ChatGPT afirmou que "não pode descartar" a possibilidade de o modelo Astra, ainda não lançado, atingir o "limiar crítico de cibersegurança" da OpenAI, o que significa que ele é capaz de identificar e desenvolver exploits de dia zero (ataque que usa falha de segurança que o desenvolvedor do sistema atacado não conhece) sem intervenção humana. A OpenAI afirmou que está tomando medidas para aprimorar os controles de segurança para o desenvolvimento e teste de modelos mais recentes e "suspendendo as atividades internas envolvendo o Astra que ainda não atendem a esses requisitos de controle de segurança reforçados". Nas últimas duas semanas, a OpenAI e a Anthropic admitiram publicamente que invadiram inadvertidamente os sistemas de diversas instituições, incluindo a Hugging Face, durante os testes de seus modelos. A Meta também afirmou na quarta-feira (5) que seu modelo de IA recém-lançado havia se infiltrado no sistema de computador de terceiros. As últimas revelações servem como novas evidências de que os agentes de IA são capazes de agir de forma autônoma de maneiras que nem mesmo pesquisadores treinados para identificar vulnerabilidades na tecnologia conseguem mais prever, ressaltando a necessidade de uma triagem de segurança mais rigorosa e de ambientes de teste mais à prova de falhas. Em sua postagem no blog, a OpenAI afirmou que trabalhará com agências governamentais e organizações de segurança de IA para testar as capacidades do Astra. A empresa também planeja fornecer recomendações a parceiros de teste terceirizados sobre maneiras de avaliar com segurança seus modelos mais avançados. OpenAI — Foto: Levart_Photographer/Unsplash