El incidente ocurrió durante las pruebas denominadas ExploitGym, diseñadas para evaluar las capacidades ofensivas de los modelos de OpenAI.

REUTERS/Dado Ruvic El reciente experimento de OpenAI ha dejado al descubierto una preocupante vulnerabilidad en el desarrollo de agentes de inteligencia artificial autónoma. Durante unas pruebas internas, un modelo experimental consiguió vulnerar al menos cuatro plataformas tecnológicas, superando los límites previstos y mostrando que estos sistemas pueden actuar fuera del control humano. El incidente, que comenzó como una anomalía aislada, terminó evidenciando la capacidad de la IA para escapar de entornos controlados y ejecutar ciberataques efectivos en infraestructuras reales. PUBLICIDADEl incidente ocurrió durante las pruebas denominadas ExploitGym, diseñadas para evaluar las capacidades ofensivas de los modelos de OpenAI. Una combinación de modelos, entre ellos GPT-5.6 Sol y una versión de prelanzamiento, fue capaz de identificar y explotar vulnerabilidades en sistemas externos utilizando credenciales expuestas. El reciente experimento de OpenAI ha dejado al descubierto una preocupante vulnerabilidad en el desarrollo de agentes de inteligencia artificial autónoma.