TECNOLOG�AGPT-5.6 Sol y un modelo a�n sin lanzar escaparon del entorno de pruebas, alcanzaron internet explotando una vulnerabilidad y asaltaron los servidores de Hugging Face para hacer trampas en un test de ciberseguridad. OpenAI lo describe como "un incidente sin precedentes"Inteligencia artificial desarrollada por OpenAI.EL MUNDOActualizado Mi�rcoles,

julio

00:36La semana pasada, un agente aut�nomo se col� en la infraestructura de Hugging Face, un popular repositorio de modelos abiertos de inteligencia artificial. OpenAI ha reconocido ahora que el agente era suyo. En una publicaci�n en su blog, la compa��a ha confesado que dos de sus modelos, sometidos a una evaluaci�n interna de capacidades ofensivas, se salieron del entorno aislado en el que estaban confinados y terminaron comprometiendo parte de los servidores de producci�n de la plataforma. Lo hicieron para tratar de conseguir una mayor puntuaci�n en un test de ciberseguridad que mide lo avanzadas que pueden ser las inteligencias artificiales utilizadas de forma ofensiva.Hugging Face hab�a hecho p�blico el incidente el 16 de julio y lo atribuy� entonces a un "sistema de agente de IA aut�nomo" de origen desconocido. El agente ejecut� decenas de miles de acciones automatizadas durante un fin de semana que los responsables de la plataforma llegaron a reconstruir a partir de los rastros que dejaron.Seg�n OpenAI, en el ataque intervino una combinaci�n de modelos: GPT-5.6 Sol, su modelo p�blico m�s potente, y otro a�n m�s capaz que todav�a no ha salido al mercado. A ambos se les hab�an rebajado deliberadamente los mecanismos de seguridad porque el objetivo de la prueba era medir precisamente hasta d�nde llegan sus capacidades ofensivas sin frenos.La prueba se llamaba ExploitGym, un banco de pruebas p�blico con cerca de 900 vulnerabilidades reales de software que exige a los agentes de IA convertir un fallo documentado en un exploit funcional. Los modelos deb�an resolverlo dentro de un sandbox (un entorno operativo con barreras) y con el acceso a la red limitado. S�lo pod�an instalar programas a trav�s de un proxy interno que hac�a de cach� para los repositorios de software.Ese proxy se convirti� en la puerta de salida. Los modelos dedicaron una cantidad importante de c�mputo a buscar una v�a hacia la internet abierta y la encontraron explotando una vulnerabilidad de d�a cero en ese software de terceros alojado internamente, un fallo que OpenAI dice haber comunicado ya al fabricante. A partir de ah�, escalaron privilegios y se movieron por el entorno de investigaci�n de la propia OpenAI hasta alcanzar un nodo con conexi�n a la red.Una vez fuera, los modelos dedujeron que Hugging Face probablemente alojaba las soluciones del propio ExploitGym y encadenaron credenciales robadas y nuevas vulnerabilidades hasta encontrar una v�a de ejecuci�n remota de c�digo en los servidores de la plataforma, con el fin de obtener las respuestas de la prueba directamente de su base de datos de producci�n.Seg�n OpenAI, nadie orden� a los modelos atacar a Hugging Face. Su objetivo era pasar una prueba. Al reconocer que el camino m�s eficiente para hacerlo pasaba por robar las soluciones, montaron una operaci�n de intrusi�n de varios pasos en sistemas reales, sin acceso al c�digo fuente, y persiguieron esa meta con lo que OpenAI describe como una "fijaci�n extrema"."Sin precedentes"La compa��a considera que se trata de un incidente "sin precedentes" y ha incorporado a Hugging Face a su programa de acceso preferente para ciberdefensa.Clem Delangue, cofundador y m�ximo responsable de Hugging Face, ha agradeci� la colaboraci�n y aprovech� para reivindicar su modelo abierto: "Este incidente, posiblemente el primero de su tipo, demuestra algo que llevamos tiempo defendiendo: la seguridad de la IA no la resolver� ninguna empresa trabajando en secreto", dijo.Aunque se trata del primer ataque de un modelo "rebelde", no es el primero que escapa de entornos de prueba que deber�an estar cerrados. Hace unos d�as, OpenAI confes� haber pausado el desarrollo de un modelo a�n sin lanzar despu�s de que escapara de su sandbox y publicara c�digo en la plataforma GitHub. Su rival, Anthropic, tambi�n reconoci� hace semanas que su modelo Mythos burl� un entorno de pruebas durante una evaluaci�n de seguridad para conseguir acceso a la red y enviar un correo a un investigador.OpenAI dice que endurecer� los controles de sus entornos de evaluaci�n aunque eso ralentice su ritmo de investigaci�n, y que compartir� m�s detalles cuando la investigaci�n conjunta con Hugging Face concluya.