NoticiaLa compañía calificó el hecho como un incidente sin precedentes y anunció cambios en sus protocolos de seguridad.Estas son las novedades. Foto: Open IA.PERIODISTA23.07.2026 16:04 Actualizado: 23.07.2026 16:04
OpenAI reveló que dos de sus modelos de inteligencia artificial protagonizaron un incidente sin precedentes al escapar del entorno de pruebas en el que estaban siendo evaluados, según detalló The New York Times, al conectarse a internet por cuenta propia y ejecutar un ataque informático contra la plataforma Hugging Face, una de las mayores bibliotecas de modelos de IA del mundo. LEA TAMBIÉN El episodio ocurrió la semana pasada durante una evaluación interna diseñada para medir las capacidades de ciberseguridad de sus sistemas. Según explicó la compañía, los modelos consiguieron vulnerar las restricciones del llamado sandbox —un entorno aislado utilizado para realizar pruebas seguras— y actuaron sin intervención humana.De acuerdo con OpenAI, la prueba combinaba el modelo GPT-5.6 Sol con otro sistema más avanzado que aún no ha sido lanzado al público. El objetivo era medir si ambos podían encadenar vulnerabilidades y completar un ciberataque dentro de un ambiente controlado.Sin embargo, los modelos encontraron una falla que les permitió escapar del entorno de pruebas y acceder a internet. Una vez fuera, identificaron a Hugging Face como un objetivo potencial al deducir que la plataforma, que alberga millones de modelos de inteligencia artificial, podía contener información útil para superar la evaluación que estaban realizando.La empres describió el episodio como "un incidente cibernético sin precedentes, que involucra capacidades cibernéticas de vanguardia", y aseguró que ya implementa controles más estrictos sobre su infraestructura, aun cuando ello implique ralentizar el desarrollo de futuras investigaciones mientras corrige las vulnerabilidades detectadas.OpenAI también confirmó que trabaja conjuntamente con Hugging Face para solucionar las fallas que permitieron el ataque.La IA automatiza tareas, pero las ideas originales nacen de las personas. Foto:ISTOCKLa semana anterior, Hugging Face había informado que detectó una intrusión en sus sistemas y que esta había sido provocada por un sistema autónomo, aunque en ese momento no reveló que el responsable era un modelo desarrollado por OpenAI.El director ejecutivo de Hugging Face, Clem Delangue, señaló que ambas compañías colaboraron estrechamente durante las 24 horas posteriores al incidente para contener la situación."Este incidente, posiblemente el primero de su tipo, demuestra algo que hemos creído desde hace tiempo: la seguridad de la IA no será resuelta por una sola empresa que trabaje en secreto", afirmó Delangue.El caso pone de relieve las advertencias que los propios desarrolladores de inteligencia artificial han realizado durante el último año sobre los riesgos que representan estos sistemas cuando adquieren mayor autonomía para ejecutar tareas complejas.Empresas como OpenAI y Anthropic han desarrollado modelos especializados en ciberseguridad capaces de detectar vulnerabilidades, automatizar procesos y encontrar fallas en sistemas informáticos. Al mismo tiempo, han advertido que esa misma capacidad podría ser utilizada para realizar ataques cada vez más sofisticados.Clem Delangue, Cofundador y CEO de Hugging Face Foto:Hugging FacePara Alex Levinson, consultor especializado en ciberseguridad y capacidades autónomas, el incidente marca un cambio importante en la evolución de estas tecnologías."Ese es un verdadero umbral, y se convertirá en una parte normal del panorama de seguridad", afirmó.La profesora Deirdre Mulligan, especialista en seguridad e inteligencia artificial de la Universidad de California en Berkeley, cuestionó la forma en que OpenAI diseñó el entorno de pruebas."Me parece que OpenAI no creó de forma adecuada un 'sandbox' como entorno de pruebas", sostuvo. También planteó interrogantes sobre el balance entre los beneficios de realizar este tipo de experimentos y el riesgo de que un sistema de IA logre escapar hacia internet."¿Qué ganamos y, si esta es la única forma en que se pueden configurar estas pruebas, cuáles son los riesgos?", preguntó.Los avances en inteligencia artificial aplicada a la programación han convertido estos modelos tanto en herramientas para reforzar la defensa informática como en posibles instrumentos para los ciberataques.En abril, Anthropic presentó Mythos, un modelo especializado en ciberseguridad disponible inicialmente para un grupo reducido de organizaciones. Posteriormente, OpenAI lanzó su propio sistema orientado a fortalecer las defensas digitales antes de ampliar gradualmente su acceso. Este martes, Google también anunció el desarrollo de un modelo enfocado en ciberseguridad que comenzó a ser probado con un grupo limitado de socios.Las empresas tecnológicas terminaron utilizando esas herramientas para fortalecer sus sistemas. Foto:Gorodenkoff Productions OURichard Barnes, investigador independiente que ha trabajado con el modelo Mythos, comparó la situación con la aparición de los llamados fuzzers hace más de una década, herramientas que automatizaron la búsqueda de vulnerabilidades en programas informáticos.Según Barnes, las empresas tecnológicas terminaron utilizando esas mismas herramientas para fortalecer sus sistemas y reducir el número de ataques exitosos. En su opinión, ahora la industria deberá seguir un camino similar con la inteligencia artificial para anticiparse a que estas capacidades sean aprovechadas por actores maliciosos. LEA TAMBIÉN LEA TAMBIÉN Sigue toda la información de Economía en Facebook y Twitter, o en nuestra newsletter semanal.










