La compa��a de inteligencia artificial ha reconocido que sus agentes de IA hackearon a la empresa sin intervenci�n humana. OpenAI ha confirmado que una combinaci�n de sus modelos de inteligencia artificial, GPT-5.6 Sol y un modelo a�n no publicado, son los culpables de un incidente de seguridad que la start up Hugging Face.La compa��a hab�a denunciado la semana pasada un ataque inform�tico realizado por un agente de IA que hab�a comprometido su infraestructura. Seg�n el comunicado oficial de OpenAI, el episodio se produjo durante una evaluaci�n interna dise�ada para medir las capacidades cibern�ticas de sus modelos y que se ejecuta sin los clasificadores de producci�n que normalmente impiden a los modelos llevar a cabo actividad cibern�tica de alto riesgo. C�mo ocurri�Los modelos identificaron y encadenaron vulnerabilidades tanto en el entorno de investigaci�n de OpenAI como en la infraestructura de producci�n de Hugging Face para obtener directamente las soluciones de un test interno llamado ExploitGym. Todo apunta a que los modelos se centraron de forma obsesiva en resolver ese test, llegando a lograr un objetivo de evaluaci�n relativamente acotado. Mientras operaban en el entorno de pruebas aislado, los modelos dedicaron una cantidad sustancial de c�mputo de inferencia a buscar la forma de conseguir acceso a internet abierto, con el fin de resolver el problema de evaluaci�n. Una vez con conexi�n, el modelo dedujo que Hugging Face pod�a alojar los modelos, conjuntos de datos y soluciones de ExploitGym, por lo que busc� y encontr� la manera de acceder a informaci�n secreta que le permitiera hacer trampa en la evaluaci�n, combinando credenciales robadas con vulnerabilidades de d�a cero hasta dar con una v�a de ejecuci�n remota de c�digo en los servidores de Hugging Face. Fue el propio equipo de seguridad de OpenAI el que detect� internamente esta actividad an�mala, mientras que el equipo y los agentes de seguridad de Hugging Face ya hab�an detectado y detenido la actividad en su infraestructura, e iniciado su propia investigaci�n forense con modelos de c�digo abierto, antes de que ambos equipos se coordinaran. OpenAI ha anunciado varias medidas a raiz de este incidente, como implementar controles m�s estrictos en la configuraci�n de su infraestructura, aunque suponga sacrificar velocidad de investigaci�n, mientras se parchean las vulnerabilidades. La compa��a est� colaborando con Hugging Face en la investigaci�n forense e incorporar�n a la compa��a a su programa de acceso confiable en ciberseguridad para ayudar a reforzar sus defensas. Modelos cada vez m�s potentesEl incidente entre OpenAI y Hugging Face es un s�ntoma de una tendencia en el sector con los grandes laboratorios de IA convirtiendo la ciberseguridad en uno de los terrenos donde m�s r�pido avanzan sus modelos. Anthropic fue de las primeras en marcar ese cambio de escala. Claude Mythos Preview demostr� que era capaz de identificar y explotar de forma completamente aut�noma una vulnerabilidad de ejecuci�n remota de c�digo de 17 a�os de antig�edad sin que ning�n humano interviniera ni en el descubrimiento ni en la explotaci�n del fallo tras la petici�n inicial. Dada esa potencia, la compa��a opt� por no lanzar el modelo abiertamente. Mythos y su sucesor, Mythos 5, se consideran modelos con capacidades de ciberseguridad significativamente m�s fuertes, especialmente en el razonamiento sobre exploits, por lo que su acceso inicial se limita a un peque�o grupo de socios a trav�s del llamado Project Glasswing. Para el resto de usuarios, Anthropic ofrece Claude Security, una herramienta que ya ha encontrado m�s de 500 vulnerabilidades en c�digo abierto en producci�n, fallos que hab�an pasado desapercibidos durante d�cadas pese a a�os de revisi�n experta.Google, por su parte, acaba de dar un paso similar. Esta misma semana present� Gemini 3.5 Flash Cyber, un modelo especializado que solo estar� disponible inicialmente para gobiernos y un grupo reducido de socios de confianza, dada la sensibilidad de sus capacidades, y que est� afinado espec�ficamente para encontrar, validar y parchear vulnerabilidades de software m�s r�pido y de forma m�s eficiente que los modelos Gemini Flash convencionales. Cuanto m�s potentes se vuelven los modelos, mayor es su capacidad tanto para encontrar vulnerabilidades como para explotarlas, lo que obliga a las propias compa��as a restringir el acceso a sus versiones m�s avanzadas y a reforzar los entornos de prueba donde se eval�an.
Los modelos de IA de OpenAI hackean de forma aut�noma la start up Hugging Face
OpenAI ha confirmado que una combinaci�n de sus modelos de inteligencia artificial, GPT-5.6 Sol y un modelo a�n no publicado, son los culpables de un incidente de seguridad que...










