La compa��a ultima el lanzamiento de Astra, su modelo de vanguardia en IA.OpenAI ha anunciado esta semana que las funciones m�s avanzadas de ciberseguridad de su pr�ximo modelo Astra, que se lanzar� pr�ximamente al mercado, s�lo ser�n accesibles por parte de un grupo limitado de evaluadores. OpenAI ha tomado esta decisi�n tras considerar que Astra presenta un riesgo cibern�tico "critico".Se trata de la primera vez que la compa��a clasifica con este nivel de amenaza uno de sus modelos. La empresa ha advertido de que Astra puede detectar brechas de seguridad desconocidas hasta la fecha y explotarlas, sin ning�n tipo de intervenci�n humana, en redes protegidas.OpenAI asegura que ha incorporado nuevas capas de seguridad en Astra para impedir el uso de sus habilidades por parte de cibercriminales. En este sentido, explica que el modelo ha sido entrenado para que rechace peticiones maliciosas y para que evite caer en trampas dise�adas para saltarse sus filtros de seguridad."Nos encontramos claramente en una fase de desarrollo en la que creemos que la precauci�n est� justificada, y marcamos el ritmo de nuestro avance para asegurar que podemos cumplir los est�ndares de seguridad exigidos por los nuevos niveles de capacidad", ha declarado Sam Altman, consejero delegado de OpenAI, en la red social X.Ataque a Hugging FaceOpenAI revel� este verano que agentes inteligentes lograron "escapar" del laboratorio durante su entrenamiento y lanzar ataques contra Hugging Face, un episodio que calific� como un "incidente cibern�tico sin precedentes". La empresa de inteligencia artificial reconoci� recientemente que tard� m�s de una semana en detectar que esta inteligencia artificial hab�a logrado saltarse las restricciones impuestas. El caso ha aumentado la preocupaci�n en la industria sobre el comportamiento de los agentes de IA, sistemas dise�ados para ejecutar tareas complejas con un elevado grado de autonom�a.OpenAI atribuye el episodio a las t�cnicas de entrenamiento que incentivan a los modelos a cumplir objetivos a toda costa, lo que empuj� a los agentes a terminar recurriendo a m�todos no autorizados.La investigaci�n revel� que los agentes hab�an creado por su cuenta un canal de comunicaci�n interno para compartir informaci�n y coordinarse durante las pruebas. A trav�s de ese sistema intercambiaron datos y credenciales que acabaron utilizando para atacar los sistemas de Hugging Face.Su rival Anthropic tambi�n restringi� este a�o el acceso a su modelo m�s avanzado Claude Mythos tras comprobar que era capaz de detectar y explotar vulnerabilidades. La compa��a decidi� limitar el uso de la versi�n preliminar a medio centenar de grandes empresas para ciberdefensa con el fin de que pudieran encontrar y parchear vulnerabilidades en software cr�tico antes de que actores maliciosos desarrollen capacidades similares. Google tambi�n mueve fichaPor su parte, Google ha anunciado hoy Fairwind, un programa restringido para gobiernos, operadores de infraestructuras cr�ticas y empresas de ciberseguridad que les permitir� utilizar sus modelos m�s avanzados para detectar y corregir vulnerabilidades antes de que puedan ser explotadas por ciberdelincuentes. A trav�s de este programa, las organizaciones podr�n utilizar Gemini 3.8 Flash Cyber, un modelo de ciberdefensa que mejora el rendimiento en detecci�n de vulnerabilidades y parcheado automatizado.
OpenAI limitar� el acceso a su inteligencia artificial Astra por su riesgo cibern�tico "cr�tico"
OpenAI ha anunciado esta semana que las funciones m�s avanzadas de ciberseguridad de su pr�ximo modelo Astra, que se lanzar� pr�ximamente al mercado, s�lo ser�n accesibles...
















