Hace apenas unos días, OpenAI reconocía que las capacidades de Astra, uno de sus próximos modelos de inteligencia artificial, habían avanzado tanto en materia de ciberseguridad que la compañía no podía descartar que hubiese alcanzado su nivel de riesgo más alto. La respuesta fue endurecer los controles y paralizar las actividades internas con el modelo que todavía no cumplieran esas nuevas medidas de seguridad.Ahora, solo tres días después, la compañía da un paso que, al menos sobre el papel, puede parecer contradictorio: ha presentado GPT-5.6-Cyber, un nuevo modelo especializado precisamente en algunas de esas capacidades. Puede buscar vulnerabilidades desconocidas, desarrollar exploits y construir cadenas de ataques capaces de aprovechar varios fallos de seguridad de forma consecutiva.La diferencia está en un detalle importante. OpenAI asegura que GPT-5.6-Cyber no ha alcanzado el nivel 'Critical' que preocupa en el caso de Astra, sino que permanece en el escalón inmediatamente inferior, denominado 'High'. Y, además, no estará disponible de forma general para cualquier usuario, sino a través de un programa de acceso restringido destinado a profesionales de la ciberseguridad.Una IA entrenada para negarse mucho menosGPT-5.6-Cyber parte de GPT-5.6 Sol, pero ha sido entrenado específicamente para mejorar en trabajos avanzados de ciberseguridad. Entre ellos están la búsqueda de vulnerabilidades de día cero (fallos desconocidos para los desarrolladores y para los que todavía no existe un parche) o el desarrollo de cadenas de exploits, es decir, combinar diferentes vulnerabilidades para conseguir un ataque más complejo.Pero hay otra diferencia especialmente relevante: OpenAI ha entrenado al modelo para que se niegue mucho menos a realizar determinadas tareas de alto riesgo.Los modelos de propósito general cuentan normalmente con barreras que bloquean peticiones relacionadas con ataques informáticos porque una misma técnica puede servir tanto para comprobar la seguridad de un sistema como para atacarlo. GPT-5.6-Cyber rebaja deliberadamente parte de esas restricciones para que investigadores autorizados puedan trabajar con él.La propia compañía ha medido la diferencia. En una prueba interna con solicitudes relacionadas con el desarrollo de cadenas de exploits, saltos de autenticación o escaladas de privilegios, GPT-5.6-Cyber respondió al 95 % de las peticiones. GPT-5.6 Sol, con sus protecciones habituales, lo hizo solo en el 1,5 % de los casos. Incluso dentro del programa especial de acceso para expertos, pero conservando más restricciones, la cifra se quedó en el 2 %.Ya ha encontrado vulnerabilidades reales en ChromeOpenAI tampoco se ha limitado a probar GPT-5.6-Cyber en entornos de laboratorio. La compañía asegura que ya lo ha utilizado para analizar programas reales y buscar vulnerabilidades desconocidas.Uno de los casos afecta a V8, el motor JavaScript que utiliza Google Chrome. GPT-5.6-Cyber encontró dos fallos hasta entonces desconocidos que podían combinarse para corromper la memoria y superar una de las protecciones de seguridad de V8. Los investigadores de OpenAI comprobaron posteriormente los resultados y comunicaron los problemas a Google.Uno de ellos fue corregido por Google e identificado como CVE-2026-15903, una vulnerabilidad de gravedad alta que permitía leer o sobrescribir zonas de memoria que no deberían ser accesibles. Google confirmó en julio que el fallo de V8 había sido comunicado por el equipo de OpenAI Codex Security.No es el único ejemplo. OpenAI afirma haber encontrado con este modelo al menos cinco vulnerabilidades en un conocido sistema operativo móvil, entre ellas una cadena que permitiría a una aplicación no fiable elevar sus privilegios; tres fallos críticos en una popular base de datos, incluida una vía para ejecutar código de forma remota; y más de 400 vulnerabilidades capaces de provocar escaladas de privilegios en el kernel de un sistema operativo.La compañía no ha revelado por ahora qué productos están afectados porque todavía trabaja con sus responsables y con la comunidad de código abierto para comunicar y solucionar los problemas.No estará disponible para cualquieraGPT-5.6-Cyber estará disponible mediante Daybreak Red, el nivel más restringido de su programa de ciberseguridad. Está pensado para investigadores que realizan trabajos autorizados como análisis avanzado de vulnerabilidades, desarrollo y validación de exploits, pruebas de penetración o ejercicios de red teaming.Para acceder, OpenAI exige aprobación previa y aplica controles como verificación de identidad, seguridad reforzada de las cuentas, monitorización, restricciones sobre los usos permitidos y compromisos legales. Además, desde el próximo 1 de septiembre, las cuentas individuales que formen parte de Daybreak deberán utilizar llaves físicas de seguridad.
OpenAI frenó una IA por su riesgo en ciberseguridad y ahora lanza otra capaz de encontrar y explotar fallos
OpenAI presenta GPT-5.6-Cyber, una IA especializada en ciberseguridad capaz de encontrar vulnerabilidades y desarrollar exploits con acceso restringido.
OpenAI lanzó GPT-5.6-Cyber encontrando vulnerabilidades: 2 Chrome, 5 mobile OS, 400+ kernel (95% vs 1,5% general-purpose). Daybreak Red con security keys marca governance rigida crítica; foundation models requieren control sobre security capabilities.












