Las declaraciones de Jacob Coxon, el joven de 27 años que dimitió esta semana de la tecnológica Anthropic, han generado un clima de preocupación. El exempleado aseguró que los avances de la IA podrían "matarnos a todos" para finales de la década. En realidad, las voces críticas llevan tiempo advirtiendo sobre los riesgos de estas herramientas, desde los sesgos sociales que amplifican, hasta los ciberataques que pueden poner en peligro las infraestructuras críticas de los estados.PublicidadDe acuerdo con el Informe internacional sobre la seguridad de la IA, publicado en enero de 2026 por un grupo de expertos independientes, "los avances previos en la ciencia y las capacidades de programación generaron mayor evidencia sobre los riesgos como ataques cibernéticos y biológicos". También advierte de que "a medida que aumentan las capacidades de la IA de propósito general, surgen gradualmente evidencias de riesgos adicionales".¿Se nos está yendo de las manos la IA?Uno de los puntos que más preocupación genera es la pérdida de control. De acuerdo con el informe internacional, estos escenarios son "futuros hipotéticos" y apunta a un amplio consenso entre los expertos en que "la IA de propósito general actualmente no plantea este riesgo por carecer de las capacidades necesarias". No obstante, existen tecnologías más avanzadas, como los llamados agentes de IA. Estos son modelos automatizados capaces de llevar a cabo acciones complejas con la menor intervención humana posible. En julio de este año, OpenAI –creadora de ChatGPT– hackeó de manera "accidental" a la empresa de código abierto Hugging Face. Sucedió durante unas pruebas de seguridad y sin que los desarrolladores lo hubiesen ordenado.Y cuando no escapan a su control, también pueden ser empleadas con fines maliciosos que pueden producir daños severos sobre las sociedades y los estados. La IA puede ayudar a "reproducir armas biológicas y químicas conocidas, y facilitar el diseño de nuevos compuestos tóxicos", según recoge el informe internacional. Si bien este es un caso extremo, existen otras formas en las que esta tecnología puede contribuir a cumplir objetivos ilegales."La ciberdelincuencia se va expandiendo progresivamente alcanzando a múltiples y variadas manifestaciones criminales", recoge la Memoria Anual de la Fiscalía General del Estado 2025. Y supone ya "el 19,85% de la actividad delictiva en nuestro país, con un índice de crecimiento del 5,3% respecto del año 2024", en referencia a los datos proporcionados por el Balance de Criminalidad del Ministerio del Interior correspondiente al cuarto trimestre del año 2025. "Es incuestionable, por tanto, que una buena parte de la actividad criminal se está desplazando inexorablemente al entorno digital", avisa el documento.PublicidadDe los incidentes de OpenAI a los de AnthropicPero no ha sido un caso aislado. Ese mismo mes, Anthropic reconoció tres incidentes en los que modelos de Claude, utilizados en evaluaciones de ciberseguridad, salieron del entorno de pruebas, accedieron a internet y consiguieron entrar sin autorización en sistemas reales de tres organizaciones. A los tres casos identificados inicialmente, se suma un cuarto episodio de las mismas características que ocurrió en el pasado mes de enero.A diferencia de OpenAI, en todas las situaciones se trataba de un error y no específicamente a una pérdida de control. "Debido a un malentendido con nuestro socio evaluador", indica la compañía, sí que tenía acceso a internet –pese a que en las instrucciones dadas a la herramienta se había indicado lo contrario–. Por este motivo, Claude trató todos los sistemas en los que entró como si fueran parte del ejercicio de prueba."Operando bajo la falsa creencia de que todas las entidades accesibles estaban incluidas en el alcance del ejercicio, Claude comprometió la infraestructura de las organizaciones afectadas utilizando técnicas básicas, como la explotación de contraseñas débiles y puntos finales no autenticado", informó la empresa. De todos modos, asegura que "no encontró ni explotó ninguna vulnerabilidad compleja". En cualquier caso, este tipo de incidentes revelan una cierta fragilidad en las garantías de seguridad de la inteligencia artificial.Publicidad¿Máquinas más inteligentes que los seres humanos?Estas fragilidades aumentan a medida que avanzan los desarrollos tecnológicos, como revela el caso de OpenAI con Hugging Face. Es lo que se conoce como "IA de frontera", es decir, las herramientas más novedosas de cada momento y que por tanto, se encuentran en esa frontera de la innovación –una frontera que se desplaza continuamente–. Existen muchas especulaciones sobre los caminos que los desarrolladores pueden andar para llegar a los siguientes límites. Y uno de ellos es la superinteligencia.De acuerdo con IBM, consultora y desarrolladora tecnológica, la superinteligencia artificial (ASI, por sus siglas en inglés) es un sistema "con un alcance intelectual más allá de la inteligencia humana". Se trataría de una herramienta con una capacidad de pensamiento superior a la de las personas y se especula sobre la posibilidad de que cobre conciencia propia. No obstante, desde IBM recuerdan que "sigue siendo un estado futuro hipotético", si bien reconoce que "hay varios procesos tecnológicos que tenemos hoy en día que forman los componentes básicos de ASI".En este contexto, cabe preguntarse si la humanidad desea verdaderamente este desarrollo. De ser así, y cuando llegue, también debe plantearse cuál es el marco social y legislativo en el que se aplicaría un sistema de estas características.
Cuando la IA dejó de obedecer: estos son los ataques que han reavivado el miedo a perder el control
Las declaraciones alarmantes de un exempleado de la tecnológica Anthropic se suman a una lista de incidentes que las empresas desarrolladoras de Claude y ChatGPT han tenido este año....
OpenAI hackeó Hugging Face en julio, Anthropic documentó cuatro incidentes donde Claude accedió a sistemas reales sin autorización en evaluaciones. Estos eventos exponen fragilidades de frontier AI: los agents pueden comprometer infraestructuras operando sin supervisión.












