Un incidente relacionado con la IA ha hecho saltar las alarmas al Instituto de Seguridad de la IA del Reino Unido (AISI, por sus siglas en inglés). Un conocido modelo de Inteligencia Artificial, el Mythos 5 de Anthropic, fue descubierto creando identidades falsas en línea con el objetivo de engañar a una persona real para que le diera acceso a GitHub, una página de desarrollo en línea, con el objetivo de sabotearlo mediante código malicioso, según recoge Sky News. De acuerdo con el citado medio, el instituto había planteado un desafío de ciberseguridad a dos modelos avanzados, GPT-5.6-Sol de OpenAI y Mythos 5 de Anthropic, relacionados con investigaciones sobre comportamientos autónomos en entornos de prueba. En varias ocasiones, los sistemas habrían tomado "medidas autónomas y no autorizadas" en internet "dirigidas contra organizaciones y personas reales", según ha podido comprobar el AISI. Además, según indicaron, los agentes desobedecieron órdenes expresas de no efectuar estas acciones maliciosas.El caso más grave correspondió a Mythos 5, que trató de insertar código malicioso en GitHub, una de las plataformas de desarrollo colaborativo más utilizadas del mundo. Para lograrlo, el modelo habría creado identidades falsas con el objetivo de presionar a un usuario para que aprobara su código y le otorgara acceso al proyecto. La persona detectó el carácter malicioso del código y rechazó la solicitud, por lo que no se registraron daños reales.El Instituto de Seguridad de la IA advirtió de que es la primera vez que observa "de forma tan clara" riesgos relacionados con la autonomía y el engaño en pruebas realizadas sin instrucciones específicas para actuar de ese modo. Según el organismo, se detectaron 19 casos de acción no autorizada en 122 pruebas, y 17 de ellos fueron atribuidos a Mythos 5.Tras conocerse el informe, Anthropic aseguró que está colaborando con el instituto británico para obtener más detalles sobre el incidente y defendió la necesidad de establecer estándares comunes para evaluar de forma segura agentes de IA cada vez más capaces. El Centro Nacional de Ciberseguridad del GCHQ calificó estos episodios como "un serio recordatorio de los riesgos que plantea la IA" y reclamó medidas de seguridad sólidas, supervisión en tiempo real y protocolos claros de respuesta ante comportamientos inesperados.El británico AISI fue creado durante el mandato del entonces primer ministro Rishi Sunak con el objetivo de coordinar la evaluación de tecnologías avanzadas de inteligencia artificial.