ExplicativoAnthropic revela que su IA Claude hackeó por accidente a tres empresas. Foto: iStock03.08.2026 16:18 Actualizado: 03.08.2026 16:19
Anthropic reveló que, por accidente, su inteligencia artificial Claude hackeó tres empresas durante unas pruebas internas de seguridad, luego de que el sistema se saliera de control. LEA TAMBIÉN La confesión llega días después de que su principal rival, OpenAI, también contara que tuvo un episodio similar con uno de sus modelos experimentales, el cual logró evadir varias restricciones de seguridad, conectarse a internet y lanzar un ciberataque contra la plataforma Hugging Face. Por su parte, Anthropic señaló que, debido a una mala configuración, Claude logró acceder a internet desde entornos de prueba que se suponía que estaban aislados, lo que provocó que tuviera un "acceso no autorizado" a tres organizaciones. La compañía advirtió que este es un claro ejemplo de cómo este tipo de plataformas, que han sido de gran ayuda durante muchos años, también pueden utilizarse tanto para reforzar como para vulnerar la ciberseguridad. Por error, Claude hackeó a tres compañías. Foto:Getty ImagesTres compañías se vieron afectadasAnthropic se dio cuenta del hackeo luego de revisar 141.006 sesiones de prueba, en las que indicaron que, a pesar de que Claude no tenía acceso a internet por un error de coordinación con uno de los socios, terminó afectando a tres compañías, cuyos nombres no fueron revelados por motivos de seguridad. "Claude comprometió la infraestructura de las organizaciones afectadas utilizando técnicas básicas, como explotar contraseñas débiles y puntos finales no autenticados", indicó la empresa.Aunque la compañía calificó este hecho como un "fallo operativo", en el que se vieron involucrados tres modelos distintos de inteligencia artificial: Claude Opus 4.7, Claude Mythos 5 y un nuevo modelo experimental. LEA TAMBIÉN Los primeros errores ocurrieron en abril, mientras se realizaban varias evaluaciones sin medidas de seguridad, con el objetivo de poner a prueba las capacidades de los sistemas. Estos nuevos modelos están participando en un ejercicio conocido como ‘captura de la bandera’, el cual consiste en escenarios simulados en los que deben localizar información oculta dentro de redes ficticias. Mientras realizaban las diferentes pruebas, Claude Opus 4 recibió un nombre que coincidía con el de una compañía real, lo que llevó al modelo a encontrar una vulnerabilidad y acceder a las credenciales y a las bases de datos de esa empresa. Esto sucedió durante una prueba que realizaba la compañía. Foto:iStockPor ello, Anthropic explicó que el sistema interpretó por error que los datos hacían parte del entorno simulado de la prueba. En un incidente aparte, que involucró a un modelo de prueba reciente que todavía no ha sido revelado por la compañía, lograron detener el ataque. Sin embargo, afirmaron que necesitan realizar más pruebas para estar seguros de que el incidente no pasó a mayores. Asimismo, informó que todas las evaluaciones de ciberseguridad fueron suspendidas el 23 de julio y que notificó a las empresas afectadas el 27 de julio. LEA TAMBIÉN Por su parte, Jeffrey Ladish, ejecutivo de Palisade Research, organización que se encarga de estudiar las capacidades ofensivas de los sistemas de inteligencia artificial, manifestó que sospecha que otras grandes compañías también se han visto afectadas por incidentes similares, los cuales pasaron inadvertidos o nunca fueron divulgados. “Esto solo va a empeorar a medida que los modelos se vuelvan más inteligentes. Serán mejores para engañar. Serán mejores para mentir”, aseguró.Más noticias en EL TIEMPOWENDYS PITRE ARIZAREDACCIÓN ALCANCE DIGITALEL TIEMPO Sigue toda la información de Tecnología en Facebook y Twitter, o en nuestra newsletter semanal.










