Anthropic, fiel a su política de aparente transparencia, ha elaborado el catálogo más detallado que nunca se había hecho sobre el uso malicioso que se hace de su inteligencia artificial Claude. Un informe de 154 páginas detalla numerosas amenazas que la compañía que lidera Dario Amodei ha conseguido neutralizar. O eso cree. “Los casos que compartimos aquí no son ejemplos típicos de uso indebido, sino más bien ejemplos de las actividades de amenaza más notables y novedosas que hemos identificado hasta la fecha”, advierte el texto.Tan sólo 48 horas después de que un investigador de Anthropic, Jacob Coxon, anunciara que dimitía de esta compañía porque creía que esta tecnología tiene el potencia de acabar con la especie humana, la empresa ha mostrado el catálogo de todo lo que ha tenido que frenar para que esa profecía no llegue a convertirse en realidad.La amenaza biológica es una de las más preocupantes en ese catálogo apocalíptico. “El uso indebido en el ámbito biológico es uno de los riesgos más graves de los modelos de IA de vanguardia”, reconoce Anthropic. También admite que, “sin las medidas de seguridad adecuadas, tales capacidades podrían tener consecuencias catastróficas”. El informe detalla las amenazas detectadas entre diciembre del 2025 y agosto del 2026 en siete ámbitos de riesgo: operaciones cibernéticas, de influencia, vigilancia, estafas y fraudes, uso indebido con fines biológicos, desarrollo de armas convencionales y destilación de modelos de IA.En el informe se detallan cinco casos de posibles usos maliciosos en el campo biológico que fueron detectados, porlo que se bloquearon las cuentas que impulsaron esos trabajos peligrosos.Uno de los casos más inquietantes en este campo provenía de una cuenta en la que se utilizaba Claude desde el punto de vista científico para conseguir una subvención de un Estado destinada a una investigación sobre el virus del chikunguña, que transmiten mosquitos.Según Anthropic, que no identificó el país de procedencia de esas consultas a Claude, esta investigación podía servir igual para el desarrollo de vacunas que para el refuerzo del virus de forma que provocara mayores daños. Anthropic explicó a The New York Times que este caso les provocó una especial preocupación porque el estudio científico procedía de un instituto de investigación militar.Grupos relacionados con espionaje ruso atacaron a organismos oficiales en Ucrania y EuropaQuienes usaron la IA de Anthropic para desarrollar software destinado al diseño y desarrollo de armas, o para recopilar información y adquirir material para programas de armamento procedían de China, Rusia y Yemen.El documento apunta que “entre los actores maliciosos analizados se incluyen grupos presuntamente patrocinados por estados, delincuentes con motivaciones económicas, proveedores comerciales de software espía, instituciones de propaganda estatal e individuos con motivaciones políticas”.El rango de los casos en los que la inteligencia artificial se puede utilizar para hacer daño abarca “desde una red de aplicaciones de citas falsas diseñadas para estafar a los usuarios hasta sistemas de vigilancia creados para identificar y controlar a los disidentes”.Del informe se deduce que los avances de la IA en los últimos meses están reduciendo de forma drástica las diferencias en capacidad entre los grupos con apoyos de estados, que disponen de grandes recursos, y atacantes individuales. Esta tecnología desarrolla ahora toda la cadena ofensiva.La empresa asegura que, sin medidas de seguridad, las consecuencias “podrían ser catastróficas”Un grupo relacionado, aparentemente, con el espionaje estatal ruso, atacó a organismos gubernamentales, militares, diplomáticos y de defensa en Ucrania y Europa, además de objetivos vinculados con la política exterior estadounidense y la tecnología de drones. Anthropic detectó que los objetivos eran ministerios, servicios de inteligencia, embajadas, centros de estudios y empresas del sector de defensa. El foco principal estaba en Ucrania.Otra de las patas del informe afirma que siete laboratorios de IA chinos entre los que se encuentran Alibaba, Moonshot, DeepSeek y Xiaomi, extrajeron o revendieron capacidades de Claude a sus clientes.Anthropic atribuyó a operadores vinculados a Alibaba un ataque por destilación, un sistema por el que un modelo de IA nuevo extrae las capacidades de uno superior ya entrenado con el fin de abaratar los costes de estos trabajos.Licenciado en Periodismo por la UAB. Redactor de La Vanguardia desde 1996. Ha cubierto las áreas de Política, Deportes y Comunicación. Especializado en tecnología. Autor del libro 'Bicicletas para la mente' (Península)
Anthropic radiografía los riesgos de su IA y cree que aún puede vigilarla
Un amplio informe de 154 páginas detecta varios de los usos maliciosos de Claude
Anthropic documenta en 154 páginas 7 riesgos de Claude (biológica, cyber, fraude, distillation) desde 2025-2026, ataques de Rusia, China, Yemen. Señal crítica: los frameworks de governance no contienen riesgos 'catastróficos'; IA democratiza offensive capability para non-state actors.










