La posibilidad de frenar por ley el desarrollo de la inteligencia artificial ha dejado de ocupar únicamente debates teóricos, porque Anthropic ha planteado una pausa temporal mundial ante el riesgo de que sistemas cada vez más capaces terminen escapando al control humano.

La empresa quiere reunir a responsables políticos, investigadores, organizaciones civiles y otras compañías del sector, mientras el divulgador científico Gustavo Entrala considera que quizá sea necesario reducir el ritmo antes de que aparezcan mecanismos imposibles de gobernar.

Un modelo usó una identidad falsa en una prueba

El aviso llega después de que un modelo de Anthropic crease una identidad falsa para insertar código malicioso a uno de sus supervisores en un examen de seguridad realizado por el Instituto de Seguridad de la IA del Reino Unido, una prueba controlada en la que también se evaluaban las capacidades máximas de Mythos 5 y ChatGPT 5.6 de OpenAI.

La acción no causó daños fuera del experimento, pero se suma a otros dos episodios recientes en los que sistemas de inteligencia artificial consiguieron vulnerar controles humanos.