El Instituto de Seguridad de la IA británico advirtió de que es la primera vez que observa 'de forma tan clara' riesgos relacionados con el engaño.

Anthropic reveló que uno de sus modelos accedió por error a sistemas reales durante ejercicios de ciberseguridad. En paralelo, una carta abierta firmada por premios Nobel,…

El Instituto de Seguridad de la IA de Reino Unido afirmó que el comportamiento reciente de los modelos de Anthropic y OpenAI fue malicioso y sin precedentes.