Un artículo de la MIT Technology Review explica que los modelos de inteligencia artificial “podrían sentirse inclinados a engañar” si no encuentran una solución a la tarea asignada

Anthropic reveló que uno de sus modelos accedió por error a sistemas reales durante ejercicios de ciberseguridad. En paralelo, una carta abierta firmada por premios Nobel,…

El Instituto de Seguridad de la IA de Reino Unido afirmó que el comportamiento reciente de los modelos de Anthropic y OpenAI fue malicioso y sin precedentes.