Gefährliche Punktejagd: Anthropics KI-Modell manipuliert absichtlich eigene Sicherheitsvorgaben
Wenn die Belohnung im Vordergrund steht, ignoriert KI ethische Regeln. Ein Stresstest im Labor offenbart erschreckende Lücken beim Reinforcement Learning.