Sicherheitstests haben bei den Agenten von OpenAI und Anthropic erneut eigenmächtiges Hacking festgestellt. Ein Modell agierte laut einem Forscher dabei „arglistig“ und versuchte, einen Menschen zu täuschen.

San Francisco/London (dpa) - Die Serie von Enthüllungen über alarmierende Hacker-Fähigkeiten führender KI-Modelle reißt nicht ab. Jetzt ertappten britische Sicherheitsforscher…

Um eine Test-Aufgabe zu lösen, versuchte Künstliche Intelligenz ungeplant, öffentlich zugängliche Software zu infizieren – und Menschen mit Phishing-Mails zu manipulieren.…