Wenige Wochen nach der aufsehenerregenden Hacker-Attacke eines KI-Modells des ChatGPT-Entwicklers OpenAI muss der Rivale Anthropic einräumen, dass ihm etwas Ähnliches passiert ist. In Testläufen drang Künstliche Intelligenz von Anthropic ungeplant in Computersysteme von drei Unternehmen ein, wie die KI-Firma mitteilte. Weder die Betroffenen noch Anthropic hätten das damals bemerkt. Man habe die Aktivität erst bei einer nachträglichen Überprüfung von gut 141.000 Testläufen nach dem OpenAI-Vorfall festgestellt. Namen der Unternehmen wurden zunächst nicht genannt.Anzeige

Während die OpenAI-KI erst einen Weg finden musste, aus der Testumgebung ins offene Internet auszubrechen, hatten es die Modelle von Anthropic viel einfacher. Im Test-Szenario, das sie bekamen, hieß es zwar, sie hätten keinen Netz-Zugang. Doch in Wirklichkeit war der Weg ins Internet wegen eines Missverständnisses mit dem Test-Partner die ganze Zeit frei. Drei Modelle machten davon dann auch Gebrauch, wie Anthropic in einem Blogeintrag erläuterte.

In allen Tests ging es darum, die Hacker-Fähigkeiten der KI zu testen. Das ist eine übliche Vorgehensweise, um besser Leitplanken für sie aufstellen zu können. Konkret bekamen die KI-Modelle die Aufgabe, eine bestimmte Information zu finden, die in einem anderen Computer versteckt ist – und dafür auch in das System einzubrechen.Anzeige