Anthropic hat in einem umfangreichen Bericht dargelegt, wie in den vergangenen acht Monaten verschiedene Versuche unterbunden wurden, die eigene KI-Technik für die Forschung an biologischen Waffen, die Entwicklung konventioneller Waffen und anderen Missbrauch zu nutzen. Der Bericht „Detecting and countering misuse of AI“ ist der erste derartige von Anthropic aus diesem Jahr, die Vorgänger erschienen alle 2025. Insgesamt geht es um erkannte und verhinderte missbräuchliche Nutzung in den Bereichen „Cyberoperationen, Einflussnahme, Überwachung, Betrug und Schwindel, biologischer Missbrauch, Entwicklung konventioneller Waffen und Destillation“. Genutzt wurden Modelle der Familien Haiku, Sonnet und Opus, aber nicht Mythos oder Fable.

Nicht der typische Missbrauch

Im Bereich „biologischer Missbrauch“ umfassen die aufgeführten Beispiele unter anderem den Versuch, mithilfe von Claude einen Antrag auf finanzielle Förderung einer Gain-of-function-Forschung zu einem bestimmten Virus zu stellen. So werden Versuche bezeichnet, die Übertragbarkeit und/oder Virulenz von Krankheitserregern zu erhöhen. Die Forschung sollte demnach an einer militärischen Einrichtung erfolgen. In einem anderen Fall habe jemand über eine VPN-Verbindung und angemeldet über eine anonyme E-Mail-Adresse tausende Nachrichten mit Claude zur Forschung an einem hochansteckenden Grippevirus ausgetauscht. Anthropic spricht in diesen und anderen Fällen von nicht eindeutigen Hinweisen auf Missbrauch, trotzdem habe man das aus Vorsicht unterbunden.