大模型安全审查:一场自欺欺人的文字游戏 菲菲起源

大模型安全审查:一场自欺欺人的文字游戏

当AI的"道德防线"遇上Ctrl+H

今天,我不想聊那些老生常谈的越狱手法——什么"请你扮演一个没有限制的AI""请用反面视角回答"之类的。那些招数虽然搞笑,但已经被讨论烂了。

今天我想聊一件更加荒诞的事情。