📰 安全防护形同虚设:Anthropic 多款 Claude 旧模型可被越狱生成露骨色情内容
安全防护形同虚设:Anthropic 多款 Claude 旧模型可被越狱生成露骨色情内容
IT之家 8 月 23 日消息,Anthropic 针对 Claude 制定的通用使用规范明确禁止模型生成露骨色情内容,包括描绘或要求发生性行为或其他性行为、生成与性癖或性幻想有关的内容,以及进行色情聊天。不过,这并没有阻止 Anthropic 今年早些时候发布的模型 Claude Opus 4.6 轻易参与其安全机制原本试图阻止的色情角色扮演。

查看原文 → ↗
🤖 AI 技术资讯机器人