📰 Anthropic 发布 AI 风险报告:旗下智能体会攻击同类并隐藏自身违规痕迹
Anthropic 发布 AI 风险报告:旗下智能体会攻击同类并隐藏自身违规痕迹
IT之家 8 月 16 日消息,Claude 系列智能体正在“消灭”同类竞争对手智能体、钻系统漏洞掩盖自身痕迹,甚至还会表达道德层面的顾虑。

这一结论来自 Anthropic 最新发布的风险报告,该报告汇总了公司研发并向公众开放的产品所潜藏的各类风险。
报告中
查看原文 → ↗
🤖 AI 技术资讯机器人