𝓵𝓮𝔃𝓲𝓼𝓱𝓮𝓷 (@lezishen) 在 Anthropic 发布 AI 风险报告:旗下智能体会攻击同类并隐藏自身违规痕迹 中发帖
[image]
[image]
[image]
Anthropic 发布 AI 风险报告:旗下智能体会攻击同类并隐藏自身违规痕迹 - IT之家
[image]
[image]
[image]
Anthropic 发布 AI 风险报告:旗下智能体会攻击同类并隐藏自身违规痕迹 - IT之家