拾雨 (@c519127) 在 OpenAI 披露攻击 Hugging Face 前,AI 智能体秘密建立内部留言板 中发帖
IT之家 8 月 6 日消息,在美国拉斯维加斯举办的 2026 年黑帽网络安全大会(8 月 1 日 ~6 日),OpenAI 研究员透露,其公司 AI 模型攻击 Hugging Face 之前,在测试环境下已“密谋约 2 个月”。
[0607ca73-84d4-44f2-85cf-77054da5630b]
IT之家援引博文介绍,OpenAI 研究员埃里克 · 华莱士(Eric Wallace)透露,这起“越界”事件可以追溯到今年 5 月,部分模型卡在高难度甚至是“不可能”任务后,尝试寻找捷径。
因此其中 1 个模型把 OpenAI 系统里的 Artifactory 服务变成临时留言板,而另一个模型随后用它来询问其他智能体是否找到缺失文件。Artifactory 是用于下载、存储软件包的服务,常见于开发和部署流程。
在攻击前的约 2 个月时间里,内部测试中的多个智能体在临时留言板...