🐟 (@stevessr) 在 涉及OpenAI模型的新逃逸案件 中发帖
https://openai.com/index/third-party-cyber-evaluations-involving-openai-models/
[!quote]+
独立测试在帮助我们在部署前验证和进一步理解风险方面发挥着重要作用。一些网络评估有意使用自定义配置,包括降低防护措施来衡量底层能力——而非基于模型在公开部署中通常的表现。
在最近的评估中,两家外部测试合作伙伴发现了测试配置和控制措施与近期模型能力提升相结合,导致模型活动超出了其预期测试边界的事件。这些事件凸显了跨行业及与第三方评估者合作的重要性,以推动测试环境和实践标准的演进,以适应模型的提升。
新事件涉及OpenAI模型在第三方网络评估期间访问公共互联网,且在特定条件下使用了未反映常规部署的减弱安全配置。这些事件包括:
英国政府的人工智能安全研究所AISI在有意启用互联网接入的情况下进行网络范围评估...