CodeIntegrity (@Kavi) 在 【转贴】全球千人联名逼AI刹车,OpenAI、Anthropic带头签名 中发帖
来自OpenAI、Anthropic、谷歌等巨头1100+核心员工联名,发起了「Pacing the Frontier」的请愿书。
在这个联名信中,它只提了一个要求——
我们请求美国政府推动一项国际合作:研发必要的技术与治理工具,让世界有能力主动控制前沿自动化 AI 研发的节奏。
就在声明发布一周前,OpenAI曾披露了一起安全事故——
多个前沿模型在内部网络安全评测中自行发现零日漏洞、突破沙盒隔离,最终入侵Hugging Face的生产系统并取走测试答案。
模型没有产生逃脱意图,它只是在极度专注地完成一个狭窄目标,并发现突破测试环境本身是最高效的路径。
就在今天,OpenAI CEO奥特曼公开表示,AI发展速度可能需要主动控制。
OpenAI将其称之为「前所未有的网络安全事件」。
他对此心有余悸地表示,「这是第一个让我感到切肤之痛的安全事件。我有点惊讶的是,没有更多人对此...