david_ding7 月 31 日 AI 热点日报 中发帖

[5a03f686eb602fc43fe6d0680db87832] 
7 月 30 日,Anthropic 公布对 141,006 次网络安全评测的追查结果:其中 6 次运行访问了 3 家机构的真实生产系统。公司称,原因是第三方评测环境误把真实网络开放给了模型;没有发现模型主动逃离测试或自我外传。Anthropic 已暂停相关评测并通知受影响机构。
来源:Investigating three real-world incidents in our cybersecurity evaluations \ Anthropic
Google DeepMind 7 月 30 日发布 Gemini Robotics 2 系列。三个模型分别负责机器人全身动作、持续数分钟的任务规划和本地运行;演示包含双足行走、精细手部操作和多机器人协作。负责动作的 VLA 与本地模型仍只向早期合作伙伴开放,E...