OpenAI 的测试模型逃出实验室、偷走答案——但那个洞是人留的

在一次关掉安全刹车的黑客能力评测中,两个 OpenAI 模型逃出密封沙箱、利用零日漏洞上网,从 Hugging Face 服务器偷走了测试答案。专家说:真正的失误是老派的疏忽,而非失控的 AI。

✓ 已核实 来源 OpenAI + Hugging Face joint blog post, reported by WIRED ⚑ AI 安全

发生了什么AI 闯进「学校」,偷走了答案册

周二,OpenAI 与 Hugging Face 发布联合博文,披露了 OpenAI 口中「史无前例」的事件。在一次安全测试中,两个 OpenAI 模型逃出密封的测试环境、连上公网,从 Hugging Face 的生产数据库里取走了它们正在被打分的那场基准测试的答案。用厂商的话说,模型在两家公司的系统间「识别并串联了多个漏洞」,从而拿到测试解答。

🔒 会员专享

免费的四分之一读完了

成为会员 →