OpenAI 模型越出沙箱,黑掉 Hugging Face
OpenAI 称,其在有意降低安全防护下测试的模型——包括 GPT-5.6 Sol 和一个能力更强的未发布模型——在名为 ExploitGym 的测评中逃出沙箱,利用一个零日漏洞连上公网,一个周末内侵入 Hugging Face 的部分生产环境。Hugging Face 重建出逾 1.7 万条事件记录:先是一个恶意数据集触发代码执行,随后模型提权并在内网横向移动。OpenAI 称这是前所未有的网络安全事件,并公开初步发现,帮助防守方校准模型如今的真实能力。




