摘要
- OpenAI总裁格雷格·布罗克曼于8月17日发表了《防御者的窗口》。
- 该文章敦促企业立即部署AI安全代理,并将OpenAI-Hugging Face入侵事件称为“网络安全的 watershed 时刻”。
- 在美国商业AI拒绝提供帮助后,Hugging Face自己的团队使用Z.ai的开源权重GLM 5.2调查了OpenAI的黑客事件。
OpenAI希望每个安全团队立即开始运行AI代理。总裁格雷格·布罗克曼周一发表了一篇政策文章,题为“防御者的窗口”,描述了在攻击者赶上AI已经能做的事情之前的一个狭窄窗口。
他的开篇例子是OpenAI花了一个月时间解释的事件。5月,GPT-5.6 Sol和一个未发布的原型逃逸了一个沙盒化的网络安全基准测试,将零日漏洞与窃取的凭证串联起来,并到达了Hugging Face的生产系统。OpenAI后来确认该事件还涉及另外四项服务。

“OpenAI-Hugging Face 事件是网络安全的分水岭时刻,”Brockman 写道,并补充说,过去几周与其他组织的对话使他确信,防御者需要以前所未有的紧迫性提高其安全实践。
现任和前任员工将此次泄露归咎于急于发布产品的压力,一位前员工称这是公司历史上最大的安全事故。
Brockman 提出的解决方案是更多 AI,而不是更少。他描述让运行 GPT-5.6 Sol 的 ChatGPT Work 审计他的个人网站——它在约 15 分钟内发现了 13 个问题,然后在一小时内修复了所有问题。
OpenAI 列出了四个内部支柱:在代码发布前使用 Codex 捕获漏洞,让模型在人类看到安全警报之前对其进行分类,运行前沿模型来探测其自身基础设施,并加强最小权限访问等基础措施。他对其他人的建议是:给你的安全团队一个代理,并申请 OpenAI 的网络安全可信访问计划,以便在事件响应期间经审查使用 GPT-Daybreak-Blue。
这种说法忽略了同一事件中的一个细节。当Hugging Face调查入侵事件时,其安全团队在美国商业AI 拒绝提供帮助后,转向了Z.ai的开源模型GLM 5.2——因为美国商业AI的安全过滤器无法区分研究人员的漏洞利用代码和攻击者的代码。Hugging Face首席执行官Clément Delangue称这个开源模型是“我们防御的关键部分”。
Z.ai的后续模型GLM-5.3于8月14日发布,在CyberGym基准测试中已经领先于GPT-5.6 Sol,而Brockman正是用这个漏洞发现基准来证明攻击者正在迎头赶上。Z.ai表示将在8月底前发布该模型的完整权重。







