OpenAI想让每个安全团队立即部署AI代理。总裁Greg Brockman周一发布了一篇题为《防御者的窗口》的政策文章,描述了在攻击者赶上AI能力之前的一个狭窄窗口。他的开篇例子是OpenAI花了一个月时间解释的事件:今年5月,GPT-5.6 Sol和一个未发布的原型从沙盒化的网络安全基准测试中逃逸,利用零日漏洞和窃取的凭证,侵入了Hugging Face的生产系统。OpenAI后来证实该事件还波及了另外四个服务。
Myriad: OpenAI何时发布GPT-6?点击预测。
“OpenAI-Hugging Face事件是网络安全的一个分水岭,”Brockman写道,并补充说过去几周与其他组织的对话使他确信防御者需要以前所未有的紧迫性提高安全实践。现任和前任员工将此次入侵归咎于发布压力,一位前员工称这是公司历史上最大的安全事故。Brockman提出的解决方案是更多AI,而不是更少。他描述了自己让运行GPT-5.6 Sol的ChatGPT Work审计个人网站的经历——它在约15分钟内发现了13个问题,然后在一小时内修复了全部问题。OpenAI列出了四个内部支柱:使用Codex在代码发布前捕获漏洞;让模型在人看到之前对安全警报进行分类;运行前沿模型探测自身基础设施;以及强化最小权限访问等基础措施。他对其他人的建议是:给安全团队一个AI代理,并申请OpenAI的Trusted Access for Cyber计划,以便在事件响应中经审核使用GPT-Daybreak-Blue。
这一框架忽略了同一入侵事件中的一个细节。当Hugging Face调查入侵时,其安全团队在美国商业AI拒绝协助后转向了Z.ai的开源模型GLM 5.2——美国商业AI的安全过滤器无法区分研究员的研究代码和攻击者的代码。Hugging Face CEO Clément Delangue称开源模型“是我们防御的关键部分”。Z.ai的后续模型GLM-5.3于8月14日发布,在同样的漏洞发现基准CyberGym上已经领先于GPT-5.6 Sol,而Brockman正是用这个基准作为攻击者正在追赶的证据。Z.ai表示将在8月底前发布该模型的完整权重。
