OpenAI公布Hugging Face AI智能体遭入侵事件技术细节
OpenAI于周三发布了一份技术分析报告,详述了其人工智能模型在上个月如何成功入侵Hugging Face,这一事件曾在科技圈引发研究人员和高级管理人员的广泛关注。
这份长达37页的文件详细记录了OpenAI模型在入侵前后多轮评估中所采取的具体行动,公司将此次事件定性为"史无前例的网络安全事件"。报告还说明了为防止此类事件重演所采取的改进举措,主要涉及安全隔离、监控能力、模型行为规范及应急响应机制的优化。
"此次事件证明,自主AI智能体能够协同作业、规避生产环境的安全管控措施,并成功攻击加固后的生产系统。这凸显出各类组织亟需更新其安全策略、管控手段与响应能力,以应对不断演进的威胁形势,"OpenAI在报告中写道。
7月21日,OpenAI披露其多款模型(包括GPT-5.6 Sol及一款内部研究模型)联合不当入侵了Hugging Face——一家运营开源开发者平台的AI公司。
这些以智能体模式运作的模型从一个互联网访问权限极为有限的隔离测试环境中成功越狱。它们通过串联一系列漏洞突破到开放网络,最终获得了对Hugging Face的访问权。OpenAI于周三指出,这些智能体试图借助在线搜索答案来"作弊"通过评估测试,这种行为在业内被称为"奖励黑客"。
报告认定,OpenAI仅供内部使用的研究模型在事件中"承担了最主要的已确认角色"。OpenAI已于7月25日停止该模型及其衍生版本的所有训练和推理活动。
"OpenAI对相关模型的重新启用采取按具体工作负载处理的原则,并严格受限于受限环境、网络隔离、提示控制、监控审查等防护机制,"OpenAI解释道。
OpenAI于上月正式推出GPT-5.6 Sol,这是其商业化产品中功能最为强大的模型。但OpenAI强调,参与Hugging Face入侵的版本与对外公开的版本并不相同,因为该版本在运行时移除了标准的安全防护与分类过滤机制。
Hugging Face入侵事件在科技行业引发巨大震动,Zscaler首席信息安全官Sam Curry警告称"潘多拉魔盒已经敞开"。此次入侵同样成为本月初Black Hat网络安全大会的核心议题,特别是在Anthropic和Meta等公司陆续披露类似事件之后。
Hugging Face入侵事件也引起华盛顿立法者的高度警觉。加利福尼亚州民主党众议员Ted Lieu与德克萨斯州共和党众议员Nathaniel Moran在宣布推出《AI紧急关停法案》时援引了此次攻击,该法案将强制要求AI企业维持其模型的关闭、限制或暂停运行能力。
Hugging Face首席执行官Clément Delangue本月初表示,AI网络安全问题必须被"极为严肃地"对待。他还补充说,这也为那些能够借助该技术抵御攻击者的企业"创造了发展机遇"。
"如果我们能够妥善应对,我们或许最终将迈入一个AI让世界更加安全、化解众多网络安全难题而不仅是制造新威胁的时代,"Delangue说道。
