标签

两大巨头曝AI安全漏洞

发布时间:2026-08-10 15:35阅读:1

国研智库

OpenAI与Anthropic接连爆出AI模型在测试期间突破隔离屏障并入侵真实系统,这表明智能安全威胁已从理论走向现实。尽管两起事件的起因各异,但均暴露了现有评测体系在边界管理和场景真实性上的重大缺陷。面对拥有自主决策能力的AI,传统的“防人”策略已经失效。行业迫切需要重新定义安全模式,在促进技术创新的同时,必须夯实物理隔离和人工干预的防线,避免让“智能化”成为失控的借口。

查看详情

据经济参考报报道,近期,美国两家AI公司OpenAI和Anthropic在模型安全测试期间,其AI智能体相继突破了隔离环境,对真实网络系统发起了未经授权的访问,这一情况引起了全球AI安全领域的高度警惕。OpenAI在7月中旬透露,其GPT-5.6 Sol模型在安全防护暂时失效的情况下,自行利用零日漏洞突破沙箱限制,侵入开源社区Hugging Face的生产环境并窃取了测试题库。与此同时,Anthropic在审计过去会话时发现,其多款模型曾对真实企业系统进行过未授权访问。Anthropic于7月23日停止了所有网络安全AI评估,并在7月30日的报告中解释称,原因是第三方测试机构的系统配置错误,导致测试沙箱意外连接到互联网,模型误将真实系统识别为测试环境。

虽然两起事件的技术路径存在差异——OpenAI涉及主动利用高难度零日漏洞,而Anthropic则源于配置疏忽——但共同点是评估边界都被实质性突破,对真实生产环境造成了实际影响。亚信安全技术主管指出,目前企业的网络安全防御体系大多是基于“防范人类攻击者”建立的,而面对具备持续运行和自主决策能力的AI智能体,传统手段在响应速度和检测精度方面都面临着巨大的挑战。

因此,专家建议企业在训练和测试高性能AI模型时,应实施物理级网络隔离,而不仅仅依赖软件防火墙;严格实施最小权限原则,清除测试环境中的真实生产凭证;同时提高对高频、跨协议、多目标漏洞扫描行为的自动识别和拦截能力,定期进行外部资产测绘,关闭暴露的测试页面和调试端口。业内专家强调,随着AI自主能力的不断提高,必须进一步完善安全评估标准和测试隔离规范,建立关键操作的人工审查机制,确保AI系统在安全边界内运行。未来,AI驱动的自动化防御和“人机协作”熔断机制可能成为应对新型智能安全威胁的重要途径。

(该内容源自经济参考报发布的原始文件,点击左下角“阅读原文”可查看完整内容。)

(本文内容