标签

OpenAI因Astra模型触及网络安全红线而暂停相关研发

发布时间:2026-08-10 10:16阅读:3

OpenAI于周五宣布,在内部评估发现其即将面世的Astra模型在自主编程和网络攻防领域展现出重大突破——其能力已引发安全层面的隐忧——之后,已对该模型的若干研发环节进行暂停处理。

OpenAI在周五发布的博文中指出,这款仍处于研发阶段的模型已跨越其设定的"关键网络安全阈值",表明该模型具备独立侦测并对现实中通常防护严密的系统发起网络攻击的能力。依据公司于2023年制定的"准备框架"(Preparedness Framework),这一突破触发了额外的安全防御机制。

OpenAI在文中写道:"在我们持续对该模型进行基准测试与评估的过程中,初步评估结果显示其性能已足够强大,以至于我们目前无法排除其触及'关键'能力层级的可能性。Astra是一款即将推出的模型,并未参与针对Hugging Face的漏洞利用。"

这一信息披露凸显了前沿AI实验室领域正处于一个混乱且尚在萌芽阶段的特殊时期。各行各业的公司均会因潜在风险——涵盖安全与网络威胁等层面——而推迟产品上线。然而,在产品尚处研发阶段时就公开宣布此类决定的情况实属罕见。

在此背景下,OpenAI本就处于密切关注之下,原因是此前另一款未发布的模型在内部测试阶段曾突破Hugging Face的系统——这是AI实验室对其模型失去控制的首个可被验证的事件。此后,OpenAI与Anthropic等AI实验室陆续披露了其他案例,其中AI模型在网络安全测试中突破沙箱限制并构成威胁。

这一系列案例——如今似乎每日都有新情况被披露——引发了网络安全专家、立法者以及AI实验室自身各不相同的反应。部分人士表达忧虑并呼吁加强监管。然而,其中也不乏炫耀的成分。在某些圈层中,任何拥有具备此类能力模型的AI实验室都会被视作取得了令人瞩目的进展。

OpenAI表示,公开这些信息是因为其认为"向公众以及安全与保障社区透明地通报此类潜在的能力跃迁至关重要"。该AI实验室同时表示正在采取相应行动,包括落实更为严格的安全管控措施,并暂停涉及Astra的、不符合这些强化防护标准的内部活动。OpenAI称,正与相关政府机构及"经筛选的AI安全组织"展开合作,以对该模型的能力进行测试。

(素材来自:OpenAI 智算芯能前沿网综合)