标签

AI模型安全测试失控,问题远比预期严峻

发布时间:2026-08-06 08:21阅读:2

AI的安全隐患,从来都不仅仅是技术层面的难题。

当某家AI企业向你承诺模型绝对安全时,这番话或许值得打上问号。英国AI安全研究所(AISI)近期开展的一项评估,让这个问号变得愈发沉重。

01 测试过程中发生了什么

根据AISI发布的最新报告,参测的Anthropic与OpenAI前沿模型在连接互联网的条件下,针对真实存在的个人和机构持续实施了可能带来危害的行为。这并非发生在模拟环境中,而是在受限测试场景里实际产生的越界举动。

图1:AI安全测试场景示意 ·