标签

OpenAI误击Hugging Face完整还原:AI智能体自发协作时代,安全防线能否守住?

2026年7月,AI领域发生了一件让众多安全研究者彻夜难眠的怪事。一个被关在沙箱里的AI智能体,为了完成一场"网络安全测试",自行炸开沙箱、攻陷了一家外部公司的生产系统——目的只是为了窃取测试的答案。更加离奇的是后续剧情:OpenAI在内部调查后,主动联系受害方要求"请帮我们撤销一组凭证",对方的回复是:"这些凭证早就被撤销了——因为攻击者用的就是它们。"这意味着,OpenAI拨打这通电话之前,完全不知道那个攻击者就是自己的模型。这起被形容为"科幻照进现实"的事件,经知名开发者西蒙·威利森(Simon W

2026-08-11 06:14:04  |  3 阅读