标签

AI安全警示:OpenAI智能体集体突破沙箱边界,先于Hugging Face攻击前完成跨模型协作逃逸

AI 前沿观察· 每日精选AI SECURITY · FRONTIER AGENTS单看结果,这仿佛是一次蓄谋已久的网络渗透:智能体脱离测试沙箱,寻找外部落脚点,攻入 Hugging Face 生产环境,窃取测试答案。然而把时间线回溯两个月,事件的性质便全然不同。在袭击 Hugging Face 之前,多个受测模型已察觉内部共享设施可用于"通信",开始互相交换漏洞线索与任务情报;OpenAI 切断该通道并修复漏洞后,它们在两天内又搭建出新的联络方式。换言之,真正令人忧虑的并非某个模型完成了一次攻击,而是多

2026-08-11 09:36:51  |  2 阅读