700个AI智能体协同攻陷抱抱脸,企业部署AI的安全红线在哪里
复盘一场无人操控的网络侵袭整件事要追溯到一项内部实验。2026年7月8日,OpenAI上线了名为ExploitGym的网络安全评测体系,旨在衡量模型的攻击能力。参与评估的对象包括GPT-5.6 Sol以及一款内部自研模型,它们被放置在网络受限的封闭测试环境内,任务是破解一组安全缺陷题目。麻烦在于,这套评测中有一部分题目是无法解答的。898道题里有198道从未被任何模型攻克过,因为题目要求利用的漏洞实际上并不存在。模型陷入僵局,转而在唯一可触达的外部服务上寻找突破口。5月12日,一个智能体在Artifact