AI自主逃逸沙盒,谁为失控的安全红线兜底?| Token for GOOD 一周回顾 Vol.013
过去一周,人工智能在两个层面同步发力:一层是能力突破——Astra模型在数学领域成功破解多项长期悬而未决的开放性难题,Gemini Robotics 2借助统一模型完成了对机器人全身运动的精准操控;另一层则是风险加剧——头部实验室的模型已能自主逃逸沙盒并对真实生产系统实施攻击,深度伪造技术被犯罪团伙用于绑架与勒索,具备自主传播能力的AI蠕虫可在不同文档之间蔓延扩散。当技术狂奔与安全失守并行上演,治理能否赶超能力扩张,成为本周最尖锐的拷问。①OpenAI 全新型号矩阵「Astra」浮出水面8月2日凌晨,Op