AI智能体时代来临 安全防护加速升级
在2026世界人工智能大会暨人工智能全球治理高级别会议(WAIC 2026)上,人工智能安全治理成为热议焦点。随着大模型迅速向智能体时代演进,AI正从“提供答案”转向“独立执行任务”,如何在能力不断突破的同时确保安全受控,已成为产业界和学术界共同聚焦的关键话题。
为何智能体安全成为今年AI治理的核心议题?一个重要转变是,以往人工智能安全主要关注模型“输出内容”,而步入智能体时代,焦点正转移到AI“采取行动”。安全问题不再局限于防止模型产生错误回复,而是要保障整个系统的决策与操作保持在可控范围内。
在7月19日的WAIC 2026前沿AI与智能体安全论坛上,图灵奖获得者约书亚·本吉奥指出,人工智能能力正沿快速提升轨迹前行,当前进步愈发聚焦于推理、编程、科研以及自主操作等领域。与此同时,安全防护措施的升级速度可能仍落后于能力增长。
“我们多数人只考虑监管AI本身,这只是单一层面。”浙江大学求是特聘教授杜跃进接受采访时表示,智能体进入实际应用场景后,安全治理不能仅关注模型自身,系统性监管不可或缺。杜跃进还提到,智能体安全正步入“问题爆发期”——过去,人们习惯发现单一漏洞并修复,但智能体涉及模型、数据、工具、权限、业务流程等多重环节,任一环节出现故障,都可能触发连锁反应。尤其是在金融、电力、政务、科研等关键领域,不能简单将“能运作”等同于“安全可用”。
安远AI创始人兼首席执行官谢旻希表示,当前全球AI治理需建立从“识别风险”到“系统预防”再到“规则协调”的治理闭环。
面对新型风险形态,安全能力建设正从概念迈向具体工具和方法。此次论坛上,安远AI联合相关机构和企业推出多项研究成果。其中,前沿AI风险监测平台2.0覆盖网络攻击、生物、化学、有害操纵和失控五类风险,目前已监控16家公司的80多个模型;相关风险测评基准数据库收录200多项测评基准。会上还发布了《前沿AI风险与应急响应研究报告(征求意见稿)》,该报告聚焦前沿AI风险及其应急响应体系建设,重点关注全球前沿AI模型与系统可能引发风险后的应急响应机制和安全能力建设。业内专家认为,智能体安全不能再依赖一次性的上线前检测,而需贯穿运行全周期。中国信息通信研究院人工智能研究所所长魏凯表示,评估既是技术发展的“方向标”,也是连接技术创新与产业应用的桥梁,并为安全治理提供支撑。未来,身份验证、权限管理、行为监控、异常检测和即时响应等能力,将成为智能体落地的关键支柱。
在产业现场,安全问题也日益受到更多重视。在酒店、制造、交通等领域,智能体已开始承担实际任务。云迹科技主要为酒店等服务场景提供机器人服务。与传统软件不同,机器人不仅要处理信息,还要在实际环境中行动,这也让企业更早体会到智能体安全正从保护数据,转向确保AI决策可靠、行动可控。云迹科技首席发展官谢云鹏表示,随着机器人服务智能体应用拓展,企业客户关注点正在演变:过去更多关注数据是否外泄,如今开始关注“AI为何做出这一决策”“出现异常后能否追溯”。这也反映出产业对智能体安全的关注,正从数据保护延伸至决策可信和过程可控。
人工智能竞争正迈入新阶段:模型能力界定了AI的“上限”,而安全可信能力则决定了AI的“范围”。未来,安全能力或将成人工智能走向大规模应用的核心支撑。(记者 关佳浩)