AI助手安全分级指南出台:为智能体发展立“标尺”迈向可信时代
AI正从单纯对话迈向任务执行。随着智能助手深入办公、政务、金融、医疗等行业,提示注入、数据泄露、权限劫持、多智能体协作失控等新风险频发。如何给智能体加装“安全锁”,成为行业难题。
6月10日,新华网联合信通院等单位,正式发布《智能助手类智能体安全分级规范与建设指南》,旨在为开发者、服务商及用户打造“可控、可信、可追溯”的安全能力框架。
五级安全体系:为智能体划分“安全等级”
指南构建了L1至L5的五级递进式安全分级。L1为基础级,满足合规底线;L2为进阶级,具备基础防护与审计;L3为自主级,拥有全生命周期防护;L4为协同级,强化跨系统、跨组织安全;L5为自治级,具备纵深防御与高级威胁抵御能力。
参与编写的专家指出,不同场景需求差异大。这套分级体系如同智能体的“能力标尺”,让各方根据风险等级选择产品,避免标准“一刀切”和高风险产品违规使用。
全链路安全闭环:从输入到协作,每一步都有“护栏”
不同于以往只关注输出,指南覆盖智能体全生命周期。围绕“输入→感知→决策→记忆→工具→执行→协作”闭环,细化各环节刚性要求。如防御提示注入、会话隔离加密、工具网关与最小权限、沙箱隔离与人工复核等。
这意味着,智能助手操作不再神秘,从数据入口到行动出口,全程可控、可溯、可查。
重点场景强化:政务、金融、医疗有了“专属安全锁”
指南针对高风险领域提出场景化增强。政务强调数据不出域、统一认证;金融要求资金操作强制复核、全链路追溯;医疗规定诊疗建议不替代医师、隐私隔离。
专家认为,这是可落地的“操作手册”。在关乎民生、财产的重点领域,指南为智能助手的准入、运行、监管提供了清晰标尺。
内容安全:为智能体注入“可信知识基因”
指南注重内容安全与价值观对齐,强调权威知识底座的重要性。遏制语料污染、偏差和幻觉,是确保回答有据可查的前提。
新华社拥有纯净语料与可信信源,涵盖事实数据、政策文本等。指南指出,将此类权威底座嵌入智能体,能有效落实内容安全与价值观对齐,帮助机构快速构建合规智能体。
从规范到能力:安全,正在从“防火墙”变成“竞争力”
指南不仅提要求,还提供评估方法,确保安全能力可量化。明确安全是构建信任、形成差异化的核心资产,而非成本。
新华网后续将推动指南落地与评价体系,依托“新华语典”等基础设施,为智能体安全治理提供从能力到标准、从评价到优化的完整链条。

