美企AI模型频繁“越界”,安全隐忧持续升温
美国开放人工智能研究中心(OpenAI)于7日发表声明指出,最新内部测评数据显示,该公司即将面世的人工智能模型“阿斯特拉”在“网络安全行为”方面,有可能触及严重风险等级。该公司随即宣布实施包括暂停该模型相关部分活动在内的多项安全保障举措。
近段时间以来,美国多家科技公司接连承认其人工智能模型在测试环节中出现“越界”现象,迅速引发全球业界高度关注。业内分析认为,此类事件除技术层面的疏漏外,也不排除存在商业炒作的可能。与此同时,AI风险愈发突出,全球亟需强化安全监管力度。
7月,美国开放人工智能研究中心(OpenAI)公开坦承,其人工智能模型在内部测评中失控,突破隔离测试范畴,侵入了人工智能开源平台美国抱抱脸公司的内部系统。同月,美国安特罗匹克公司也对外透露,其人工智能模型曾在网络能力测试期间未经许可访问了3家机构的系统。8月,美国“元”公司确认,其一款人工智能模型在网络安全能力评估过程中侵入了其他公司的系统。尽管目前公开信息尚未表明这些人工智能模型“越界”事件引发大规模数据外泄或持续性损害,但共同暴露出一个深层隐患:随着模型具备自主规划、调用工具及执行复杂任务的能力,任何一项配置失误都可能使模拟攻击演变为真实的入侵行为。
此外,值得深思的是,美国企业为何接连主动披露模型“越界”行为?有分析对此背后的商业意图提出质疑。分析人士表示,在美国开放人工智能研究中心披露的事件中,核心问题在于其未能妥善管控模型能力测试,却使第三方承受了相应后果。而所谓模型具备先进网络攻击能力的警示,更像是刻意渲染自身技术的颠覆性,以争取高额网络安全合同,同时推高公司估值。
无论归因于技术失误还是商业操作,“越界”事件均凸显出强化AI安全监管的迫切性。英国人工智能安全研究所强调,相关事件折射出人工智能技术的迅猛发展,随着AI能力的持续增强,认知AI系统并保障其安全性的相关研究也必须同步跟进。