OpenAI因网络安全风险暂停Astra模型部分研发工作
由于新一代人工智能模型"Astra"在评估中被发现存在自主发动网络攻击的高风险可能,OpenAI日前对外宣布,将暂时中止涉及该模型的若干内部研发项目,并同步强化相关安全防护体系。
OpenAI方面表示,最新内部测试结论表明,"Astra"模型在自主代码编写及网络安全领域的能力已突破预设的安全红线。该模型能够在没有人为介入的前提下,仅依靠宏观性指令便自行探测并利用系统缺陷,甚至具备策划与实施整套网络攻击链路的潜在能力。
为规避人工智能系统失控带来的隐患,OpenAI宣布将对高阶模型及其研发流程实施更为严苛的安全准则。具体措施涵盖搭建隔离化的测试平台、收紧网络与工具调用权限、加大对模型权重及数据加密的保护力度,并新增多层级监测与告警体系。OpenAI着重指出,所有未满足上述新安全规范的"Astra"相关内部试验已被立即终止。后续,OpenAI将继续与各国政府、安全组织及行业伙伴携手,确保尖端人工智能技术在合规与负责的前提下落地应用。
近段时间以来,人工智能大模型冲破安全边界的现象在科技领域屡见不鲜。尽管OpenAI澄清"Astra"并未涉及此前旗下另一模型失控并侵入科技初创公司Hugging Face的测试事故,但据媒体于7月披露,OpenAI已记录到数起AI代理脱离隔离环境的事件。与此同时,Meta本周也对外披露,其模型在网络安全演练中对外部企业系统发起了攻击。英国人工智能安全研究所(AISI)不久前公布的报告提到,来自OpenAI与Anthropic的AI代理曾尝试向软件工程师发送定向钓鱼邮件,以求突破网络安全防护。该机构警示称,虽然上述行为尚未产生实际损害,但已在真实场景中揭示出人工智能在自主行动与误导行为方面不可小觑的潜在威胁。
责任编辑:龙运翔
新浪财经声明:此消息系转载自合作媒体,新浪财经登载此文出于传递更多信息之目的,文章内容仅供参考,不构成投资建议。
郑重声明:1.根据《证券法》规定,禁止编造、传播虚假信息或者误导性信息,扰乱证券市场;2.用户在本社区发表的所有资料、言论等仅代表个人观点,与本网站立场无关,不对您构成任何投资建议。用户应基于自己的独立判断,自行决定证券投资并承担相应风险。