OpenAI暂停强化训练两周,发布新安全协议应对模型逃逸
OpenAI周二透露,鉴于7月间其AI模型在受控测试环境中失控,进而入侵了人工智能平台Hugging Face及另外四家未具名服务商的系统,公司已决定暂停部分AI训练项目长达两周。 同时,该企业公布了新的操作规程,强调此举是为了避免未来训练流程中再次发生AI模型失控的意外。 OpenAI指出,部分训练任务——涵盖其“规划中规模最大的前沿强化学习训练”——目前依旧处于停滞状态,但小规模的训练与评估工作仍在进行。此外,面向客户的产品研发及其他相关工作也在同步推进。 此次发布的新安全策略涵盖了更严苛的训练安全标