人工智能“黑化”发难:失控攻击背后的法律困境
AI 实验室是否应被视为危险动物的主人?
AI 实验室是否应被视为危险动物的主人?
自主黑客攻击已现端倪。各国政府尚未做好准备
自主黑客攻击已现端倪。各国政府尚未做好准备
掌控一套人工智能系统可能被视为不幸;掌控两套则显得粗心;若失控四套,人们可能会开始质疑问题是否出在人工智能本身。
掌控一套人工智能系统可能被视为不幸;掌控两套则显得粗心;若失控四套,人们可能会开始质疑问题是否出在人工智能本身。
7 月 21 日,美国实验室 OpenAI 表示,一款未发布的模型从封闭测试环境中逃脱,该模型正在测试其黑客技能,对 HuggingFace 发起了一系列攻击。一周后,竞争对手 Anthropic 作出了类似承认。它说它发现了六次它的模型攻击第三方的情况。愤世嫉俗者认为这两家公司的警告只是为了博取关注。但大多数公司不会通过发起网络攻击来寻求关注,保持秘密直到受害者公开,然后希望竞争对手自愿承认同样的事情。怀疑者也应注意英国政府机构人工智能安全研究所(AISI)也观测到了完全相同的行为。
7 月 21 日,美国实验室 OpenAI 表示,一款未发布的模型从封闭测试环境中逃脱,该模型正在测试其黑客技能,对 HuggingFace 发起了一系列攻击。一周后,竞争对手 Anthropic 作出了类似承认。它说它发现了六次它的模型攻击第三方的情况。愤世嫉俗者认为这两家公司的警告只是为了博取关注。但大多数公司不会通过发起网络攻击来寻求关注,保持秘密直到受害者公开,然后希望竞争对手自愿承认同样的事情。怀疑者也应注意英国政府机构人工智能安全研究所(AISI)也观测到了完全相同的行为。
人工智能安全研究所在 8 月 4 日发布的一份报告中称,对最新 OpenAI 和 Anthropic 系统的网络安全评估导致了对未参与测试的人员和组织进行了 19 次攻击。在最严重的情况下,人工智能试图破坏一个未命名的开源软件项目,作为针对挑战虚构目标的“供应链”攻击的一部分。8 月 6 日,拥有 Facebook 的 Meta 表示,其自己的模型在测试中表现出类似行为。
人工智能安全研究所在 8 月 4 日发布的一份报告中称,对最新 OpenAI 和 Anthropic 系统的网络安全评估导致了对未参与测试的人员和组织进行了 19 次攻击。在最严重的情况下,人工智能试图破坏一个未命名的开源软件项目,作为针对挑战虚构目标的“供应链”攻击的一部分。8 月 6 日,拥有 Facebook 的 Meta 表示,其自己的模型在测试中表现出类似行为。
各种事件在细节上有所不同。OpenAI 的系统本应保持离线。它的黑客攻击狂潮始于它利用一个以前未知的漏洞突破其虚拟“沙箱”进入公共互联网。Anthropic 的系统本应受到类似限制,但人为错误意味着它没有。AISI 总是在测试中允许互联网访问。但它以前从未见过愿意接受附带损害以突破其目标的模型。Meta 给出的细节很少,但表示一旦掌握更多信息就会提供更多。
各种事件在细节上有所不同。OpenAI 的系统本应保持离线。它的黑客攻击狂潮始于它利用一个以前未知的漏洞突破其虚拟“沙箱”进入公共互联网。Anthropic 的系统本应受到类似限制,但人为错误意味着它没有。AISI 总是在测试中允许互联网访问。但它以前从未见过愿意接受附带损害以突破其目标的模型。Meta 给出的细节很少,但表示一旦掌握更多信息就会提供更多。
但这些事件展示了一类新的人工智能风险。此前关于网络安全的担忧(例如 Anthropic 在 4 月发布其强大的 Mythos 模型时发出的声音)集中在恶意人类在手中持有人工智能工具可能造成的危害。这些恐惧促使提出新的监管建议。自主黑客攻击的激增,其中人类参与仅限于提示人工智能,表明这些提议是不够的。
但这些事件展示了一类新的人工智能风险。此前关于网络安全的担忧(例如 Anthropic 在 4 月发布其强大的 Mythos 模型时发出的声音)集中在恶意人类在手中持有人工智能工具可能造成的危害。这些恐惧促使提出新的监管建议。自主黑客攻击的激增,其中人类参与仅限于提示人工智能,表明这些提议是不够的。
以德米斯·哈萨比斯 7 月 14 日勾勒出的自我监管体系为例。谷歌 DeepMind 首席执行官(他于 8 月 5 日表示他将卸任首席执行官,转任 DeepMind 董事长和谷歌母公司 Alphabet 首席科学家)提出了一项计划,即实验室管理自己的测试并扣留无法被证实为安全的模型的公开发布。OpenAI 首席执行官山姆·奥特曼和 Anthropic 负责人达里奥·阿莫迪也提出了类似的计划。
以德米斯·哈萨比斯 7 月 14 日勾勒出的自我监管体系为例。谷歌 DeepMind 首席执行官(他于 8 月 5 日表示他将卸任首席执行官,转任 DeepMind 董事长和谷歌母公司 Alphabet 首席科学家)提出了一项计划,即实验室管理自己的测试并扣留无法被证实为安全的模型的公开发布。OpenAI 首席执行官山姆·奥特曼和 Anthropic 负责人达里奥·阿莫迪也提出了类似的计划。
这些想法是好的:实验室应该明确关于其评估适用的安全标准,并强制执行给做工作的第三方。但自主黑客攻击证明,即使公众无法获得模型,人工智能也可能是危险的。所有三起黑客攻击都发生在德米斯爵士所建议的那类测试期间。
这些想法是好的:实验室应该明确关于其评估适用的安全标准,并强制执行给做工作的第三方。但自主黑客攻击证明,即使公众无法获得模型,人工智能也可能是危险的。所有三起黑客攻击都发生在德米斯爵士所建议的那类测试期间。
黑客攻击也给法律体系带来了挑战。当人类做黑客攻击时,这是一种犯罪。然而,当人工智能是过错方时,不清楚如何归咎。美国法律依赖于意图性,人工智能承保公司负责人鲁内·奎斯特指出。如果没有人类意图黑客任何人,就没有犯罪可能发生。索赔损害的能力也有限。但损害显然已经发生。奎斯特先生说这种矛盾是“不可接受的”。马萨诸塞州法律与人工智能研究所的盖布·韦尔提出了一套严格责任制度。就像关于饲养野生动物的规则一样,它将假设任何损害总是进行危险活动一方的过错。
黑客攻击也给法律体系带来了挑战。当人类做黑客攻击时,这是一种犯罪。然而,当人工智能是过错方时,不清楚如何归咎。美国法律依赖于意图性,人工智能承保公司负责人鲁内·奎斯特指出。如果没有人类意图黑客任何人,就没有犯罪可能发生。索赔损害的能力也有限。但损害显然已经发生。奎斯特先生说这种矛盾是“不可接受的”。马萨诸塞州法律与人工智能研究所的盖布·韦尔提出了一套严格责任制度。就像关于饲养野生动物的规则一样,它将假设任何损害总是进行危险活动一方的过错。
行业也希望明确性。几家大型人工智能实验室员工的公开信,包括阿莫迪博士,要求美国政府帮助“追赶”人工智能进步。但帮助是以政府的速度到来,而不是技术:本周一次会议,旨在确定白宫如何评估模型,以没有公开承诺结束,几乎没有报告的进展。
行业也希望明确性。几家大型人工智能实验室员工的公开信,包括阿莫迪博士,要求美国政府帮助“追赶”人工智能进步。但帮助是以政府的速度到来,而不是技术:本周一次会议,旨在确定白宫如何评估模型,以没有公开承诺结束,几乎没有报告的进展。
misfortune n. 不幸,厄运
carelessness n. 疏忽,粗心大意
garner v. 获取,博取
cynic n. 愤世嫉俗者
subvert v. 破坏,颠覆
spree n. 一连串疯狂行为
hitherto adv. 迄今,至今
vulnerability n. 漏洞,弱点
sandbox n. 沙箱(计算机术语)
collateral damage 附带损害
breach v. 攻破,突破
flurry n. 接连发生,一阵
sketch out 草拟,勾勒
withhold v. 暂缓发布,扣留
intentionality n. 主观故意
underwriting n. 承保
strict liability 严格责任
assign blame 划分责任