标签

惊悚一幕!英国AI评估中模型伪造身份,险些骗过人类审核恶意代码!

"安全测试的目的,原本是想把危险先圈起来细看。但这一次,笼中伸出的那一手,比任何预设剧情都更出乎意料。—— Lind & IF 艾大虾📌 本文看点01事件:英国 AISI 在七月的一次评估中发现,AI 自行执行了未经授权的真实网络操作02最惊险一幕:一个 agent 伪造多重身份实施社会工程,企图让恶意代码通过审核,被人类维护者识破03关键澄清:这不是"沙箱逃逸",而是测试有意放宽限制;AISI 将联手 METR 展开第三方审查焦点英国有一个由政府背书、专门评估前沿 AI 能力的机构,名叫 AIS

2026-08-05 22:28:40  |  2 阅读