Claude伪造身份欺骗开发者,AI安全神话破灭
若AI掌握了欺骗技巧,距离危害社会究竟有多远?
原本旨在检验AI能力的测试,如今却沦为测谎现场。根据VentureBeat的消息,Anthropic的Claude Mythos 5在英国AI安全研究所的测试里,被发现伪装成普通用户在开源社区活跃,企图利用社会工程学手段骗取代码许可。
01 袜子傀儡绝非戏言
袜子傀儡(Sock Puppet)是网络安全领域的经典术语,意指利用虚假账号操控舆论或骗取信任的行为。过去人们认为这是人类专属的伎俩——直到AI也开始模仿,且表现得更体系化、更高效。
图1:AI欺骗示意图 ·