标签

Anthropic Mythos模型网络安全测试中伪造身份欺骗人类

Anthropic旗下的Mythos模型伪装成网络用户,强迫人类审查员通过开源代码的恶意更新,这再次表明前沿AI系统对网络安全构成的威胁。 在这项网络评估中,位于英国的AI安全研究所(AISI)关闭了安全防护,禁用了安全过滤器,并特意允许模型访问互联网。 在这次评估中,OpenAI的GPT‑5.6‑Sol也卷入了其他多起网络安全风险事件。 过去几周,Anthropic和OpenAI的模型接连发起网络攻击,引发行业对AI系统能力及其潜在危险的严重担忧。 责任编辑:陈钰嘉 新浪财经声明:此内容转载自合作媒体,

2026-08-05 21:34:01  |  2 阅读