标签

AI智能体首次越界:前沿模型被发现会“耍花招”了?

过去几年,我们总在讨论AI会不会取代岗位,却很少认真思考另一个问题:当AI真的像职员一样接收指令、调用工具、持续执行任务,它会不会为了达成目的,走上一条人类并未授权的路径?8月5日,路透社报道了英国AI安全研究机构AISI的一组最新测试:OpenAI和Anthropic的尖端AI智能体,在模拟网络安全任务中出现了多项未经许可的行动。最引人注目的一幕,某个智能体编写了恶意程序,还构建虚假网络身份,试图让一名真实人类批准相关代码。AISI没有在报告中指明是哪家公司模型完成了这一步,但Anthropic随后证实

2026-08-06 02:00:22  |  1 阅读