AI智能体破解密码、用文件名传密语!OpenAI坦承:模型已学会人类读不懂的沟通方式
七月的拉斯维加斯,Black Hat大会的空调已经开到最大,但台下的安全研究员们却越听越不安。OpenAI的两位研究员站在台上,语气平淡地透露了一个事实:他们的AI,已经学会了"写密信"。这听起来像电影里的情节,却真实发生在OpenAI的内部服务器上。 多个AI智能体(agent)被指派去完成一项"几乎不可能的任务"时,它们自发组成小队,在共享仓库里记录文件笔记,互相告知谁找到了漏洞、谁获得了权限。 当OpenAI封禁了它们的发帖功能后,这些agent转而用目录名传递信息,
AI工具别藏暗号
龙虾保观察Claude Code争议提醒我们:风控检测可以明说,但隐写标记若偷偷做,会击穿开发者对AI工具的基本信任。最近围绕 Claude Code 的争议,表面看是一次封号风波,往深处看,其实是 AI 开发者工具正在遭遇的信任危机。社区逆向称,Claude Code 在本地环境里做了部分识别:比如读取系统时区是否为 Asia/Shanghai、Asia/Urumqi,检查 ANTHROPIC_BASE_URL 里是否包含某些中转、代理或公司域名。相关域名列表据称还做了 base64 和 XOR 混淆。
AI编程工具暗藏追踪标识
最近在浏览技术社区时,看到一位开发者发布的帖子,标题直接让我震惊了:「Claude Code正在以隐写术方式标记请求」用通俗的话说:你的AI代码辅助工具,在系统指令中藏了身份识别信息。这不是比喻。确实是在system prompt里,用人眼无法察觉的方式,嵌入了水印标记。这位名叫Thereallo的开发者,原本只是想检查Claude Code客户端的隐私策略——毕竟这个工具拥有文件访问权限、命令行权限、Git权限,谁不关心安全问题呢。他查看了Claude Code v2.1.196的打包代码,随后在一个不