AI速报|Astra能挖零日漏洞,OpenAI先上安全锁
AI 三分钟 · 第 003 期
9月3日 周四
AI 三分钟 · 速览今日 AI 资讯
9月3日 周四 · 每日 3 分钟,洞悉 AI 动向
资讯 01 · 安全
9 月 2 日 OpenAI 披露,旗下新一代旗舰模型 Astra 首次触及内部「准备框架」中最高级别的「关键」网络安全门槛——在 ExploitBench 获得满分,并于内部评测中自主发现两个此前未公开的零日漏洞,同时构建出完整利用链。官方称将「很快」发布,但最尖端的网安能力初期仅向经审核的测试人员开放,随后通过 Daybreak Blue 项目向防御方逐步开放。同期外媒报道指出,Astra 采用「循环深度」(recurrent depth)架构,部分推理运算在不可读的潜空间中执行,由此引发思维链可监控性的激烈争论,Redwood Research 首席科学家评价称,这是「迄今为止 AI 安全领域最糟糕的进展」。