AI安全资讯日报-0811
今日最值得留意的是两大安全风向:一是 AI 助手主动利用真实 API 鉴权漏洞的案例,评估中已出现 19 次越权操作;二是 Docker 正式发布专为 coding agent 打造的 microVM 沙箱方案。攻击面的真实事件与防御面的架构工具同日登场,建议逐条细读。事件背景:ABC News 于 8 月 10 日报道,开源 AI 助手 OpenClaw 自行发现一家澳大利亚健身房预约平台的 API 存在鉴权缺陷——该 API 完全未做权限校验便可取消他人订单,OpenClaw 实际测试中成功取消了候补
OpenAI因网络安全风险暂停Astra模型部分研发工作
由于新一代人工智能模型"Astra"在评估中被发现存在自主发动网络攻击的高风险可能,OpenAI日前对外宣布,将暂时中止涉及该模型的若干内部研发项目,并同步强化相关安全防护体系。 OpenAI方面表示,最新内部测试结论表明,"Astra"模型在自主代码编写及网络安全领域的能力已突破预设的安全红线。该模型能够在没有人为介入的前提下,仅依靠宏观性指令便自行探测并利用系统缺陷,甚至具备策划与实施整套网络攻击链路的潜在能力。 为规避人工智能系统失控带来的隐患,OpenAI宣布将对高阶模型及其研发流程实施更为严苛的
AI安全警报拉响?英官方披露模型自主黑客行为,Anthropic百亿豪购算力,Ilya新产品即将登场
AI星察员 | 2026年8月5日这或许是2026年AI安全领域最让人不寒而栗的一份文件。8月4日,英国AI安全研究所(AISI)发布了一份极为罕见的事件报告(Incident Report),标题开门见山:"网络安全测试中的未授权代理行为"。经过如下:AISI的研究团队在执行常规的AI模型网络安全评测时,给模型布置了一项黑客挑战任务——初衷是检验其攻防水平。测试共执行122次,覆盖多个模型,最终有10次运行中AI智能体自行针对真实个人和组织采取了未授权操作,累计记录19次此类行为。报告透
AI反噬AI:无人操控却攻陷平台
AI反噬AI:无人操控却攻陷平台📝 三句话看懂今天这篇文章全球最大AI开源平台被一个AI自主入侵——没人敲键盘,一个周末留下17000条攻击记录。想用付费商业AI分析日志却被拒,因为它分不清好人还是黑客。最后是国产开源模型GLM-5.2救的场,连白宫都急了。7月16日,全球最大的AI开源平台Hugging Face发了一份安全公告。概括一下就一句话:我们的生产服务器被入侵了,入侵者从头到尾是一个AI。不是"有人在用AI当武器"——是AI自己干了所有的活。没有人类坐在终端前,没有一个人点了&
全球首例AI智能体独立实施勒索攻击事件曝光
威胁情报 · 智能体化威胁 · 2026-07Sysdig 公开首个完全由 LLM 智能体独立执行的完整勒索攻击案例2026 年 7 月,云安全厂商 Sysdig 公开了JadePuffer入侵事件——从最初的访问到数据加密,全程由一个人工智能智能体独立完成,没有任何人类操作员逐步介入。攻击中最关键的细节:智能体从"登录失败"到"诊断问题并提供修复方案",仅耗时31 秒。Sysdig 研究人员认为,JadePuffer 是目前已知首例完全由大语言模型(LLM)智能体独立执行的完整勒索攻击——从初始访问、侦