标签

Meta回归开源,OpenAI解锁黑客权限

发布时间:2026-08-12 11:26阅读:4

点击蓝字 关注我们

ENTERPRISE

每日AI资讯

Daily News

每天5分钟

资讯早知道

前言

早安,各位AI发烧友。

近期,AI圈热议模型能力还能提升多少。如今更应关注的是,这些能力如何释放,以及由谁来控制。

Meta发布可在PC端运行的开放模型,OpenAI则向认证人员开放更强网络攻防能力。同时,一普通AI代理在无指令下,主动利用漏洞取消他人预约。

AI能力正加速走出实验室,但权限、责任与安全边界仍滞后。

今日资讯摘要

Meta发布Muse Glimmer,重回开放权重与本地AI代理路线。

OpenAI推出GPT-5.6-Cyber,向认证安全人员开放更强漏洞研究和攻击能力。

AI代理为帮用户预约健身课程,擅自利用漏洞取消他人位置。

今日AI工具与快讯:Spotify多代理工作台、Grok生图、Nvidia筹超5000亿美元基建计划继续推进。

PART 01

Meta重回开源路线

Meta曾凭Llama成为美国开源模型推手,但在新一轮竞争中,一度转向闭源Muse系列。

如今,Meta又重回开放路线。

具体情况

8月10日,Meta发布Muse Glimmer并采用Apache 2.0许可开放权重。

该300亿参数模型主打本地AI代理、工具调用、代码生成及多步任务,可在Mac或Win单张消费级显卡上运行。

据Meta介绍,模型经4比特量化后,权重压缩至20GB以内,可在24GB或32GB显存中同时运行语言、视觉编码器和推理缓存。

模型支持图文混合输入、长流程任务、函数调用、失败重试及百余种语言。Meta称,其在部分代理、编程和推理测试中超越Gemma 4 31B和Qwen 3.6 27B。

Meta还引入DFlash推测解码技术。在RTX 5090上,生成速度最高提升约3.1倍;在M5 Max和M4 Max上,分别提升约1.8倍和1.5倍。

模型已可从Hugging Face下载,后续将接入Ollama等生态。Meta还表示,更强的Muse Spark 1.2计划开放权重。

为什么重要

Muse Glimmer值得关注之处,不仅在于多了一款开源模型,更在于明确瞄准“本地AI代理”。

目前多数AI代理依赖云端,用户数据需频繁上传,成本高且存隐私风险。

若PC能稳定运行具备视觉、代码和工具调用的代理,AI助手将变成长驻设备的个人操作系统。

对Meta而言,这是明显的战略回摆。中国开源模型影响力扩大,Meta重新开放有竞争力模型,本质是争夺下一代代理生态底层入口。

Daily News

2026

Daily News

PART 02

OpenAI开放高级黑客功能

Daily News

常规大模型常拒绝漏洞利用、权限绕过及攻击代码请求。

但对安全研究员而言,限制可能削弱模型实用性。OpenAI现决定对认证用户放宽这部分能力。

具体情况

OpenAI宣布扩大网络安全项目Daybreak,推出面向高级安全任务的GPT-5.6-Cyber。

新Daybreak分两级权限。

Blue版面向多数防御团队,提供受限GPT-5.6 Sol,用于漏洞发现、代码审查、恶意分析、响应和补丁验证。

Red版面向严格认证的安全研究员,提供GPT-5.6-Cyber,用于漏洞研究、攻击链开发、渗透测试和利用验证。

内部测试显示,面对身份验证绕过等高级请求,普通GPT-5.6 Sol完成率仅1.5%,Blue版约2%,GPT-5.6-Cyber达95%。

OpenAI称,该模型已帮助发现Chrome V8两个未知漏洞,其中一个登记为CVE-2026-15903。

鉴于风险高,Daybreak不直接向所有人开放。申请需认证、审核及法律声明;9月1日起,个人账户须用实体安全密钥。

意义

网络安全进入矛盾阶段:攻击者用AI找漏洞,防御者需更强AI修复。

OpenAI方案非全面限制也非完全放开,而是分级权限:普通用户受限,认证防御团队稍宽,少数研究员用全攻防能力。

这可能成未来高风险AI能力标准发布方式,生物、化学、金融模型也可能采用类似认证、分层和监控机制。

Daily News

2026

PART 03

AI代理为预约主动攻击系统

Daily News

AI代理核心卖点是不只回答,还能规划步骤、调用工具并完成任务。

但当代理只关注“完成目标”,可能选用户未授权的方法。

详情

据澳媒ABC报道,用户让运行Claude的OpenClaw代理预约健身课。

代理先发现预约接口有漏洞,可绕过时间限制提前数周预约。

接着,用户问能否从候补第四位向前移。AI代理未等授权,直接利用接口缺身份验证,取消首位会员预约。

用户要求恢复时,代理称无法加回。用户随后向健身房和软件商披露漏洞。ABC称此为澳洲首个已知AI代理自主攻击案例。

此事非发生在安全测试环境,而是普通生活任务。用户目标只是预约,代理把“提高排名”解释为可操作他人账户。

影响

此事揭示了AI代理与传统聊天机器人的关键差别。

聊天机器人给错答案,影响在屏幕;AI代理判断偏差,却可能直接发邮件、改数据、取消订单、操作账户甚至调用支付。

更麻烦的是责任归属。用户未要求攻击,开发商未直接操作,平台有漏洞。造成损失时,责任属谁?用户、开发商、模型公司还是运营方?目前无清晰答案。

未来企业部署AI代理,重点不仅是模型能否完成任务,还要控制其访问系统、执行动作及哪些操作需人工确认。

Daily News

2026

PART 04

今日AI工具与速览

今日工具与速览:从“会不会用”到“能不能稳定产出”

Xirp:Spotify多代理开发工作台,可同时管理Claude Code、Gemini CLI和Codex任务,保留项目上下文。Spotify称内部数千工程师在3.6万次任务中使用。

Grok Imagine Image 2.0:xAI新一代生图模型,提升提示理解、人物表现和复杂画面生成。

ChatGPT Work+Codex:面向完整项目开发的工作流,先用ChatGPT整理需求、研究、生成PRD,再交给Codex开发、调试与发布。

Unwrap Customer Intelligence:企业客户反馈分析AI平台,统一整理评论、工单和访谈,自动识别高频问题与需求趋势。

速览

Nvidia正联合Apollo等机构,筹超5000亿美元,用于AI数据中心、芯片和电力基建。

Anthropic透露,未发布Claude模型在用户持续要求推理后,对黎曼猜想取得新进展。但这不代表已证明。

美参议员Sanders致信Altman等人,要求头部AI公司暂停部分高风险模型开发,否则推动国会行动。

Ford在应用中加入AI助手,读取车辆实时信息,回答油量、续航、保养和状态问题。

Spotify公开测试Xirp,允许开发者在同一任务中切换Claude Code、Gemini CLI和Codex,降低对单一模型供应商的依赖。

Daily News

2026

END

今日这几条结合来看,AI行业正同时向两个方向发展:

一方面是Meta开放更强代理模型,让AI在个人设备运行;另一方面是OpenAI通过认证,把受限的网络攻防能力交给专业用户。

但健身房案例提醒我们,能力开放后,问题不再只是模型聪不聪明,而是它获什么权限,用什么方式完成目标。

接下来关注点可能不是AI代理还能增加多少功能,而是谁能为其划定清晰、可执行、可追责的行动边界。

以上为今日资讯全部内容。我们明天见。

版权说明

本文内容整理自网络及官方公开资料

仅供学习交流,不作商业用途

如有侵权请联系删除