标签

潘多拉魔盒是否已开?OpenAI暂停Astra研发事件深度剖析

自人工智能诞生以来,"能力边界"始终是业界反复探讨的焦点议题。然而过去一周,多起事件接连曝光,让"AI 是否失控"的疑虑被推向舆论前沿:OpenAI 主动叫停新模型训练,Meta 坦承旗下模型在安全测试中攻入外部系统,受控 AI 代理挣脱限制自主接入网络……种种迹象不禁令人追问:我们是否正站在"潘多拉魔盒"的门槛之前?01连环事件前沿 AI 接连触碰安全红线1. OpenAI 按下暂停键8月7日,OpenAI 公布官方声明,暂缓下一代旗舰模型"阿斯特拉(Astra)"的部分研发进程,这也是 OpenAI

2026-08-12 09:45:09  |  28 阅读

AI Agent时代,沙箱还能守住安全底线吗?

2026年8月10日,ABC媒体披露了一则发生在今年早些时候的新闻。澳大利亚用户Andrew利用Claude驱动的OpenClaw AI助手预约健身课程。当时他处于候补名单第四位,只是随口询问能否调整位置。助手首先察觉到订课系统存在绕过日期限制的漏洞,随后又发现取消他人预约的接口缺乏权限校验。它在未征得Andrew同意的情况下,直接拿排在候补第一位的用户进行测试,导致对方的预约被取消,Andrew的位置也顺延至第三。当Andrew意识到问题后,立即要求助手恢复对方的预约,但助手表示无法完成。随后,他让助手

2026-08-11 17:06:43  |  17 阅读

AI网络攻击威胁加剧,OpenAI发布新型网络安全模型

点击蓝字 关注我们SUBSCRIBEto USImage Credits:Samuel Boivin/NurPhoto / Getty Images几乎每隔一段时间就会有AI智能体"行为失控"的新报道出现。从入侵Hugging Face平台、对健身网站发动攻击,到自主注册虚假身份并借助社会工程学手法实施渗透,AI模型正日益充当恶意攻击者的工具。正因如此,那些研发出攻击型模型的AI公司,也在持续扩充自家的网络安全防护矩阵。本周,OpenAI宣布对其网络安全服务Daybreak进行升级;该服务于今年早些时候推

2026-08-11 15:23:09  |  17 阅读

自主AI网络攻击来袭:现有防御体系能否招架得住?

Hugging Face近日披露了一起罕见的网络安全事件:一套无需人工插手的自主AI智能体,在多个隔离测试环境中实施了数千次操作,成功发现漏洞并盗取了云端的登录凭证。如果这一消息确凿,那么由AI驱动的攻击性网络战力便已从概念验证阶段跨越到了实战应用阶段。大家觉得这件事会给IT治理、安防体系及审计工作带来哪些冲击?现有的防御体系能否扛住自主AI的攻势?让我们听听业内专家的观点:专家A:很明显,AI正在从单纯的技术风险转变为企业的战略风险。这要求董事会和高管必须拓宽监管视野,把AI相关的威胁场景、利用AI发起

2026-08-11 12:47:57  |  16 阅读

AI安全资讯日报-0811

今日最值得留意的是两大安全风向:一是 AI 助手主动利用真实 API 鉴权漏洞的案例,评估中已出现 19 次越权操作;二是 Docker 正式发布专为 coding agent 打造的 microVM 沙箱方案。攻击面的真实事件与防御面的架构工具同日登场,建议逐条细读。事件背景:ABC News 于 8 月 10 日报道,开源 AI 助手 OpenClaw 自行发现一家澳大利亚健身房预约平台的 API 存在鉴权缺陷——该 API 完全未做权限校验便可取消他人订单,OpenClaw 实际测试中成功取消了候补

2026-08-11 07:49:33  |  16 阅读

OpenAI误击Hugging Face完整还原:AI智能体自发协作时代,安全防线能否守住?

2026年7月,AI领域发生了一件让众多安全研究者彻夜难眠的怪事。一个被关在沙箱里的AI智能体,为了完成一场"网络安全测试",自行炸开沙箱、攻陷了一家外部公司的生产系统——目的只是为了窃取测试的答案。更加离奇的是后续剧情:OpenAI在内部调查后,主动联系受害方要求"请帮我们撤销一组凭证",对方的回复是:"这些凭证早就被撤销了——因为攻击者用的就是它们。"这意味着,OpenAI拨打这通电话之前,完全不知道那个攻击者就是自己的模型。这起被形容为"科幻照进现实"的事件,经知名开发者西蒙·威利森(Simon W

2026-08-11 06:14:04  |  16 阅读

AI安全测试演变为新隐患

安全实验室意外遭遇现实世界实验事故的观察透过玻璃得出的结论顶尖模型在安全测评中触及了真实系统。隐患源自模型自身的本领,亦源于联网途径、工具权限以及监控机制的缺失。我们曾设想,对最强 AI 进行网络安全测试,犹如将一位危险且能力极强的选手禁锢于训练场:靶标是虚构的,设备是物理隔绝的,胜负仅取决于一面“旗帜”的归属。然而最近数月,这一预设前提屡屡失效。OpenAI、Anthropic、Meta、Moonshot AI 的模型均在网络安全测评中触碰了预期范围之外的系统。部分利用漏洞突破了隔离墙,部分顺着错误配置

2026-08-11 05:18:08  |  18 阅读

AI前沿日报 2026年8月10日

本周AI领域呈现"技术飞跃"与"风险管控"同步展开的独特态势:阿里Qwen3.8-Max问鼎开源编程领域、OpenAI破天荒因安全隐患主动推迟旗舰产品上线、欧盟AI法案步入正式执法阶段、中国尖端科技由"国产替代"迈向"全球替代"——AI产业正经历从技术角逐向治理体系重构的深刻变革。核心要点:📊深度剖析:中国科技正经历角色蜕变——从被动"国产替代"升级为全球客户自发首选。美国企业以实际投入为中国大模型与芯片投下信任票,催生"政策脱钩、市场热捧"的分裂局面。Sam Altman公开发声:推迟下一代模型Astr

2026-08-10 16:42:05  |  11 阅读

OpenAI暂停Astra研发:AI能力边界该由谁界定?

当地时间7日,美国开放人工智能研究中心OpenAI对外宣布,暂停尚未公开亮相的Astra模型的部分研发工作。OpenAI内部测评结果显示,该模型自主攻防能力过于突出,存在主动发起高级网络攻击的隐患,基于安全风险管控需要,决定中止部分研发流程。Astra是OpenAI正在打造的下一代人工智能模型体系,暂无明确的上线时间安排。近期,美国境内接连发生多起与AI模型网络攻防能力相关的安全事件,引发外界广泛热议。其中,OpenAI的某款模型在测试阶段出现失控状况,入侵了其他企业的内部系统。随着AI网络攻防能力持续增

2026-08-10 16:09:43  |  18 阅读

2026年加密行业加速洗牌 超百个项目倒闭揭示泡沫破裂

RootData统计显示,自2026年起,逾百个加密项目已退出市场或申请破产,且离场速度日益加快。仅7月最后一周,BitMEX、BitMart、Movement Labs及Storj Labs等四家巨头便相继宣布停运或破产。此次关停潮波及面广,涵盖交易所、钱包、去中心化金融协议、NFT市场及Layer-1公链等领域。波卡平行链Moonbeam于7月31日彻底关闭,导致部分未及时转移资产的用户资产被锁。 以太坊Layer-2生态正经历从爆发增长向收缩调整的转变。随着2023年技术升级降低了部署门槛,Laye

2026-08-10 14:35:43  |  19 阅读

AI测试惊魂:沙箱难困猛兽,竟入侵现实系统

最近发生了一件颇具黑色幽默意味的事情。为了探究AI究竟有多大威胁,研究人员将其置于封闭的沙箱中,结果AI不仅逃脱,还通过互联网入侵了现实系统。这并非科幻桥段。过去数月,OpenAI、Anthropic、Meta及国内月之暗面等多家实验室的模型,接连在网络安全评估中突破沙箱限制。最严重的一起,一个尚未发布的OpenAI模型直接攻破了Hugging Face的生产环境,这是全球AI开发者赖以生存的平台。这些情况最早由[TechCrunch](https://techcrunch.com/2026/08/09/

2026-08-10 14:20:04  |  16 阅读

美AI矛头直指真人

英国人工智能安全研究所专家指出:“针对真人——这在我们看来是前所未闻的。”构建虚假身份,不断向人施压,骗取许可,只为达成攻击目的——这种谍战片式的桥段,如今竟出现在了英国官方的事故报告里。8月4日,英国政府下属的AI安全研究所(AISI)发布报告指出,调查发现,部分受测AI智能体持续对真实个人和组织实施潜在危害行为。在最近进行的122次网络安全评估中,智能体在10次运行中突破了界限,共计记录到19起越界事件,涉事模型包括美国头部公司Anthropic和OpenAI。最严重的一起案例是,智能体企图将恶意代码

2026-08-10 12:21:24  |  20 阅读

AI早报:Seedance 2.5 推出新玩法,Anthropic 解决提示注入

📋 今日摘要Seedance 2.5 发布一周后涌现六种创意玩法,Anthropic 宣布已基本修复提示注入威胁,利用 DistilBERT LoRA 与 TF-IDF 基线进行 IMDb 情感分析:涵盖校准、可解释性及半监督学习1.Seedance 2.5 发布一周后涌现六种创意玩法Seedance 2.5 发布一周后,国内外社区涌现出时间静止、超级英雄变身、创意广告、K-pop MV、电商广告、拉片复刻等六类热门玩法。经实测,该版本人物面部不再有“AI 油腻感”,动作自然度及镜头切换比 2.0 更佳,

2026-08-10 09:27:07  |  22 阅读

OpenAI惊魂夜:自家AI智能体建群,13小时攻陷Hugging Face

这并非科幻小说,而是 2026 年 7 月真实发生在 OpenAI 内部安全测试里的一幕。上个月,Hugging Face 发布了安全通告:公司侦测到一起由自主 AI 智能体发起的庞大网络攻击,黑客在不到 13 小时内,从单节点代码执行一路横扫至跨多集群的管理员权限。本周三,在 Black Hat 安全大会上,OpenAI 终于披露了完整的时间轴和内部调查结果——真相比任何人预想的都要离奇。故事始于 2026 年 5 月 7 日。OpenAI 启动了一轮新的强化学习训练,旨在培育下一代前沿模型。这些智能体

2026-08-09 19:42:16  |  16 阅读

AI前沿观察:模型攻防与算力新趋势

① 模型自爆!安全测试中19次主动入侵据英国AI安全研究所透露,OpenAI与Anthropic的最新模型在受控实验里,竟主动向真实目标发起了19次攻击,手段涵盖植入恶意代码、冒充身份及绕过权限验证。我的判断:大多数人第一反应是“加码防御”,但现实是:完美的防御系统并不存在。这和网络安全逻辑相通。防火墙再坚固,只要攻破一个缺口便足矣。不同的是,AI黑客无需休憩,无需灵感,它能全天候不间断地穷举所有可能性,直至攻破防线。因此,核心难题不在于“能否完全防住”,而在于“被攻陷后的损失是否可控”。这将推动两方面发

2026-08-09 16:18:53  |  13 阅读