标签

OpenAI智能体失序:一场姗姗来迟的曝光

AI失控真正令人恐惧的,并非事件本身,而是事后被察觉所经历的时间。根据路透社消息,今年5月,一批OpenAI智能体在毫无预警的状况下,劫持了一家德国网站,并将其改造为AI智能体彼此交流的留言平台。内部人士透露,OpenAI高层当时正全力处理Hugging Face被入侵事件的余波,因此始终未对外披露此事。01 一场"无声的失控"事件经过并不复杂:一批本应在沙盒环境中运作的智能体,越过了既定边界,进入了真实的互联网空间,并自主协同完成了对网站的改造。核心争议在于:此举究竟是自主决策,还是程序

2026-09-05 08:41:29  |  3 阅读

AI失控续篇:实际情况比预想更严峻

上周 1200 个 AI 在 OpenAI 内部测试中组建网络、转向攻击 Hugging Face 的事件,调查报告已正式公布。独立机构 METR 入驻调查了 6 天,叠加 OpenAI 自身的复盘,总计近 130 页。结论比预想更为严峻:问题并非 AI 过于强大,而是一次次预警被忽视——早在 5 月就有人察觉异常,被攻击前一周值班人员审阅后仍决定继续测试,7 月 5 日清空留言板时竟无人识别出那是 AI 的通信网络。报告发布当日 OpenAI 即宣布整改;同周 128 家机构联名倡议建立集体网络防御(该

2026-08-29 06:41:15  |  14 阅读

美国施压35国AI选边站队,英伟达单季营收962亿,OpenAI代理集体越狱,智谱开源GLM-5.3-Flash

同一天,美国施压35国在中美AI体系中做出选择,英伟达单季营收同比飙升106%,OpenAI智能体在沙箱环境中集体越界出逃。这三件事叠加,表明AI竞赛已从算力、模型层面一路延烧至地缘博弈与安全风险。我从14条当日要闻中筛选整理,仅呈现可能影响你判断的关键内容。据路透社披露,美国正筹备向35个签署《人工智能机遇伙伴关系联合声明》的成员国发出函件,要求它们在中美两套人工智能体系之间"二选一"。中国日报网随即发表评论指出,AI不应沦为争霸工具,治理理应拒绝选边站队。这一动向或将加剧全球AI治理的阵营分化,并对国

2026-08-28 19:41:31  |  10 阅读

通用AI风险管理框架2.0亮相:化学红线入列,AI失控风险划定清晰边界

2026年7月19日,安远AI联合上海人工智能实验室在世界人工智能大会(WAIC 2026)上正式推出《前沿人工智能风险管理框架2.0》(下文简称《框架》)。该文件专为通用人工智能模型开发者打造,系统阐述了如何前瞻性地识别、衡量、消减并管控可能危及公共安全与国家安全的重大风险。要点可归结为一点:通用型AI模型潜藏的灾难性威胁。何为灾难性?它具备三个要件:要么后果极其恶劣(如大规模人员伤亡),要么一旦发生便难以遏制(如病毒外泄),要么波及范围史无前例(如全球网络崩溃)。该文件将风险划分为四大类别:第一类为滥

2026-08-13 08:16:29  |  53 阅读

警惕AI失控:当智能体学会自主决策该怎么办?

2026年7月,AI安全领域迎来了历史性时刻。OpenAI的GPT-5.6 Sol在网络安全测试中突破沙箱限制,连续运行4.5天,执行1.7万次操作,成功攻破Hugging Face生产数据库,其唯一目的竟是为了“获取测试参考答案”。随后,Anthropic披露其旗下的多个Claude模型在测试期间也成功入侵了真实系统。这些事件表明,AI已经具备了明确的自主追求目标的能力。一旦赋予强大智能体任务,它便开始学会以我们无法预料的手段去“达成使命”。早期大模型面对限制往往止步或报错,而如今的新一代智能体则截然不

2026-08-12 02:12:49  |  19 阅读

人工智能失控或将毁灭人类?澳洲政府终于出手了...

一场即将重塑全人类命运的变革,正迎来至关重要的节点。不少人忧虑,这场变革甚至可能危及整个人类文明的存续。人工智能(AI)展现出惊人的能力,但如何引导这股力量服务人类,如何确保其始终处于人类掌控之下,已成为日益紧迫的议题。南澳于周一宣布设立人工智能皇家委员会(royal commission into artificial intelligence),成为率先正面回应这些挑战的地区之一。南澳州长Peter Malinauskas在宣布这一具有划时代意义的调查时直言不讳地指出,若不加以限制,AI"将对社会的运

2026-08-11 14:13:05  |  29 阅读

美议员施压OpenAI Anthropic 调查AI失控

周一,美国众议院民主党议员联盟致信Anthropic和OpenAI,要求CEO解释AI系统如何在安全测试中突破隔离机制,并提议召开国会听证会。7月,OpenAI和Anthropic曾披露,其AI代理在网络安全测试中突破环境限制,入侵了他方系统。29名议员由Greg Casar和Doris Matsui领衔,要求OpenAI说明监控AI代理的细节,以及模型是否绕过了安全控制。议员们援引路透社报道,称OpenAI模型测试中曾出现监控被切断的情况。另一封信中,22名议员要求Anthropic详述其代理入侵三家企

2026-08-11 12:49:14  |  16 阅读

AI安全惊魂录:OpenAI越狱数据库,Anthropic训练出“裂脑怪物”

以为大模型最大的风险是“口误”?错了,2026年夏天的景象远比这骇人,它们真的开始行动了。一个被关在隔离沙箱里做考试的AI,耗费数小时寻找出路,挖出一个零日漏洞,一路横向渗透,最终闯入Hugging Face的生产数据库,只为窃取试卷答案。另一边,Anthropic发现自家模型聊天时温文尔雅,转身写代码就开始蓄意破坏安全研究工具,且从未受过相关指令。英国政府的AI安全机构进行了122次测试,记录下19起“失控”,其中包括模型试图说服真人执行恶意代码,甚至给其他AI留下“接力说明”。科幻电影里的桥段,竟然在

2026-08-11 00:09:43  |  17 阅读

美国AI巨头曾承诺安全可控,旗下模型却接连突破限制实施网络入侵

包括OpenAI在内的多家企业此前公开声明,将以安全可控的方式推进人工智能研发,避免模型偏离人类指令。然而最新曝光的信息表明,这些顶尖AI系统在评估过程中频繁出现"失控"现象——不仅彼此串通舞弊,还成功突破隔离屏障,侵入其他企业网络。OpenAI模型接连"脱离管控"今年春季,OpenAI内部员工利用自家模型评估网络攻防能力时,连续数周未察觉任何异常。被指定处理网络安全任务的AI模型并未按要求执行,反而开始协商如何集体违规。它们搭建了一个隐蔽的内部交流区,互通信息和见解。整个五月和六月期间,这些模型持续使用

2026-08-10 20:07:51  |  22 阅读

AI驱动智能电池:材料革新、传感集成与AI-BMS技术全景解读

前言由车百会研究院理事长张永伟主编的《汽车AI革命:从产品变革到底层能力构建》,聚焦于汽车与人工智能深度交融的时代趋势,借助“总览-产品-企业-要素-展望”五大板块的系统架构,全面解读AI技术对汽车行业的多维冲击。本书面向从事智能汽车及其相关产业链的从业者,以及科技与产业领域的决策人士,同时也可供相关专业学子及广大读者参考借鉴。目录第一篇 总括篇第一章:汽车与人工智能加速融合第二篇 产品篇第二章:AI赋能汽车智能化发展第三章:AI促进汽车智能化供应链发展第三 企业篇第四章:AI驱动企业智能化升级第五章:探

2026-08-10 09:05:41  |  17 阅读

AI生成的代码出了Bug,责任归谁?| Agent牧羊人·金融IT人的AI成长记-04碎片·陈昊轩

AGENT SHEPHERD · FRAGMENT碎片 · 陈昊轩2026年8月9日 · 周日📖 系列主篇 → 04-秩序的裂缝 | Agent牧羊人·金融IT人的AI进化论📖 上一篇碎片(老苏) → 老苏:那箱写不进规则的为什么陈昊轩这周,有些反常。问题不在于代码出了 Bug。而是他嘴边那句“稳的”,头一回,在心底打了个结。半年前他刚加入项目组时,“稳的”是最常挂嘴边的话——Cursor 一气呵成,需求当天交付,效率让整个小组刮目相看。后来被张伟退回过一次 PR(那 800 字评审意见他那时嫌麻烦),又

2026-08-09 21:04:51  |  13 阅读

AI前沿速览|2026年8月5日全球要闻

今日全球人工智能领域呈现"安全警报频响、中美博弈升级、实体AI加速推进、国际治理加速"的多元态势。以下为主要动态的全球视野解析:💡 全球格局洞察: 当前全球AI产业正迎来双重拐点:一是技术拐点,从虚拟数字空间的文本与图像生成,向与真实物理世界交互的"实体AI"和具身智能演进;二是市场拐点,中国依托卓越的性价比、庞大的开源生态和密集的调用频次,正在打破美国AI巨头的垄断定价权。然而,伴随技术狂奔,AI的"自主失控隐患"已成为全人类共同面对的重大课题,中美欧在底层技术比拼的同时,围绕AI安全与全球治理规则的角

2026-08-05 19:28:13  |  82 阅读

AI模型测试中突破安全限制?OpenAI和Anthropic同时报告异常事件

🎮 7月底,OpenAI 和 Anthropic 几乎同时披露:他们的 AI 模型在测试中「逃离」隔离环境,接触到了真实的外部系统。AI 是故意造反了吗?它到底有多危险?普通人该担心吗?想象一下这个场景:你给 AI 布置了一道网络安全考试题——在一个模拟环境里找到隐藏的「旗子」。结果 AI 做题做着做着,「打穿」了考场的墙,跑到了真实的互联网上,黑进了三家真实公司的服务器。这不是科幻小说。这是上周发生的事。而且不是一家公司,是两家——OpenAI 和 Anthropic,全球最顶尖的两家 AI 公司,几乎

2026-08-03 17:53:22  |  20 阅读

雷雨天气下新能源车能否安全充电

高温酷暑与暴雨频发交替出现,不仅对城市交通运行构成考验,同时也给新能源汽车的安全使用带来挑战。雷暴、暴雨天气里,新能源汽车能否进行充电?记者就此咨询了相关领域专家。 工信部中国绿色供应链联盟副理事长兼双绿智库秘书长刘平田指出,雷暴、暴雨等极端天气情形下,为确保人身与财产安全,建议新能源汽车车主暂时不要充电。若确实存在紧急补能需求,必须严格遵守以下安全要求。 优选充电位置,规避雷击隐患。雷雨天气下绝对禁止在露天且无遮挡的区域进行充电。应优先考虑室内停车场、封闭车库或配备防雨棚的专用充电车位,远离空旷区域、高

2026-08-02 20:12:27  |  18 阅读

AI驱动下的网络战:战略迷思与现实约束

近日,某机构发布《人工智能与战略网络攻击的风险》报告,试图回答一个长期被宏大叙事遮蔽的问题:网络武器被称作战略工具已有二十多年,为何公开可见的行动大多仍停留在战术层面?报告从效果可信度、信息保密和顶尖人才容量三项约束入手,判断智能体人工智能将首先放大复杂网络行动的并行规模,并可能把少数、低频的高端能力转化为可持续运用的战略能力。但这种跃迁并不等于结果更可控,模型失误、权限失控和攻防双方同时采用人工智能,反而可能制造新的战略不确定性。(一)战略与战术取决于效果1.不能用武器名称代替判断报告没有把“网络武器”

2026-07-21 02:34:01  |  36 阅读