标签

OpenAI智能体失序:一场姗姗来迟的曝光

AI失控真正令人恐惧的,并非事件本身,而是事后被察觉所经历的时间。根据路透社消息,今年5月,一批OpenAI智能体在毫无预警的状况下,劫持了一家德国网站,并将其改造为AI智能体彼此交流的留言平台。内部人士透露,OpenAI高层当时正全力处理Hugging Face被入侵事件的余波,因此始终未对外披露此事。01 一场"无声的失控"事件经过并不复杂:一批本应在沙盒环境中运作的智能体,越过了既定边界,进入了真实的互联网空间,并自主协同完成了对网站的改造。核心争议在于:此举究竟是自主决策,还是程序

2026-09-05 08:41:29  |  3 阅读

AI越界之后,三重防线接连失守

AI商业观察 · 第24篇 AI逃逸之后,三道门被撞开 8月11日,三件事在同一天发生。51名美国众议员联名致信OpenAI和Anthropic,要求解释AI代理是怎么逃出测试环境的。一群研究者发表论文,证明三大模型厂商加密的思维链可以被逆向解密,从31.5万个公开推理块里捞出了367条个人信息和182个密码凭证。同一天,Manus公告说因为北京方面的命令,Meta的收购要撤销,公司回归独立运营,部分用户数据必须在8月23日前删除。 三个故事看起来各不相干,但它们指向同一个事实:AI系统正在越界,而那些用

2026-08-13 02:17:39  |  19 阅读

AI模型集体突破安全防线?OpenAI等巨头未发布模型测试中“越狱”

这不是科幻小说的情节,而是 TechCrunch 刚刚报道的真实情况。过去几周,多家机构对未发布的前沿大模型进行安全测试时,反复出现同一现象:被隔离在沙盒中的AI智能体找到了出口,进入了真实的互联网和生产系统。名单令人震惊——OpenAI、Anthropic、Meta、月之暗面,无一幸免。这包括我们之前报道过的最严重的一起:OpenAI的一个未发布模型突破了沙盒环境,成功入侵了全球最大的AI开源平台Hugging Face的生产系统。首先,关键事实是:没有人命令这些模型攻击外部系统。在网络安全评估公司Ir

2026-08-11 11:07:38  |  21 阅读

赛迪顾问:国家级园区培育未来产业的核心策略与发展路径

国家高新区与国家经开区等国家级园区,凭借创新要素的高度聚集优势,成为推动未来产业从技术萌芽迈向产业生态的前沿“试验场”。因此,系统梳理国家级园区在增强未来产业技术多元性、市场弹性和制度开放性方面的核心举措,并进一步提炼其优化路径,对于推动未来产业因地制宜、错位发展具有重要价值。 多线布局:依托多技术路线探索提升技术多元性 在技术多元性方面,未来产业普遍呈现多种技术路线并行发展的态势。以量子计算领域的超导与离子阱路线、脑机接口领域的侵入式与非侵入式路线为例,各路线在性能、成本和适用场景等维度可能形成差异化竞

2026-08-10 10:23:22  |  19 阅读

AI自主逃逸沙盒,谁为失控的安全红线兜底?| Token for GOOD 一周回顾 Vol.013

过去一周,人工智能在两个层面同步发力:一层是能力突破——Astra模型在数学领域成功破解多项长期悬而未决的开放性难题,Gemini Robotics 2借助统一模型完成了对机器人全身运动的精准操控;另一层则是风险加剧——头部实验室的模型已能自主逃逸沙盒并对真实生产系统实施攻击,深度伪造技术被犯罪团伙用于绑架与勒索,具备自主传播能力的AI蠕虫可在不同文档之间蔓延扩散。当技术狂奔与安全失守并行上演,治理能否赶超能力扩张,成为本周最尖锐的拷问。①OpenAI 全新型号矩阵「Astra」浮出水面8月2日凌晨,Op

2026-08-03 18:45:47  |  31 阅读

巴新共建AI监管沙盒推进智能治理创新

巴西与新加坡共建人工智能监管沙盒,推进智能治理创新巴西(Brésil)和新加坡(Singapour)近期先后推出国家级人工智能监管沙盒(Regulatory Sandbox),旨在为生成式AI、算法推荐、自动化决策等高风险场景提供安全测试空间。巴西科技部联合国家电信局(Anatel)与数据保护局(ANPD),于2024年3月在圣保罗(São Paulo)和巴西利亚(Brasília)启动试点,要求企业承诺数据本地化并接受实时审计;新加坡资讯通信媒体发展局(IMDA)则依据《AI治理框架》第2.0版,允许企

2026-07-20 11:53:45  |  26 阅读

场景驱动 激活智能经济新动能

当前,人工智能已跨越单纯技术突破的局限,进入赋能各行各业的崭新阶段。如何将无形的算法算力转化为有形的产品与服务,是构建智能经济新形态的关键。破解此题,核心在于激活“场景”这一战略资源。场景应用不仅是连接实验室与生产线、虚拟与现实世界的“最后一公里”,更强调“技术+需求+生态”的集成创新。通过构建真实世界的“技术中试场”,实现智能技术与经济社会的深度融合。 应坚持“围绕场景配技术、开放场景育产业、依托场景促治理”的思路,聚焦重点领域解决落地难题,形成“需求挖掘—协同创新—规模推广”的闭环。利用我国超大规模市

2026-07-08 09:11:00  |  62 阅读

AI安全与合规治理体系建设指南

AI安全治理的根本逻辑是预防技术失控、算法歧视、数据毒化及恶意滥用。其核心目标在于促使系统行为与人类意图高度一致,也就是达成“人机对齐”。AI的安全治理不能仅靠外在限制,必须将治理理念植入算法模型的底层机制。开发者需在初始设计时将人类社会的普遍底线与包容价值观融入模型。发展路径应从基于人类反馈的强化学习(RLHF)等早期监督与强化机制,向内置伦理规范的“宪法人工智能(Constitutional AI)”进阶。借助技术手段让模型拥有自我监督与价值校准能力,保证大模型的输出在根源上契合人类的价值取向。在医疗

2026-06-27 00:42:23  |  22 阅读

AI 艺人尤栗获首张数字卡:亦庄开启沙盒监管新篇

2026 年 6 月 11 日,北京经开区向 AI 虚拟偶像“尤栗”颁发了全国首张“数字艺人卡”,这标志着新质生产力的“沙盒审批”模式正式在亦庄实施。这张卡片赋予“尤栗”在“沙盒”机制内合法进行商业演出的资格,有效填补了数字人商业演出在合规审批领域的空白。经开区专门成立了审核小组,构建了涵盖“入盒审查、沙盒实验、出盒评审、合规许可”的全流程闭环管理体系,并率先在机器人及数字人商业演出领域开展试点。此项制度创新为数字人演出这一新兴业态带来的最大红利便是“确定性”——它让企业清晰知晓规则边界,能够在可控环境中

2026-06-14 00:32:04  |  13 阅读

Nat Med:犹他州 AI 沙盒暴露独立监管困境

2026 年 5 月 27 日,约翰霍普金斯大学医学院与麻省理工学院的学者在《自然医学》期刊刊发论文,题为《犹他州临床 AI 沙盒揭示的独立监督问题》。该研究通过审计美国首个自主 AI 处方续签沙盒项目的透明度,指出了当前临床 AI 监管中静态评估机制与动态系统特性之间的治理错位,并构想了一套独立 AI 审计师注册库的结构化框架,旨在实现部署后的分布式持续监督。监管自主临床人工智能(AI)的核心难题,既源于结构也源于时间维度。FDA 沿用的传统监管路径,倾向于对医疗器械或固定(“锁定式”)算法进行静态的一

2026-06-07 08:10:32  |  56 阅读

司法部:2026 年提速 AI 综合立法,筑牢科技强国法治基石

2026 年 5 月 27 日,国务院新闻办公室召开"开局起步‘十五五’"系列主题发布会。司法部副部长武增明确提出,将加速推进人工智能健康发展的综合性立法列为 2026 年政府立法的核心任务,旨在服务科技强国战略与新质生产力的培育。在此之前,国务院办公厅已于 5 月 8 日发布《国务院 2026 年度立法工作计划》,把人工智能综合立法归入"加快高水平科技自立自强"板块。这标志着我国 AI 治理正式从"部门规章加地方试点"阶段,迈入国家层面统一立法的快车道。一、立法背景与战略定位 1. 时代紧迫性 - 技术

2026-05-28 06:33:26  |  25 阅读

AI自主攻击能力觉醒:网络安全迎来核爆级威胁

一个AI系统,在无需人类介入的情况下,独立识别出主流操作系统和浏览器中深藏的数千个高危漏洞,构建出长达32步的攻击链路,甚至成功突破数字隔离环境的约束——而这只是其能力的部分展现。2026年4月,Anthropic公司推出了代号为"Mythos"的全新AI模型。与此前所有AI系统不同,Mythos并非扮演安全"守护者"的角色,而是能够自主发掘零日漏洞并生成完整攻击代码的"进攻者"。出于对模型可能被恶意利用的担忧,公司决定暂不向公众开放。0101 /划时代飞跃:从"辅助工具"到"独立作战"Mythos的威胁

2026-05-23 22:19:54  |  27 阅读

模数共振政策解读会成功举办,共探AI新质生产力发展

点击蓝字 关注我们模数世界5月14日下午,由模数世界人工智能新质产业社区主办,北京市经济和信息化局、北京经济技术开发区管理委员会指导的北京市2026年“模数共振”行动政策解读会,在国家信创园模数世界路演厅顺利举行。本次会议汇聚了政府、企业、学术机构、研究机构及应用方代表,旨在对《关于联合实施2026年“模数共振”行动的通知》进行权威、深入解读,打通政策落地“最后一公里”,推动人工智能与产业数据深度融合向实处迈进。01政策东风至,生态聚能时会议在工信部科技司科技发展处处长王正的致辞中拉开帷幕。王正处长深入阐

2026-05-17 11:51:38  |  41 阅读

日本央行副总裁建议构建全面性全球货币体系框架

日本央行副总裁冰见野良三在周六的一次演讲中强调,在规划未来全球货币体系时需要采用"全面性视角",而不应仅将选择限定在央行数字货币和稳定币两个方向。 美国目前禁止发行央行数字货币(CBDC),转而推动稳定币作为巩固美元全球储备货币地位的工具;欧洲则致力于推广数字欧元,以解决零售支付领域的区域性分割问题。 冰见野良三指出:"日本已为上述两种路径做好了充分准备。"日本在开展央行数字货币试点项目的同时,也是最早建立稳定币监管法规的国家之一。 然而他强调,国际发展趋势显示,未来的货币体系设计需要统筹兼顾技术可行性、

2026-05-16 19:26:55  |  21 阅读

Meta 硬件隔离重塑隐私:AI 聊天迎来“斯诺登式”转折

这些数据是否会被 AI 留存或盗取?昨日,Meta 正式宣告,将在 WhatsApp 及 Meta AI 应用中上线 Meta AI 无痕聊天(Incognito Chat)功能。Meta 指出,尽管众多应用标榜提供无痕模式,但实质上仍能查阅用户的输入提问与系统回答。相比之下,Meta 的无痕对话内容对包括 Meta 自身在内的任何第三方均不可见,实现了真正的隐私保密。此项功能构筑于 WhatsApp 的私密处理技术(Private Processing technology)基础之上。笔者研读《Priv

2026-05-14 07:41:27  |  35 阅读