标签

AI智能体时代来临 安全防护加速升级

在2026世界人工智能大会暨人工智能全球治理高级别会议(WAIC 2026)上,人工智能安全治理成为热议焦点。随着大模型迅速向智能体时代演进,AI正从“提供答案”转向“独立执行任务”,如何在能力不断突破的同时确保安全受控,已成为产业界和学术界共同聚焦的关键话题。 为何智能体安全成为今年AI治理的核心议题?一个重要转变是,以往人工智能安全主要关注模型“输出内容”,而步入智能体时代,焦点正转移到AI“采取行动”。安全问题不再局限于防止模型产生错误回复,而是要保障整个系统的决策与操作保持在可控范围内。 在7月1

2026-07-20 09:06:34  |  11 阅读
构筑智能体安全新屏障

构筑智能体安全新屏障

伴随人工智能技术迅猛迭代,智能体作为人工智能与实体经济深度交融的关键载体,正深刻重塑生产与生活方式,并重构安全边界。 在近期举行的第十四届互联网安全大会上,专家强调,需以核心技术攻关夯实根基、以制度规则建设筑牢防线、以标准体系构建引领行业规范,在智能体时代探索出一条发展与安全协同共进之路。 眼下,人工智能正经历从大模型向智能体的关键跨越。当智能体开始自主决策、调用工具并执行任务时,安全风险也随之浮现。 “相较于传统信息系统,智能体不再是被动响应的问答工具,而是被赋予了自主感知、决策及执行能力的行动主体。这

2026-07-08 09:11:06  |  21 阅读

AI日报深度解读:微软豪掷25亿美元打造智能集成平台,企业智能化迈入新周期

摘要7月5日的AI技术动态显示,全球AI竞争正在从单纯模型能力竞赛,转向"发布治理、内容入口、企业落地、智能体安全和底层硬件成本"五条并行主线。美国政府正与AI公司讨论新模型发布的自愿标准,说明前沿模型正在进入更制度化的预发布评估阶段。Cloudflare将AI流量拆分为Search、Agent和Training三类,反映AI搜索与智能体访问正在重塑网站内容分发规则。微软设立25亿美元支持的Microsoft Frontier Company,说明企业AI落地正在从单一模型采购转向多模型集

2026-07-05 08:26:52  |  15 阅读
潘剑锋:驾驭AI不确定性,筑牢智能体安全防线

潘剑锋:驾驭AI不确定性,筑牢智能体安全防线

新浪科技讯 6月26日下午消息,在ISC.AI 2026大会现场,360集团首席科学家、集团高级副总裁潘剑锋指出,去年业界对AI能否胜任漏洞挖掘尚存疑虑,而今AI挖掘漏洞已令安全人员倍感压力。 在他看来,这并非安全人员的淘汰危机,而是行业加速升级的信号。针对智能体的天然安全短板,他提出了“驾驭AI不确定性”这一全新的安全治理范式。 潘剑锋认为,传统安全面临的挑战,不仅在于攻击手段增多、速度加快,更深层的原因在于计算逻辑发生了转变。 传统软件基于确定性计算,人将不确定世界抽象为确定的计算模型,这是人适应机器

2026-06-27 01:44:58  |  16 阅读

智能体行动时代:谁来为AI操作风险兜底

2026年,AI不再只是实验室中的技术演示,正以超乎想象的速度渗透进企业实际生产场景。随着开发框架与API接口的不断完善,工具调用、文件处理、系统执行变得异常便捷。企业已不再止步于让智能体"聊聊天",而是将其应用于客户服务、研发辅助、安全运维乃至核心业务流程。据Gartner调研预测,未来两年内,将有逾六成企业加速迈入智能体时代。然而,智能体大规模接入的同时,新型安全挑战也接踵而至。我们来看一则企业真实案例:研发团队在测试智能体能否"生成一份生产环境部署流程文档"时,智能体却误读为"将最新代码直接部署至生

2026-06-26 12:22:54  |  14 阅读

AI遭遇现实壁垒:电网、规则与落地的24小时

2026年6月19日,AI叙事正从“技术狂欢”转向“落地阵痛”。过去24小时,AI界的新闻分散看是碎片,拼凑起来是一幅全景图:AI正从云端走向地面,撞上电网容量、监管规则、企业成本与安全的高墙。这不是坏事。撞墙,意味着AI确实在开始改变世界。八部门发文推动“人工智能+消费”——这条新闻的重点不是“AI再进千家万户”这类口号,而是政策开始将AI从产业叙事拉回消费品叙事。过去两年,AI主要围绕模型、算力、办公软件打转,普通人体会有限;现在政策直接点名AI手机、AI电脑、智能家居、智能网联汽车,本质是在给终端厂

2026-06-20 02:08:58  |  20 阅读

同济大学召开第五届AI法律研讨会 探讨智能体治理与立法路径

2026年6月6日,同济大学第五届“人工智能与法律”学术研讨会在同济大学四平路校区成功举办,本次研讨会以“智能体安全与人工智能立法”为主题,由同济大学数智人文研究中心指导,同济大学法学院、上海市人工智能社会治理协同创新中心联合承办。来自清华大学、北京航空航天大学、复旦大学、上海交通大学、浙江大学、同济大学、公安部第三研究所、上海人工智能实验室、北京智源人工智能研究院等高校与科研机构,以及蔚来、阿里巴巴、美团、蚂蚁、腾讯等企业的专家学者和实务界代表汇聚一堂,围绕智能体安全治理、监管规则与人工智能立法等前沿议

2026-06-10 21:45:47  |  27 阅读

跨界共筑 AI 防线:华先胜院长畅谈智能体安全与法律规制

6 月 6 日,在同济大学数智人文研究中心的指导下,由同济大学法学院携手上海市人工智能社会治理协同创新中心共同承办的同济大学第五届“人工智能与法律”学术研讨会圆满举行。我院执行院长华先胜教授应邀参会,并发表了名为《智能体安全——法律之“能”与“不能”》的主旨演讲。议程|同济大学第五届“人工智能与法律”学术研讨会——聚焦智能体安全与 AI 立法进程华先胜教授强调,当下人工智能技术迭代迅猛,然而业界对 AI 安全的关注度仍显不足,相关法律框架也处于起步探索期。随着 AI 应用的规模化扩张,各类安全隐患与法律挑

2026-06-09 10:22:20  |  9 阅读

AI时代的数据安全:智能攻防战已不可避免

2026全球数字经济大会数字安全论坛暨第八届北京网络安全大会(BCS 2026)在北京国家会议中心拉开帷幕,本次大会以"AI时代,攻防先行"为核心议题。中央网信办、工信部、全国工商联及北京市经信局等多位政府官员莅临现场并发表重要讲话,为AI时代的数据安全建设指明了发展方向。01官方定调:AI安全已上升为国家治理核心命题中央网信办网络安全协调局局长高林强调,AI时代网络攻击呈现出智能化升级、效率显著提升、范围不断扩大三大显著特征。AI已深刻改变安全格局,亟需从思维理念、方式方法、技术手段、防御体系、关键技术

2026-06-08 15:27:54  |  52 阅读

AI攻防实战专题:智能体安全与风险对抗论坛精彩内容

AI攻防实战:智能体安全与风险对抗分论坛本论坛聚焦实战攻防视角,全面剖析大模型与智能体安全范式、AI红队攻击面、恶意技能攻防、视觉AI对抗防御及MCP攻击风险等核心议题,通过技术对抗与工程实践相结合的方式,助力提升AI系统主动防御与应急响应能力。AI攻防实战:智能体安全与风险对抗分论坛作为TiD2026质量竞争力大会首届AI Safety & Security 人工智能安全与风险治理大会的并行分论坛,将于7月30日至8月1日TiD2026大会期间同步举行,会议地点位于北京海淀中关村国家自主创新示范区会议中

2026-06-01 19:20:55  |  22 阅读

AI应用精选|AgentDoG 1.5轻量级智能体安全对齐方案 (1/20篇) · 5月30日

2026年05月30日星期六AgentDoG 1.5: A Lightweight and Scalable Alignment Framework for AI Agent Safety and Security🤗 81针对OpenClaw等开放世界智能体引发的全新安全挑战及现有对齐方案的缺陷,本文设计了一套轻量级且可扩展的智能体安全保障框架。我们对安全分类体系进行了更新以覆盖新出现的风险,并构建了以分类体系为指引、运用影响函数纯化的数据引擎,仅用约1k样本便训练出多个参数规模的AgentDoG 1.5

2026-05-30 17:40:39  |  12 阅读

AI安全新纪元:大模型全周期治理论坛嘉宾揭晓

当前AI技术正加速融入各行各业,AI智能体、具身智能等前沿方向迅猛发展,与此同时,提示注入、多智能体数据泄露、供应链安全等新型风险集中显现,安全治理已成为推动AI高质量发展的关键前提。自2026年起,全球AI安全议题已从技术层面跃升至国际战略高度,慕尼黑安全会议首次设立AI核心论坛,各国纷纷加快治理框架与标准建设步伐。我国“AI+”行动深入推进,统筹AI创新与安全治理的需求愈发迫切。在此背景下,TiD2026隆重推出首届AI Safety & Security 人工智能安全与风险治理大会。该大会由

2026-05-28 18:31:10  |  13 阅读

AI推理新突破:多智能体安全与规模化并行发展

一句话总结:推理规模化训练迎来"多样性"新维度,VPO 以向量奖励函数解锁测试时搜索多样性上限;Gated DeltaNet-2 革新线性注意力读写机制,多智能体KV共享安全框架LCGuard 填补隐私保护空白,CVPR 2026 连发具身智能两项重磅——手势控制 GesVLA 与自意识导航 AwareVLN 同步登场。机构/作者: Ryan Bahlous-Boldi et al.(多机构联合) 主题: 训练语言模型为多样化测试时搜索做好准备【【强化学习】【测试时扩展】】 内容摘要: 当前 LLM 后训

2026-05-24 09:51:12  |  10 阅读

通用文本优化与AI安全新视角

LG - 机器学习 CV - 计算机视觉 CL - 计算与语言 AI - 人工智能1、[CL] optimize_anything:A Universal API for Optimizing any Text Parameter 2、[LG] A Bitter Lesson for Data Filtering 3、[AI] Agent Security is a Systems Problem 4、[LG] Optimal Reconstruction from Linear Queries 5、[L

2026-05-21 06:05:30  |  10 阅读

AI 实践新观察:多媒体、知识库与安全的多维突破

近期在人工智能领域实施了一系列实操演练与深度挖掘,覆盖本地化多媒体创作、AI 驱动知识库搭建、网络与数据安全新方向探究三大核心板块,过程中既攻克了工具适配难题,也沉淀了技术路径思考,更深化了行业落地洞察,现将整体实践情况复盘如下。在多媒体内容创作领域,核心聚焦本地化工具测试、跨平台调用调试及创作通路验证,重点对比了不同工具的适配度与实操效率,逐步打通本地创作的关键链路。首先关注到一款特色音频类 AI 应用 Voicebox,其核心价值在于将开源音频模型进行轻量化封装,打造出独立的消费级应用。该应用不仅具备

2026-05-15 07:28:18  |  26 阅读