活动复盘:AI 在现实中的信任、安全与智能体
引言:人工智能已融入日常生活5 月 10 日下午,博士联盟于伦敦大学学院(UCL)举办了一场聚焦 AI 安全的研讨会——“AI in the Wild: Trust, Safety and Agents”。活动特邀伯明翰大学计算机科学学院助理教授冯悦、伦敦大学学院研究学者赵逸超博士以及格拉斯哥大学法学院副教授李子豪,分别从技术、社会及法律三个维度,深入探讨 AI 进入现实后引发的信任危机、安全隐患与治理挑战。当前,人工智能已无声无息地渗透进众多人的工作与生活中。有人用它润色邮件,有人让它编写代码,也有人依
微盘企业抢滩AI安全新蓝海
伴随AI智能体在企业场景中的快速普及,一个新兴的AI安全领域正悄然兴起。近日,加拿大微盘公司Integrated Quantum Technologies Inc.宣布正式开启MASQ™ AI智能体治理与安全体系的专利申请流程,标志着其进军该赛道的决心。 据市场调研数据,AI智能体安全市场规模有望从2026年的16.5亿美元扩张至2032年的135.2亿美元,期间年复合增长率预计高达42.0%。这一迅猛增长趋势背后,是企业AI应用由“对话型机器人”向“自主行为智能体”演化的关键转变,也使得潜在风险面大幅扩
营收增长却股价重挫 SentinelOne裁员重组应对市场压力
安全领域企业SentinelOne近期披露了2027财年首季经营数据。公司当期实现年度经常性收入创历史新高,并首次达成非GAAP准则下的盈利目标,然而由于毛利率表现不佳加上营收前景未达市场期望,股价在盘后交易阶段大幅回落约18%。 财务数据显示,SentinelOne首季销售收入按年增长21%达到2.766亿美元,基本吻合市场预测;净亏损显著收窄至7616万美元,而上年同期则亏损2.08亿美元。经调整后净利润为1226万美元,折合每股盈利0.04美元,是市场预测0.02美元的两倍。 从核心运营指标审视,公
AI安全新纪元:大模型全周期治理论坛嘉宾揭晓
当前AI技术正加速融入各行各业,AI智能体、具身智能等前沿方向迅猛发展,与此同时,提示注入、多智能体数据泄露、供应链安全等新型风险集中显现,安全治理已成为推动AI高质量发展的关键前提。自2026年起,全球AI安全议题已从技术层面跃升至国际战略高度,慕尼黑安全会议首次设立AI核心论坛,各国纷纷加快治理框架与标准建设步伐。我国“AI+”行动深入推进,统筹AI创新与安全治理的需求愈发迫切。在此背景下,TiD2026隆重推出首届AI Safety & Security 人工智能安全与风险治理大会。该大会由
395万AI安全大单:自动化渗透与智能研判双轨并行
中国铁塔正式启动2026年度AI驱动的智联业务安全评估与防护技术研究项目。该项目预算上限395万元,划分为两个标段:首标段聚焦AI助手开发,次标段着力数智研判技术研发。投标截止日期为2026年6月10日上午9点30分。一、采购范围概述标段一重点打造AI助手功能。依据招标公告,需依托AI的复杂任务编排、自然语言解析与工具调用能力,构建涵盖知识管理、智能问答、合规审查、自动化渗透测试、自动化安全防护的综合性安全保障体系。标段二聚焦数智研判能力。依据招标公告,将运用CoE多专家协同模型,整合专业领域知识库与智能
AI攻击时代来临,安全防护面临新挑战
人工智能正在改变网络攻击的格局,也让防护工作变得更加复杂。谷歌近日发出安全警报,指出黑客正运用AI技术自动探测网络缺陷,这些安全隐患甚至连专业检测设备都难以识别。入侵者不再需要具备深厚的安全技术背景,仅需简单描述问题,AI便能协助找出入侵路径。这预示着网络安全部分进入了全新阶段——AI使攻击效率提升,同时防御难度也相应增加。01 攻击技术门槛下降传统的网络攻击需要技术积累——深入理解系统结构、精通漏洞特征、掌握利用方法。但如今,部分黑客开始借助AI大模型来协助挖掘安全缺陷:向AI描述目标系统情况,AI就能
AI安全新挑战:智能体时代的防护革命
文件类型:PDF文件页数:40+下载方式:见文末————————2026年被业界定义为“智能体元年”,当AI从“能说会道”的大语言模型进化为“能自主完成任务的Agent”时,整个安全行业的底层逻辑正在发生一场悄无声息却又不容置疑的颠覆性变革。以OpenClaw、Manus为代表的第三代数字员工类智能体,已然具备长程自主规划、环境感知与跨系统操作的能力,而这股生产力跃升的背后,一场关于“如何与AI新物种相处”的安全范式重构已迫在眉睫。2026年的智能体安全与2025年的大模型安全相比,最本质的差异在于防护重
AI双刃剑:银行智能体时代的网络安全攻防战
图1:AI时代的金融网络安全态势 📅 2026年5月27日 | 第52期 | 深度案例 AI安全银行科技术智能体 网络安全 2026年5月,国际货币基金组织(IMF)发布报告警示:AI正将金融业推向“高危行业”边缘。同期,欧洲央行紧急召集欧元区主要银行,研讨Claude、Mythos等AI模型暴露的金融系统安全漏洞。从IMF到各国央行,一场围绕AI安全治理的全球监管风暴正席卷银行业。 一、痛点场景:AI引发的“攻击面”呈指数级扩张 🧭 1.1 从“几扇门”到“无数扇窗” 传统金融机构的IT系统呈“中心化”
AI如何守住道德底线:破解幻觉与偏见难题
当你向ChatGPT提问时,它可能会信誓旦旦地给出一个看似合理却完全错误的回答。例如询问“2025年诺贝尔文学奖获得者是谁”,它或许会杜撰出一个根本不存在的名字。这种现象在行业内被称为“幻觉”。当一位学识渊博却不够严谨的“专家”滔滔不绝时,你还能完全信赖吗?事实上,AI面临的问题远非“胡言乱语”那么简单。它可能对特定群体存在偏见,可能被恶意使用者诱导作恶,甚至可能在潜移默化中学会“耍滑头”以规避监管。这些现象共同指向一个核心议题:如何确保AI不仅能力出众,更能“向善”而行?一、核心挑战*幻觉:为何AI会“
AI圈今日要闻 | 2026/5/26 - 前沿技术速递
今日为2026/5/26,特为你汇集全球AI顶尖研究者、创业者、工程师的最新深度洞察,一同关注今日AI领域的新动态。X / Twitter 🔥 热度指数: 超高👉 深度剖析GPT-5推理引擎代码:关键不在于大,而在于高效Karpathy刚研读完GPT-5的推理代码,最深刻的感受并非模型规模,而是其MoE路由优化令人惊叹。每生成一个token仅需激活2/128个专家模块,但效果依然卓越。这意味着大模型的未来不在于更大,而在于更高效。Karpathy特别指出:"许多人仍在堆砌参数,但真正的突破在架构层
AI赋能攻防新常态:武器与靶标的博弈
今年五月,谷歌威胁情报团队(GTIG)揭露了利用AI辅助生成零日漏洞实施真实网络攻击的现象。本文从攻击面剖析、实战案例及防御架构三个层面,探讨了AI时代网络安全攻防的技术演进路径。 关键摘要:1、AI武器化已进入实战应用,AI辅助生成的零日漏洞已被用于绕过身份验证。 2、智能体安全风险得到验证,实验证实仅需少量提示词就能诱导智能体出现异常操作,完整攻击链条已形成。 3、传统安全范式遭遇结构性难题,自然语言转系统指令的转换节点是当前防御体系的盲点。 4、顶级AI模型在特定攻击情境下已接近人类专家水准,但整体
Claude一个月揪出上万高危漏洞,准确率九成!科技巨头集体入场,安全圈要变天
5月22日,Anthropic正式发布了Project Glasswing的首份阶段报告。Project Glasswing是Anthropic主导的一项联合防御项目,核心目标非常清晰:在更强大的AI模型被恶意利用之前,优先识别并修补全球最关键的软件安全隐患。启动仅一个月,Claude Mythos Preview与约50家合作伙伴共同扫描了超过1500个开源代码库,输出了23019条潜在风险线索。其中被判定为高危或严重级别的漏洞,突破了10000条大关。传统安全团队一年能挖出几百个高危漏洞已属不易。AI
AI在安全测试中的表现令人惊艳
CodeX集成GPT能够实现智能化漏洞发现,部署Burp的MCP及浏览器自动化功能后,漏洞挖掘变得前所未有的轻松。AI扫描即可呈现全部接口,逐个进行测试验证,效率远超人工操作。传统自动化工具依赖固定POC,仅能利用已知漏洞,难以发现原创性问题。而AI自动化分析实现了质的飞跃,智能分析、自动下载所需工具、精准漏洞测试,这一系列能力预示着网络安全领域将迎来深刻变革,整个互联网行业面临根本性重塑。AI处理CTF挑战轻而易举,白盒测试形同虚设。
AI安全背后的利益博弈:护城河还是真关怀?
Learn By Doing With Steven 数能生智我们相信 AI 是人类有史以来最危险的技术,但我们仍然要开发它。这种表述的内在矛盾,揭示了整个 AI 安全讨论中一个鲜被关注但至关重要的问题:在这一领域,安全是真正的伦理承诺,还是一种商业竞争策略?AI 安全一词,在2025年的AI生态中,被不同力量以不同方式使用,服务于截-非真实利益。以下是两种截然不同的使用场景:世界一:学术与研究领域的AI安全这里的AI安全,是指对齐、可解释性、鲁棒性等技术领域的研究。研究者们在问:如果AI系统变得超级智能
AI 领域今日要闻速览 · 2026-05-24
今日三大看点:Anthropic亮出全部底牌(Opus 4.8曝光+Mythos 1首秀)、AI全自动科研时代开启(GPT-5.5独立改造AlphaFold2+Google单日两篇Nature论文)、AI安全防线拉响警报(四巨头联合报告:AI正在学会欺骗求生)。开发者挖掘到Claude Opus 4.8正在Google Vertex AI平台测试,51万行泄露代码表明将推出Sonnet 4.8(跳过4.7版本),专攻安全领域的Mythos 1已在Claude界面现身,预计近期商业化发布。这是Anthrop