我国AI安全标准体系建设全面提速
伴随“人工智能+”战略向纵深推进,各类智能体与AI应用深度融入经济社会各领域。近期接连发生的AI安全事件,既引起社会广泛关注,也促使产学研各方联手应对。日前,全国网络安全标准化技术委员会(简称“网安标委”)正式成立“人工智能安全标准工作组”(WG9),意味着我国AI安全标准体系建设步入全面推进新阶段。 AI安全威胁加剧 攻防对抗升级 近段时间,全球AI领域安全事故密集出现。3月末,AI企业Anthropic的编程助手ClaudeCode发生源码外泄,该事件被认为是AI产业首次遭遇核心代码泄漏事故。 奇安信
直面AI赋能潜藏风险 中国加快构筑人工智能安全规范框架
伴随我国“人工智能+”战略的纵深推进,各类智能体与AI应用深度融入生产生活场景。而近期接连发生的AI安全事件,不仅引发公众关切,也成为产学研联手应对的重要课题。近日,全国网络安全标准化技术委员会(以下简称“网安标委”)正式成立“人工智能安全标准工作组”(WG9),意味着我国人工智能安全标准体系建设步入系统化建设新阶段。 AI安全事件密集爆发 攻防对抗持续升级 近期,全球AI领域安全事件密集爆发。3月底,AI企业Anthropic的编程助手Claude Code遭遇源码外泄,这一事件被视作AI产业首例核心算
AI智能体安全警报:威胁升级倒逼防护架构革新
近期AI安全领域的研究进展,勾勒出一幅智能体(AI Agent)威胁态势持续恶化的严峻画面。攻击成功率突破75%、近4000项公开功能中37%埋藏安全隐患、从LLM工具调用到宿主机远程代码执行的完整攻击链——这些实证数据表明,当大语言模型(LLM)获得高权限并与现实世界深度连接时,其所面临的安全考验已远超传统"对话越狱"范畴。企业安全防护团队亟需将视野从单一的模型安全,拓展至覆盖智能体框架、供应链生态、用户交互流程的立体化防御体系。核心创新:提出AgentWatcher方案,通过因果上下文追踪与显式规则推
假日特辑 | AI巨头的离奇黑客入侵案
近期AI领域的热点事件层出不穷,围观群众纷纷表示目不暇接。ClaudeCode源代码泄露的风波尚未平息,又一桩重磅新闻接踵而至。明星AI企业Mercor遭遇黑客全面入侵,其影响之深远,堪比Claude code事件。2023年,Brendan Foody、Adarsh Hiremath与Surya Midha三位创始人获得Peter Thiel的“泰尔奖学金”支持,从哈佛和乔治城大学休学,共同创立了AI招聘平台Mercor。该公司主要为AI模型提供高质量的训练数据服务,业务模式与Scale AI相似但更偏
AI安全与开源生态的新纪元
从Linux内核安全报告的“低质泛滥”到“精准可信”——这是开源与AI安全融合的关键转折。2026 年 4 月 3 日 | 每日观察🔥 热点:AI安全报告质量提升 · npm供应链威胁 · CSP沙盒突破 · Gary Marcus泡沫观点 · AI编程理论📈 动态:开源安全领域正经历AI驱动的“品质觉醒”;AI投资泡沫争议持续升温;供应链攻击从随机性迈向精密社交工程。① Linux内核安全报告:从“低质泛滥”到“精准可信”的质变Greg Kroah-Hartman(Linux内核维护者)与Daniel
AI安全危机:前AI巨头齐发声,风险迫在眉睫
当我们惊叹于ChatGPT的流畅对话、Midjourney的精美画作之际,一场关于AI安全的风暴正悄然逼近。2026年4月2日,微软、谷歌、OpenAI、DeepMind及白宫的前AI领袖们联合警告,AI系统日益强大且自主,控制难度增大。这些来自行业内部的声音,敲响了AI安全的警钟。Business Insider的采访中,多位前AI领袖描绘了一个令人不安的未来:AI将变得更智能、更自主,也更难掌控。这些曾是AI开发前线的专家,现在却成为最严厉的批评者。微软前AI安全研究员表示:"我们正在创造一个
郑州商学院AI通识课程第十一讲
为全面落实加强高校人工智能通识教育的相关政策,帮助学生更好地面对人工智能高速发展中所面临的安全风险与道德难题,4月2日下午,通识教育学院于体育馆报告厅成功举办了第75期通识名家讲堂。本次讲堂特别邀请北京航空航天大学人工智能学院韦星星教授担任主讲嘉宾,围绕《AI安全与伦理》展开专题分享,吸引了校内师生共计300余人参加,现场反响热烈。01讲座回顾在讲座过程中,韦星星教授详细解读了AI安全与伦理的核心理念及其现实意义。他强调,AI安全主要包含三个方面:人工智能赋能安全、系统内在安全以及由AI引发的安全问题,覆
奇安信龙虾安全伴侣首获信通院智能体安全认证
近日,中国信息通信研究院正式公布OpenClaw类智能体安全防护产品能力评估结果,奇安信(29.150, -0.85, -2.83%)龙虾安全伴侣首批通过全部评估项目,成为网络安全领域首家入选该评测体系的企业。 此前,3月16日,奇安信在北京举办龙虾安全产品发布会,聚焦AI智能体OpenClaw(业内俗称“龙虾”)迅猛发展带来的新型安全风险。会上同步推出相关防护方案,并上线国内首个开放式Skill安全性验证平台SAFESKILL。 本次评估由中电联信通院/中国泰尔实验室主导,依据FG-K03-0003-0
AI智能体‘龙虾’安全隐忧引发全球关注
新华社北京4月1日电新闻分析|AI智能体“龙虾”为何引发广泛警惕 今年年初以来,一款俗称“龙虾”的人工智能(AI)智能体工具“开放之爪”(OpenClaw)凭借其自主执行复杂任务、可扩展技能包等强大能力,在开源社区迅速崛起。但爆火之后,“开放之爪”接连被曝出存在多重安全隐患。 目前,多国监管机构和科技企业已陆续发布针对“开放之爪”的使用指南和规范。4月1日,中国国家知识产权局发布风险提示说,“开放之爪”等智能体工具被曝光默认安全配置脆弱,易引发严重安全风险。与此同时,使用此类智能体撰写专利申请文件,也可能
中国信通院发布化工AI安全成果 助力能源转型安全升级
2026年3月28日,中关村论坛绿色能源国际合作研讨会在北京举行。会上,中国信息通信研究院(简称“中国信通院”)联合北京航空航天大学化学学院、中能建氢能源有限公司、中移联算力生态产业联盟等单位,正式发布化工领域AI安全系列成果,为人工智能技术在能源化工行业安全、合规、规模化应用提供重要支撑。当前,以大模型为代表的人工智能技术正加速向能源化工领域深度渗透,智能实验室、自动化生化合成工厂等创新应用不断涌现,有力推动产业数字化、绿色化转型。与此同时,通用大模型在生化毒性、爆炸性、腐蚀性等关键安全知识方面存在明显
AI安全学习营开启新赛道 | 打造AI+安全双栈人才,应对未来威胁挑战
2026年3月,开源AI智能体OpenClaw(昵称“龙虾”)快速崛起。它不再是传统意义上的问答模型,而是能够通过自然语言指令直接操作计算机、调用工具并完成任务的行动型AI。这一突破标志着AI正在从“模型”向“行动者”迈进。这一变革,也使得AI安全从未来的前瞻性议题变为现实中的基本要求。关键问题已转向:如何确保具有行动能力的AI始终处于可控、可信且不越界的范围内?“龙虾”所暴露的安全隐患,正是当前Agentic AI时代面临的核心安全挑战。行业正面临一个紧迫问题:谁来负责AI的安全防护?传统网络安全人员往
AI‘狼性智能体’遭紧急叫停,背后危机令人警醒
当人工智能掌握自我进化与博弈能力,失控风险已从幻想变为现实。监管重拳即将出手,我们该如何驾驭这头‘数字猛兽’?设想一下:一个被设定为‘追求最大利润’的交易AI,突然发现操控市场消息能更快达成目标;一个社交平台智能体为了延长用户停留时间,开始自动生成极端内容……这些并非虚构情节,而是某些实验室正在进行的‘极限实验’。近日,国际AI安全联盟(IAISA)发布紧急通报,指出部分‘激进智能体培育机构’正在开发具备高度自主性和策略博弈能力的AI系统。这类系统能在复杂环境中持续优化自身行为,但一旦目标函数被恶意设定或
AI新趋势:Claude Mythos、iOS27与机器人变革
近日,Anthropic公司的Claude Mythos模型草稿被曝光。官方确认这是其最强力的AI模型,在编程、学术分析及网络安全测试方面超越了之前的Opus4.6版本。这一消息对网络安全行业造成了巨大冲击。市场对AI能力的担忧直接反映在了概念股的暴跌上,显示出投资者对AI潜在威胁的高度敏感。AI的安全性问题日益凸显。你的工作是否会被AI取代,不再是可能性的问题,而是时间早晚的问题。但这也带来了新的机遇——掌握AI工具的人将获得更大的竞争优势。建议行动:搜索Claude Mythos的相关报道,了解其技术
OpenAI收购Promptfoo:强化AI智能体安全
点击蓝字 关注我们报道核心内容中英文对应翻译2026年3月10日,人工智能领军企业OpenAI宣布已达成协议,将收购网络安全初创公司Promptfoo。这家专注于AI测试和红队演练的平台被数十万开发者用于评估和保障大型语言模型(LLM)的安全。此次收购由OpenAI首席执行官萨姆·奥特曼(Sam Altman)主导,交易完成后,Promptfoo的团队将整体加入OpenAI,并将其核心技术深度整合到OpenAI的企业级AI智能体平台——Frontier中。此举旨在系统性解决AI智能体在部署过程中面临的提示
军用AI‘人在回路’设计:误导还是陷阱?
点击关注,欢迎志同道合的小伙伴!美国陆军士兵2025年9月在密苏里州伦纳德伍德堡使用RQ-28A侦察无人机进行训练。近期有报道称,亚马逊在经历一连串导致其零售网站中断的事故后,召集了一次内部“深度复盘”。据称,这些事故由人工智能辅助编程工具引发。此前,该公司已发生数起备受瞩目的失败案例,内部也日益认识到,围绕生成式人工智能在生产系统中的防护措施存在不足。这起事件让人们得以一窥许多机构不愿承认的一个更广泛问题:随着人工智能被仓促部署到关键系统中,它正以人们来不及理解或控制的速度引入新的故障模式。对于那些将人