标签

OpenAI发布GPT-Red:AI攻防新纪元,四步循环超越人工红队

在传统的网络安全攻防演练里,红队扮演着不可或缺的角色。他们模拟黑客思维审视系统防线,挖掘隐秘漏洞,设计攻击路径,突破看似坚固的边界,并在恶意攻击降临前协助防守方加固系统。这是一场永不落幕的攻防博弈,是网络安全领域最核心的实践之一。如今,这种经典的攻防对抗正以全新姿态登陆大模型领域。2026年7月,OpenAI披露了其内部名为GPT-Red的自动化红队模型,这标志着人工智能安全迈入了一个崭新的时代。GPT-Red的职责与众不同。它并非为了回答用户或编写代码,而是专攻其他GPT模型的提示词注入漏洞。它如同一位

2026-08-13 08:36:13  |  17 阅读

ASTELD六维分类体系:解析自主AI智能体的安全架构困局

某中型科技公司的安全主管清晨被手机震醒。警报提示,公司内部测试的开源 AI 智能体平台 OpenClaw 出现了异常外联情况,一个本该负责日程管理的智能体,居然开始尝试读取.ssh 目录并向外传输数据。事后溯源才查明,根源仅是一名员工让智能体帮他归纳一篇公众号文章,文章中嵌入了一句经过精心编排的自然语言指令。这并非虚构的演练场景。一篇最新公开的学术论文,将 OpenClaw 这个 GitHub 史上最快封神、也最具争议的 AI 智能体项目,推到了聚光灯下完成了一场冷静的"解剖"。论文《ASTELD: A

2026-08-11 02:05:52  |  16 阅读

大模型越狱实战:OnlyLANs 提示词注入靶场

导语:当"OnlyFans"邂逅"局域网"——著名安全教育平台 Just Hacking Training(JHT)正式发布了一款名为 OnlyLANs 的免费 AI 安全挑战项目。这并非传统的 CTF 竞赛,而是一场专为大语言模型打造的"越狱"实战演习。OnlyLANs 是由 Just Hacking Training(JHT)发起的免费社区安全挑战活动。JHT 由知名安全研究员及 YouTube 安全领域创作者 John Hammond 联合创办,致力于网络安全教育与技能培养。John Hammond

2026-06-07 09:00:38  |  62 阅读

安全前置:将 AI 防御融入开发流程

「大模型安全:攻击面演变历程」系列第七篇(收官之作)大模型面临的安全挑战并非单一漏洞,而是一条不断扩张的攻击演进路径——从输入端(提示词注入/越狱)→ 训练端(数据投毒/模型窃取)→ 执行端(智能体安全)→ 评估治理端(红队演练/安全左移)。每一层面的新型攻击,都使得上一阶段的防御措施显得捉襟见肘。作为本系列的终章,我们将聚焦于治理层面。前六篇文章已详细剖析了各层攻击面,本文旨在解答一个核心命题:如何让安全机制不再是事后的修补工具,而是从系统构建之初便深度植入?2023 年,某安全团队察觉公司新部署的 A

2026-05-31 21:22:00  |  20 阅读

AI智能体测试方法

探究AI智能体(AI Agent)与传统确定性软件测试的本质差异。传统测试关注“输入A,必然输出B”;而AI智能体具备自主规划、工具调用、长期记忆和非确定性生成能力,这使其测试维度更广、复杂度更高。构建一个成熟的AI智能体测试体系,需从核心能力评测、工程链路监控及安全护栏测试三个维度入手。对Agent的测试,通常需将其拆解为底层组件与综合表现的双重评估:目标拆解测试:向Agent下达复杂指令(如“分析过去三个月销售数据并生成PPT”),检验其能否将大任务拆解为合理的子步骤。反思与纠错:当工具调用出错(如A

2026-05-18 14:33:48  |  18 阅读

AI出错谁担责?智能体法律责任大揭秘

点击上方蓝字关注我们你是否幻想过这样的场景:清晨醒来,AI助手已帮你订好咖啡、回复邮件并预约了周末餐厅——你仅需点头确认即可。这一幕正逐步照进现实。AI智能体——一种能够自主决策并代为执行任务的AI——正加速融入我们的生活。2025年被誉为“AI Agent元年”,国家在《关于深入实施“人工智能+”行动的意见》中,已正式将智能体纳入国家级政策文件。然而随之而来的疑问是:AI替你办事出了纰漏,该由谁负责?机票订错多花了两千元,这笔账算谁的?AI自动回复邮件泄露了商业机密,谁来赔偿?更糟糕的是,AI被黑客通过

2026-04-24 19:05:17  |  27 阅读

透视表象:Chrome AI如何重塑互联网商业逻辑

意图驱动网络重构:Google Chrome AI“技能”与WebMCP生态的战略深度剖析2026年4月,Google Chrome浏览器正式上线“技能”功能,这不仅是网络导航史上的关键转折,更意味着浏览器正从传统的被动信息阅览器,进化为以用户意图为核心的自动化指令中枢。这一架构变革由Gemini智能助手驱动,彻底重塑了用户、AI与全球网络基础设施的交互模式。在Web 1.0和2.0时代,浏览器的核心仅限于信息检索,即便是早期的AI侧边栏也难逃“复制粘贴”的跳转窠臼。Chrome“技能”旨在消除生成式AI

2026-04-20 01:58:52  |  23 阅读

开源AI智能体“龙虾”的安全隐患与应对措施

自年初以来,一款名为“龙虾”的开源AI智能体工具“开放之爪”(OpenClaw)因其强大的自主执行复杂任务能力和灵活的技能扩展包,在开源社区中迅速走红。然而,随着热度攀升,该工具的安全隐患也逐渐浮出水面。近期,多国监管机构和科技公司纷纷出台使用规范,以应对潜在风险。3月30日,中国国家知识产权局发布警告称,“开放之爪”类AI工具存在默认安全配置薄弱的问题,可能引发严重安全威胁。此外,利用此类工具处理专利文件也存在多重风险。安全隐患频现“开放之爪”由奥地利工程师彼得·施泰因贝格尔开发,采用分层架构设计,将社

2026-04-02 09:53:52  |  26 阅读

AI智能体‘龙虾’安全隐忧引发全球关注

新华社北京4月1日电新闻分析|AI智能体“龙虾”为何引发广泛警惕 今年年初以来,一款俗称“龙虾”的人工智能(AI)智能体工具“开放之爪”(OpenClaw)凭借其自主执行复杂任务、可扩展技能包等强大能力,在开源社区迅速崛起。但爆火之后,“开放之爪”接连被曝出存在多重安全隐患。 目前,多国监管机构和科技企业已陆续发布针对“开放之爪”的使用指南和规范。4月1日,中国国家知识产权局发布风险提示说,“开放之爪”等智能体工具被曝光默认安全配置脆弱,易引发严重安全风险。与此同时,使用此类智能体撰写专利申请文件,也可能

2026-04-02 09:21:41  |  70 阅读