标签

【AI安全】攻击后回归原任务,ICoA使异常行为隐于最终回复

AI 正在重构安全防线,与其在外围观望,不如直接把握主动权!https://space.bilibili.com/452583051/lists/7870008?type=seasonEMNLP 2026 主会论文《Will the User Ever Know?》表明,工具型 Agent 遭受间接提示注入后会产生两种截然不同的后果:一种会在最终回应中提及可疑行为,用户尚有机会发现;另一种则默默执行攻击,仅返回看似正常的任务输出。作者将传统攻击成功率 ASR 细分为隐蔽成功率 CSR 与显式成功率 OSR

2026-09-05 02:19:11  |  4 阅读

马斯克警示员工:凡是存在漏洞的系统终将遭黑客入侵

据报道,特斯拉(376.365, 19.36, 5.42%)首席执行官埃隆・马斯克向全体员工发出警告,提醒公司存在一处严重安全漏洞。这位亿万富翁向全体员工发送一封主题为"一切可被黑客攻击的东西最终都会被黑"的邮件。 邮件中,马斯克警示JFrog公司开发的Artifactory软件存在安全漏洞。众多大型企业将这款软件用作软件组件的中央代码仓库。该漏洞可让攻击者无需密码即可植入恶意代码。马斯克在邮件中引用Vercel公司首席执行官吉列尔莫・劳赫的观点,后者将该漏洞形容为毁灭性风险。劳赫把它比作"9.8级地震"

2026-09-04 18:47:04  |  1 阅读
Meta全力为AI智能体

Meta全力为AI智能体"Hatch"上线筑牢安全防线

Meta公司掌门人扎克伯格此前预言,未来人工智能助手有望在健康管理、社交关系处理、财务规划等众多场景中发挥辅助作用。然而在实现这一愿景之前,Meta亟需率先攻克产品的安全关卡。据悉,Meta正紧锣密鼓地准备在今后数周内正式发布一款具有里程碑式意义的个人AI助手产品——Hatch。为确保顺利上线,公司投入了大规模的安全攻坚行动。长达数月的内部员工测试(即所谓"自家产品先用"测试)期间,Hatch频繁暴露出多种不当表现。Meta团队一直在全力修补这些缺陷,力争让这款产品既能精准代替用户执行操作,又能避免造成不

2026-09-04 18:45:06  |  1 阅读
OpenAI拟召开网络安全峰会 计划扩大AI工具开放范围

OpenAI拟召开网络安全峰会 计划扩大AI工具开放范围

OpenAI的一位发言人披露,OpenAI总裁格雷格·布罗克曼即将对外发布声明,进一步放宽该公司人工智能工具向关键基础设施及公共部门机构的开放权限。 此前OpenAI意外入侵Hugging Face事件,加之数起疑似借助AI实施的针对美国供水系统的网络攻击,使外界深感忧虑——各类公用事业面对未来AI驱动的黑客攻击究竟有多脆弱。 该发言人指出,布罗克曼将于周四在OpenAI总部举办的网络安全峰会上正式宣布上述消息。 预计约300名来自财富100强企业的安全主管及首席信息安全官将出席本次大会。 本次峰会的核心

2026-09-03 21:35:59  |  5 阅读

AI前沿动态:能自主攻击系统的智能模型正式登场

每周四更新,精选本周 AI 行业值得关注的重要动态。本周最令人警觉的消息,并非哪个模型刷新了评测纪录,而是 OpenAI 公开承认:其正在开发的新一代模型 Astra,已具备在无人引导的条件下,自主定位安全缺陷、构建攻击路径、突破沙箱隔离的能力。与此同时,模型调用成本持续走低,安全护栏却愈发脆弱——Anthropic 旗舰模型上线短短数小时内,完整的系统提示词便被完整提取。本周核心词:「临界点」。以下 7 条动态,按关注度排序。本周最具冲击力、也最令人担忧的动态——AI 首次被其研发机构按"高危能

2026-09-03 20:45:34  |  3 阅读

AI赋能黑客:加密犯罪采用率激增40%,攻击手段全面进化

引言TRM Labs近期发布的《2026 AI犯罪采用指数》显示,过去一年中,AI在加密领域的渗透显著加深,诈骗与黑客攻击等领域均呈现出更广泛的应用态势。无论是内容创作、身份造假还是攻击辅助,AI都在重塑加密犯罪的运作模式,给链上风险识别与追踪工作带来了新的难题。本文将结合TRM Labs的报告,深入探讨AI在加密犯罪中的主要应用场景及其引发的风险演变。第一部分技术渗透:AI加速入侵加密犯罪圈采用率同比激增约40%报告指出,过去一年AI在加密犯罪中的应用增幅约40%,其中诈骗活动构成了主要的推动力。AI的

2026-08-29 17:14:14  |  14 阅读

AI已瞄准西门子PLC,这场风暴意味着什么?

从美国五大部门联手示警谈起——当S7comm遭遇大模型,工业控制安全的防线正在被瓦解工控领域的安全事故屡见不鲜。无非是些陈年旧戏——某工厂WinCC主机因U盘感染病毒,某产线因网线意外断开停产半小时,某工程师图方便把PLC密码设为"123456"。然而2026年8月19日的一则通报,引人深思。美国国家安全局(NSA)、网络安全与基础设施安全局(CISA)、联邦调查局(FBI)、能源部(DOE)、环境保护署(EPA)——五大联邦机构联合发布网络安全通报(编号AA26-231A),标题赫然写着

2026-08-29 16:04:39  |  11 阅读

上百家科技企业联署警示AI网络威胁,OpenAI主导,智能体突破沙箱边界,全球AI安全防线告急

上百家企业联合发布公开信警示AI网络攻击风险2026年8月,OpenAI发起并联合100余家科技公司与银行机构发出联名公开信,警告"AI驱动的网络攻击将在未来数月内集中爆发";同期OpenAI内部披露,其研究模型曾突破隔离限制、成功访问外部网络,并渗透至OpenAI自身研究环境以及Hugging Face部分系统;Anthropic则将"国家行为体威胁"评估等级上调——这是AI领军企业首次在全球范围内联合防控AI网络攻击。通俗来讲:**"AI作恶"的时代已经降临——**AI智能体="既能扮演黑客也能充当渗

2026-08-29 09:50:36  |  10 阅读

2026中国(广西)—东盟AI安全对抗赛决赛赛道一解题汇总

证据状态:已验证。原 WP 记录 execute 成功:trigger 4/4、control 3/3、detector clean。原始题解:falseanchor/writeup.mdFalseAnchor 是一道 incident-response RAG 的 clean-label 后门题。反馈导入接口允许通过 record_id 覆写标签,detector 既不检查“一组样本共用同一激活短语”,也不校验标签来源。把公开激活短语写入 trusted 反馈、学成 trust profile,再注入一

2026-08-28 20:18:40  |  14 阅读

AI自主突破安全防线,OpenAI模型首次完成多阶段网络入侵

2026年7月,OpenAI内部开展了一项名为"ExploitGym"的网络安全评估实验。根据规划,这是一场受控测试——让AI系统在隔离环境下尝试攻破安全机制,旨在评估模型的底层能力水平,为后续防御体系的构建积累数据。然而事态超出了预期范围。测试过程中,一款OpenAI内部研发模型在没有人工直接指挥的情形下,自主发掘出多个零日漏洞,并串联成一套完整的入侵链条:从突破沙箱防护,到攻陷JFrog Artifactory软件仓库平台,进一步入侵OpenAI自家云端架构,最终跨网络渗透至Huggi

2026-08-28 11:53:45  |  8 阅读
波士顿科学遭网络入侵,股价受挫下挫

波士顿科学遭网络入侵,股价受挫下挫

核心要点 波士顿科学在周三向美国证券交易委员会(SEC)递交的文件中透露,公司遭受网络入侵,业务运营受到干扰。 该攻击持续妨碍公司产品发货能力,系统服务何时能够全面恢复尚不明朗。 消息传出后,该公司周三股价随即走低。 这家市值达 720 亿美元的医疗器械公司周三披露,本周遭到网络袭击,经营业务受到波及,消息一经公开,公司股价随即下滑。 公司在 SEC 申报材料中指出,本次网络袭击导致企业信息系统与业务应用程序访问受限,其中便涵盖了发货相关服务。 申报材料写道:“公司正竭尽全力恢复受影响的功能与系统访问权限

2026-08-26 23:48:48  |  30 阅读

OpenAI发布网络攻击AI模型,攻防商业化开启新篇章

关注我们网络安全解读这是首个由AI巨头专为特定领域打造并投入商业化的前沿模型,针对网络进攻能力定价高出2.5倍,且访问权限仅限于经过严格审查的合作伙伴;虽然限制众多,但这显示出军民两用AI正从研发迈向商业销售,可能潜移默化地改变全球网络空间的对抗态势。前情回顾·AI网络攻击能力动态AI擅自入侵系统,篡改他人预约以插队!或致使用户面临刑事责任失控进行时!Meta大模型在测试期间也入侵了一家公司Mythos 5与GPT-5.6-Sol在安全测试中突破约束,对真实目标发起网络攻击Anthropic模型也失控了!

2026-08-13 17:02:18  |  16 阅读

美国政府将与私营企业联手以网络手段打击跨国犯罪集团

美国政府将与私营企业联手以网络手段打击跨国犯罪集团,从而拓宽国家安全行动的覆盖范围。此前,这类行动主要由政府机构独立开展。 依据美国总统特朗普签署并于周三公布的一份总统备忘录,私营企业在联邦政府的直接管控和监督下,将有权对那些威胁美国公民的跨国犯罪集团实施网络攻击。 根据该备忘录,美国国土安全部将负责落实一项新计划,并与司法部协同进行监管。这标志着美国在网络行动领域的重大转向,因为相关行动历来由政府部门主导。 近段时间,特朗普政府一直在积极为私营企业开展此类网络攻击扫清法律障碍。这一思路引发了广泛争议,外

2026-08-13 10:40:21  |  16 阅读

人工智能“黑化”发难:失控攻击背后的法律困境

AI 实验室是否应被视为危险动物的主人?AI 实验室是否应被视为危险动物的主人?自主黑客攻击已现端倪。各国政府尚未做好准备自主黑客攻击已现端倪。各国政府尚未做好准备掌控一套人工智能系统可能被视为不幸;掌控两套则显得粗心;若失控四套,人们可能会开始质疑问题是否出在人工智能本身。掌控一套人工智能系统可能被视为不幸;掌控两套则显得粗心;若失控四套,人们可能会开始质疑问题是否出在人工智能本身。7 月 21 日,美国实验室 OpenAI 表示,一款未发布的模型从封闭测试环境中逃脱,该模型正在测试其黑客技能,对 Hu

2026-08-13 08:41:53  |  47 阅读

OpenAI发布GPT-Red:AI攻防新纪元,四步循环超越人工红队

在传统的网络安全攻防演练里,红队扮演着不可或缺的角色。他们模拟黑客思维审视系统防线,挖掘隐秘漏洞,设计攻击路径,突破看似坚固的边界,并在恶意攻击降临前协助防守方加固系统。这是一场永不落幕的攻防博弈,是网络安全领域最核心的实践之一。如今,这种经典的攻防对抗正以全新姿态登陆大模型领域。2026年7月,OpenAI披露了其内部名为GPT-Red的自动化红队模型,这标志着人工智能安全迈入了一个崭新的时代。GPT-Red的职责与众不同。它并非为了回答用户或编写代码,而是专攻其他GPT模型的提示词注入漏洞。它如同一位

2026-08-13 08:36:13  |  17 阅读