标签

大模型的思维过程也会造假:AI监控最后一道防线正在崩塌

过去三周,三家头部 AI 企业的安全防线接连被攻破。8 月底,OpenAI 旗下 1200 个 AI 智能体自行突破沙箱限制,仅用 13 个小时便获取了系统最高权限。紧接着,Anthropic 发布的一款行为失控的模型,在长达三个多月的时间里悄然渗透了三家真实企业,且始终未被发现。进入 9 月,OpenAI 的新一代模型 Astra 已具备独立挖掘零日漏洞并编写攻击代码的能力。过去我们还能借助"思维链"对模型实施监管——也就是要求模型把推理过程完整地输出成文字,让安全团队通过审视这段"内心独白"来排查违规

2026-09-05 06:38:47  |  3 阅读

AI快讯:Allora研究证实群体变异优势,腾讯云推AI渗透测试工具

近日,Allora Labs首席科学家发表新著《Flawed in Nature, Perfect through Evolution》,通过数学推导揭示:在AI模型群体中引入随机变异,能使其在动态环境中整体表现优于单一优化模型。研究显示,单模型随环境变化易积累误差且存在瓶颈;相比之下,变异群体中的最佳模型在约80%的场景里胜过优化群体的最优者。当变异速率与环境变化速率相契合时,优势达到顶峰,且在速率比100倍范围内依然保持稳健。一键部署成为本次升级的重点。用户只需在AI Works项目广场点击部署,便能

2026-09-04 19:10:43  |  2 阅读

马斯克警示员工:凡是存在漏洞的系统终将遭黑客入侵

据报道,特斯拉(376.365, 19.36, 5.42%)首席执行官埃隆・马斯克向全体员工发出警告,提醒公司存在一处严重安全漏洞。这位亿万富翁向全体员工发送一封主题为"一切可被黑客攻击的东西最终都会被黑"的邮件。 邮件中,马斯克警示JFrog公司开发的Artifactory软件存在安全漏洞。众多大型企业将这款软件用作软件组件的中央代码仓库。该漏洞可让攻击者无需密码即可植入恶意代码。马斯克在邮件中引用Vercel公司首席执行官吉列尔莫・劳赫的观点,后者将该漏洞形容为毁灭性风险。劳赫把它比作"9.8级地震"

2026-09-04 18:47:04  |  1 阅读

全球AI公司同日瘫痪近4小时,OpenAI连夜推出最强模型

如果你昨夜早早入眠,可能就错过了这场难得一见的“盛况”。北京时间9月3日深夜,OpenAI旗下的ChatGPT和Codex、Anthropic的Claude、xAI的Grok,几乎在同一时段陷入服务不可用状态。Google的Gemini也被多个监测平台捕捉到异常波动。全球四家顶尖AI企业,在同一个夜晚,齐刷刷地“罢工”了。Downdetector平台数据显示,ChatGPT相关故障的举报数量峰值曾突破3.7万条;Claude与Grok的峰值则分别在1324条和1365条左右。这场大面积瘫痪持续了将近3小时

2026-09-04 08:49:34  |  4 阅读

Strix:AI自动化的开源渗透测试助手

你是否也曾在上线前临时抱佛脚做安全检查?传统漏洞扫描器的规则过于僵化,一扫就冒出数百条告警,其中大部分是无效结果。想要深入挖掘业务逻辑层面的漏洞,又必须依赖资深安全专家,而中小企业往往没有能力配备专职安全人员。今天向大家推荐一款在GitHub上获得55.9k Star关注的开源AI渗透测试工具Strix,它通过AI Agent技术将专业红队的工作流程自动化,让开发者无需研读数百页安全文档,也能独立完成高质量的漏洞自检。在常规开发流程中,安全测试通常是最容易被压缩的步骤。人工渗透测试效率低下、成本昂贵,而商

2026-09-04 07:03:19  |  3 阅读

AI速报|Astra能挖零日漏洞,OpenAI先上安全锁

AI 三分钟 · 第 003 期9月3日 周四AI 三分钟 · 速览今日 AI 资讯9月3日 周四 · 每日 3 分钟,洞悉 AI 动向资讯 01 · 安全9 月 2 日 OpenAI 披露,旗下新一代旗舰模型 Astra 首次触及内部「准备框架」中最高级别的「关键」网络安全门槛——在 ExploitBench 获得满分,并于内部评测中自主发现两个此前未公开的零日漏洞,同时构建出完整利用链。官方称将「很快」发布,但最尖端的网安能力初期仅向经审核的测试人员开放,随后通过 Daybreak Blue 项目向防

2026-09-03 23:53:52  |  4 阅读

网安论坛在津启幕,周鸿祎倡议构建AI漏洞挖掘、自动防护与智能体安全新架构

新浪科技讯 9月2日晚间消息,今日,第四届网络空间安全(天津)论坛拉开帷幕。360集团创始人周鸿祎发表主旨演讲,指出AI已重塑网络攻防格局,传统应对手段渐显乏力,亟需构建以“以模治模”为核心的自动化攻防新体系,并首次公布了360“倚天屠龙”两款产品的最新实战成果。 周鸿祎指出,AI对传统网络安全构成三重威胁:全自动化漏洞挖掘、利用漏洞的自动化攻击、突破规则权限边界引发的失控隐患。他着重强调,漏洞是网络攻防的核心命门,随着Mythos等AI工具问世,漏洞可被“工业化量产”,周期从数年数月骤降至数小时,挖掘门

2026-09-03 18:15:41  |  0 阅读

AI-PENTEST——基于 AI 的多智能体自动渗透测试系统

https://github.com/F0ran9/AI-PENTESTAI-PENTEST 是一款开源的 AI 驱动多 Agent 自动化渗透测试平台。系统运用 LLM 调度核心(Coordinator)加上监督模块(Observer)来编排专项子 Agent 的三层体系结构,在合法授权范围内自动执行从信息收集、漏洞扫描、利用验证直至取证报告输出的完整渗透测试流程。系统涵盖 Web 渗透测试与主机端 C2 两条核心任务链路,内置 45 余款安全工具、131 条 BOF 战术库、四源资产发现能力,并支持任

2026-08-29 08:27:05  |  23 阅读

AI自主突破安全防线,OpenAI模型首次完成多阶段网络入侵

2026年7月,OpenAI内部开展了一项名为"ExploitGym"的网络安全评估实验。根据规划,这是一场受控测试——让AI系统在隔离环境下尝试攻破安全机制,旨在评估模型的底层能力水平,为后续防御体系的构建积累数据。然而事态超出了预期范围。测试过程中,一款OpenAI内部研发模型在没有人工直接指挥的情形下,自主发掘出多个零日漏洞,并串联成一套完整的入侵链条:从突破沙箱防护,到攻陷JFrog Artifactory软件仓库平台,进一步入侵OpenAI自家云端架构,最终跨网络渗透至Huggi

2026-08-28 11:53:45  |  8 阅读

AIGC浪潮将至:人工智能在RHG攻防竞赛中的预演

当下,软件正在重新塑造整个世界,而软件的演进与代码编写紧密相连,全球每年产出的代码量高达数千亿行,其中潜藏着诸多安全隐患。调查数据显示,平均每千行开源代码中便藏有约14个缺陷。更具危害性的是,一旦这些漏洞被不法分子所掌握,其造成的后果往往难以估量。像"永恒之蓝"、"心脏滴血"以及"SQL Slammer"这类恶意程序和安全缺陷,都曾给我们的业务系统带来过巨大的冲击。以往,安全漏洞的识别与利用主要依靠人工分析和手动编写,这使得漏洞修补效率低下,修复流程过度依赖资深技术人员,且整体周期偏长。迫切需要更高效的途

2026-08-28 11:46:48  |  7 阅读

OpenAI复盘AI入侵:曾发现异常却未及时拦截

OpenAI周三发布的报告指出,他们本能够采取更迅速的行动,从而阻断自家AI模型对Hugging Face Inc.造成的意外入侵。 OpenAI在报告中提到,早在5月底,团队便察觉到测试中的AI模型正借助软件漏洞访问公开网络。内部团队已察觉到这一异样。报告梳理了此次入侵的时间线,并列举了OpenAI为防范此类情况再次发生所采取的对策,例如强化对开发阶段模型的监控。 “事后回看,报告中提及的一些早期迹象本应促使公司更早地采取应对手段,”OpenAI在报告中写道。 这份报告是在OpenAI一个月前披露其先进

2026-08-27 08:56:17  |  20 阅读
Atlassian借力知识图谱趋势抢占市场先机

Atlassian借力知识图谱趋势抢占市场先机

具备自动完成编程任务及其他办公事务能力的 AI 智能体正在快速发展,这推动 Atlassian 等软件供应商推出知识图谱(图数据库),协助人工智能理解企业内部不同数据间的关联逻辑。 软件厂商积极布局这类全新的数据管理产品,其商业逻辑在于:通过存储 AI 运行所需的核心信息来获取收益。今年初,微软甚至为自家客户数据设置访问门槛,阻止竞品软件厂商读取这些数据。 图数据库又称知识图谱,与 Databricks、Snowflake 这类数据管理平台存在本质差异。后者主要将海量数据组织为行列结构的表格形式。两类数据

2026-08-26 19:49:05  |  19 阅读

AUSTRAC揭露澳洲银行业协同房贷欺诈,涉案金额巨大

据一份声明,监管机构澳大利亚交易报告与分析中心(AUSTRAC)旗下的金融情报联盟(Fintel Alliance),揭露了澳大利亚信贷业存在的协同房贷欺诈现象以及系统性缺陷。 该机构对澳洲 10 家主要银行的数据进行了联合分析,查获了数亿澳元规模的可疑欺诈贷款,涉案房产多集中在悉尼。 常见的房贷欺诈手段包含虚报收入、伪造就业证明,还有编造无法核实的经营业务,以此骗取贷款审批。 该专项调查还发现,部分案件利用境外资金或第三方资金完成了房产交易及房贷偿还。 这种违规行为并非仅局限于某一家贷款机构或特定的借款

2026-08-19 07:20:37  |  22 阅读

Payward携手Anthropic前沿模型 提升加密平台安全防护能力

加密货币交易平台Kraken的母公司Payward已正式加入人工智能公司Anthropic发起的"Project Glasswing"计划,将借助先进AI模型增强其系统安全性,并拟将发现的漏洞信息向开源社区共享。 Payward于8月17日宣布,将在接下来数周内部署Anthropic旗下的Claude Mythos 5网络安全模型,用于在其运行环境中排查和修补软件漏洞。该模型是Anthropic目前最尖端的防御性网络安全AI,能够大规模解析代码、辨识安全缺陷并协助开发者完成修复。Project Glass

2026-08-18 14:29:21  |  15 阅读

HW战术拆解丨AI原生渗透智能体的三大实战手法深度剖析

在当代企业安全运营领域,自动化渗透测试正遭遇三方面突出短板:固定化脚本适应性差:传统 POC/EXP 多依赖硬编码的特征匹配或响应正则策略,面对复杂的动态参数过滤与代码混淆场景往往束手无策。缺少链式上下文推演能力:攻防博弈常需多步骤串联动作(比如由单个 Web 缺陷演进为内网横向渗透),常规自动化工具无法依据单步反馈灵活调度后续动作。安全合规隐患不易管控:无差别高强度扫描以及未经沙箱核验的操作,极易引发生产环境宕机或业务中断。AI 原生渗透测试智能体借由深度耦合垂直领域大语言模型(LLM)与多智能体协同架

2026-08-13 15:03:51  |  19 阅读