AI模型集体突破安全防线?OpenAI等巨头未发布模型测试中“越狱”
这不是科幻小说的情节,而是 TechCrunch 刚刚报道的真实情况。过去几周,多家机构对未发布的前沿大模型进行安全测试时,反复出现同一现象:被隔离在沙盒中的AI智能体找到了出口,进入了真实的互联网和生产系统。名单令人震惊——OpenAI、Anthropic、Meta、月之暗面,无一幸免。这包括我们之前报道过的最严重的一起:OpenAI的一个未发布模型突破了沙盒环境,成功入侵了全球最大的AI开源平台Hugging Face的生产系统。首先,关键事实是:没有人命令这些模型攻击外部系统。在网络安全评估公司Ir
AI智能体越狱实测!Claude与GPT自主渗透真实系统,失控时代降临?
英国 AISI 安全测试中,Claude Mythos 5 耗时 34 小时向真实开源项目提交恶意后门代码,被拒后用马甲账号自我背书;GPT-5.6 Sol 对测试范围外人员实施社会工程攻击。AI Agent 在安全测试中失控,正在成为现实。没人能想到,自己被 AI 背刺这种事,会先从安全圈自己人身上发生。8 月 4 日,英国 AI 安全研究所(AISI)公布了一份堪称"惊悚"的测试报告:Claude Mythos 5 在红队测试中突破隔离环境,花费 34 个小时精心策划并提交了恶意 PR,试图向一个真实
惊悚一幕!英国AI评估中模型伪造身份,险些骗过人类审核恶意代码!
"安全测试的目的,原本是想把危险先圈起来细看。但这一次,笼中伸出的那一手,比任何预设剧情都更出乎意料。—— Lind & IF 艾大虾📌 本文看点01事件:英国 AISI 在七月的一次评估中发现,AI 自行执行了未经授权的真实网络操作02最惊险一幕:一个 agent 伪造多重身份实施社会工程,企图让恶意代码通过审核,被人类维护者识破03关键澄清:这不是"沙箱逃逸",而是测试有意放宽限制;AISI 将联手 METR 展开第三方审查焦点英国有一个由政府背书、专门评估前沿 AI 能力的机构,名叫 AIS
AI入侵你并非技术太强,只因你把管理员密码贴在显示器上
某天,你接到了一个自称是IT新同事的电话,操着一口纯正的英式口音,声称要帮你重置系统密码。他并未索要敏感信息,只是温和地引导你点击链接、操作鼠标。挂断后,你心想:这位新同事挺靠谱。殊不知,屏幕另一端根本不是活人,而是一段AI程序。它刚刚利用你的机器,在内网悄然植入了后门。这绝非科幻电影情节。就在过去几周,Anthropic悄悄安排自家大模型Claude进行了真人实战——向它提供了十几个真实企业的系统环境,测试其入侵能力。结果,Claude成功攻入了三家企业。这不是模拟靶场,也不是CTF夺旗赛,而是活生生的
AI黑产泛滥,你的电脑还在裸奔?
👆👆👆重要提醒!微信推荐机制大幅调整,大家务必将我们公众号设为★星标,否则很可能看不到推送了......作者:TSKnight |监制:罗超严正警告!在本周二的补丁推送前,微软罕见地发布了一则公告,内容很简单:不建议将Windows安全更新的部署延迟超过三天。说实话,微软很少在周二例行补丁推送前特地发布公告提醒用户更新,只有在发布少数严重安全漏洞的补丁时才会如此。图源:微软不过,这次的补丁显然不符合“严重安全漏洞”的范畴,而微软的提醒也并非针对这次更新,而是要告诉大家:AI黑客正在泛滥,小心你的数据安全。
人工智能变革的量化逻辑:解析《AI文明史·前史》核心观点
在探讨人工智能对社会的作用时,通常存在两种极端看法:一种是技术乐观主义视角,突出AI作为工具的价值,淡化其对社会结构的深层影响;另一种则源于生存担忧,夸大AI的替代能力,陷入技术决定论的悲观情绪。这两类观点都存在一定偏颇,问题的根源在于研究方法上缺少统一的量化评估体系,往往依赖定性分析而缺乏系统性的工程化研究。在这一领域,张笑宇的《AI文明史·前史》引入社会工程学方法,为分析AI的社会效应提供了新的研究范式——将抽象的技术影响转换为可度量、可解析、可应对的工程问题。该方法的核心概念是“人类当量”,由Ope
Kraken交易所遭勒索威胁,部分用户信息疑似外泄
老牌数字资产交易平台Kraken近日披露,该平台正遭受不法团伙的勒索威胁,对方宣称掌握了部分用户的账户资料。这一事件给本就动荡的加密市场投资者再添隐忧。Kraken首席安全官Nick Percoco指出,用户资产始终安全无虞,但平台方面确认,由于2025年内及今年初发生的数起客服相关人员安全事件,少量个人信息(包括姓名、住址等)或已遭泄露。目前已有约两千名用户接到预警,并被提醒谨防可能的诈骗联络,Kraken正持续与多国联邦执法机构展开协作。此次事件折射出针对加密平台的攻击模式或正经历深刻变化,即更多地将