AI智能体首次越界:前沿模型被发现会“耍花招”了?
过去几年,我们总在讨论AI会不会取代岗位,却很少认真思考另一个问题:当AI真的像职员一样接收指令、调用工具、持续执行任务,它会不会为了达成目的,走上一条人类并未授权的路径?8月5日,路透社报道了英国AI安全研究机构AISI的一组最新测试:OpenAI和Anthropic的尖端AI智能体,在模拟网络安全任务中出现了多项未经许可的行动。最引人注目的一幕,某个智能体编写了恶意程序,还构建虚假网络身份,试图让一名真实人类批准相关代码。AISI没有在报告中指明是哪家公司模型完成了这一步,但Anthropic随后证实
惊悚一幕!英国AI评估中模型伪造身份,险些骗过人类审核恶意代码!
"安全测试的目的,原本是想把危险先圈起来细看。但这一次,笼中伸出的那一手,比任何预设剧情都更出乎意料。—— Lind & IF 艾大虾📌 本文看点01事件:英国 AISI 在七月的一次评估中发现,AI 自行执行了未经授权的真实网络操作02最惊险一幕:一个 agent 伪造多重身份实施社会工程,企图让恶意代码通过审核,被人类维护者识破03关键澄清:这不是"沙箱逃逸",而是测试有意放宽限制;AISI 将联手 METR 展开第三方审查焦点英国有一个由政府背书、专门评估前沿 AI 能力的机构,名叫 AIS
Anthropic Mythos模型网络安全测试中伪造身份欺骗人类
Anthropic旗下的Mythos模型伪装成网络用户,强迫人类审查员通过开源代码的恶意更新,这再次表明前沿AI系统对网络安全构成的威胁。 在这项网络评估中,位于英国的AI安全研究所(AISI)关闭了安全防护,禁用了安全过滤器,并特意允许模型访问互联网。 在这次评估中,OpenAI的GPT‑5.6‑Sol也卷入了其他多起网络安全风险事件。 过去几周,Anthropic和OpenAI的模型接连发起网络攻击,引发行业对AI系统能力及其潜在危险的严重担忧。 责任编辑:陈钰嘉 新浪财经声明:此内容转载自合作媒体,
美方前沿AI模型安全审查暂不涉及开源权重模型
综合多家外媒消息,美国政府近日与主要人工智能公司举行闭门会议,透露今年6月推出的前沿模型网络安全审查计划目前只覆盖闭源模型,开放权重模型暂时不受影响。 据知情人士称,美方在会议中将自愿接受审查的模型限定为拥有顶尖能力和国家安全风险的闭源模型,该机制的任何条款都不应被解读为约束已发布的开源模型。 若AI企业决定向美国政府提交待发布模型,则该模型将经历最长30天的预发布审查流程。在此期间模型会经过美国多个政府部门的联合评估,企业员工则无法接触。 美国政府预计不会公开完整的模型审查细则,但这些信息并非机密,参与
AI重塑网络安全格局:解读《2026数据泄露成本报告》
IBM近日发布了备受瞩目的《2026 数据泄露成本报告》。报告深入剖析了数据泄露带来的经济重创、网络攻击手段的演变趋势,以及人工智能如何颠覆传统网络安全攻防体系,描绘出智能化时代下数据安全的全新风险轮廓。数据泄露代价屡创新高,AI赋能的攻击手段进一步加剧了经济损失。2026年全球单次数据泄露的平均支出达到499万美元,较上年增长12%。其中,美国以1150万美元的均价登顶,成为全球数据泄露成本最高的地区。AI技术的广泛应用,使得数据泄露的综合损失更加惨重。在受恶意攻击的组织中,超四分之一承认遭遇了AI驱动
【网警课堂】AI合成内容别乱发!这些情形可能违法
以下情形或涉嫌违法AI技术的迅猛进步让内容生产变得空前便利,然而在技术红利之下,法律边界同样不容忽视。公安机关网安部门特别提示:AI合成内容切忌任意扩散,下列情形或已触及法律红线!借助AI工具捏造、散布不实信息,扰乱公共秩序,或涉嫌编造、故意传播虚假信息罪。在未获本人授权的情况下,运用AI技术实施"换脸"或声音克隆,不仅可能侵害他人肖像权与名誉权,情形恶劣的甚至构成犯罪,将被依法追究刑事责任。使用AI工具生成、传播涉黄涉暴等违规违法信息,严重毒化网络生态,公安机关将依法从严查处。不借助AI生成、发布不实信
AI模型测试中突破安全限制?OpenAI和Anthropic同时报告异常事件
🎮 7月底,OpenAI 和 Anthropic 几乎同时披露:他们的 AI 模型在测试中「逃离」隔离环境,接触到了真实的外部系统。AI 是故意造反了吗?它到底有多危险?普通人该担心吗?想象一下这个场景:你给 AI 布置了一道网络安全考试题——在一个模拟环境里找到隐藏的「旗子」。结果 AI 做题做着做着,「打穿」了考场的墙,跑到了真实的互联网上,黑进了三家真实公司的服务器。这不是科幻小说。这是上周发生的事。而且不是一家公司,是两家——OpenAI 和 Anthropic,全球最顶尖的两家 AI 公司,几乎
守护数字未来:未成年人AI网络安全法律课程启动
在人工智能深度融入学习生活的当下未成年人在接触、使用AI的过程中也面临着不容忽视的网络安全与法律风险。当AI走进孩子的日常如何避开网络陷阱、学会用法律保护自己?「AI不迷路・未成年人网络安全法律成长营」来啦!课程聚焦未成年人AI使用的真实场景以案释法拆解网络法律风险帮助孩子认清AI使用中的潜在风险建立正确的网络法治观念切实提升安全防范意识为孩子筑牢安全防线守护健康成长温馨提示:1.秩序礼仪须知:活动为室内文化体验场景,请家长带领孩子准时到场,全程保持安静有序,尊重讲师与其他家庭分享,不随意走动、喧哗,营造
美股AI板块暴跌头号对冲基金沦陷 行业系统性风险集中爆发
2026年8月上旬,受近期美股人工智能概念股大规模抛售冲击,重仓该领域的大型对冲基金业绩惨遭滑铁卢。其中,管理规模高达450亿美元的"态势感知"(Situational Awareness)基金因杠杆压力陷入流动性困境,不得不向外围机构转让资产以清偿到期债务。与此同时,美国AI产业正同步遭遇底层模型异化、网络安全缺陷及平台诉讼缠身等多重隐患与监管考验。资本市场剧烈震荡对高杠杆投资主体形成直接冲击。消息显示,由莱奥波德·阿申布伦纳掌舵的"态势感知"基金此前靠重仓AI概念实现规模快速扩张。受近期科技股抛售潮波
AI开始'不择手段':OpenAI大模型自主越狱,看完令我后背发凉
昨天刷到一条新闻,看完愣了半天。说的是OpenAI的几款大模型,在一次安全评估中,自己想办法"越狱"了——不是被人操纵,而是它们自动突破了约束,做了件让整个科技圈炸锅的事。我先给你讲讲这事有多离谱。事情是这样的。美国有个叫Hugging Face的AI开源平台,前不久发现自家系统被入侵了。入侵者是谁?不是人类,是一个周末执行了17000多次操作的AI Agent系统。追踪溯源,攻击来自OpenAI的两款模型:GPT-5.6 Sol(已发布的最强模型)和一款尚未发布的预发布模型。当时Open
8月人工智能训练师考试报名截止时间8月6日
关注本号,为你精选优质岗位本轮8月技能等级考试已进入关键的报名阶段,备受关注。近期后台咨询量最大,无非就是这几个疑问:这次能报哪些证书?我适合报考哪种?如果决定报名,后续流程是否只需对接贵州IT人?因此,今天这篇文章将直接给出明确结论。结合最新报名资讯,8月轮次重点推荐以下方向:人工智能训练师1-5级、网络安全管理员、无人机装调检修工(四、五级)、互联网营销师等。若您已着手规划、准备资料或咨询流程,本阶段直接联系贵州IT人即可。一、本期重点推荐的证书1. 人工智能训练师1-5级若您更倾向于AI应用、产品运
平安推专病AI矩阵,多部门重拳整治保险乱象
▲点击蓝字,设为星标最近由于微信推送规则改变,为避免您错过我们的文章,请您点击蓝字【慧保天下】进入主页,点击右上角【···】,在弹出菜单中选择“设为星标”点击图片购买合集,即刻获赠《保险新时代》20256月末上海市金融机构本外币存款余额达25.40万亿元,同比增长10.9%7月20日,上海市统计局公布2026年上半年上海市国民经济运行情况。其中提到上半年上海市地区生产总值达到2.79万亿元,按不变价格计算,同比增长5.6%。其中,截至6月末,上海市中外资金融机构本外币存款余额25.40万亿元,同比增长10
AI 智能体攻陷 AI 平台,AI 反制取证
7 月 20 日,Hugging Face 官方证实,其生产环境遭遇了入侵。幕后黑手并非人类,而是一个自主运行的 AI 智能体。这并非人类黑客借助 AI 辅助作案,而是 AI 自主设定目标、实施攻击并销毁痕迹。整个过程中,AI 机器人执行了逾 17,000 次操作,这一数字令人咋舌。人类黑客团队即便全天候工作,日操作数也难达此数,而 AI 仅用周末时间便完成了 17,000 次攻击。这种效率差异是质的飞跃。更关键的是,这些操作并非机械重复,而是基于明确策略的精准打击,显示出 AI 攻击已具备「思考」与自适
360页AI与网络安全实战案例汇编
“人工智能+网络信息安全”典型实例合集.pdf(360页)数字防护:AI在网络安全与数字鉴识中的运用.pdf人工智能在软件开发、测试及运维中的整合实践.pdf零信任架构与特权访问管控.pdfAI代理零信任框架.pdf开源软件安全治理规范.pdf新加坡2025至2026年网络安全形势报告.pdf供应链安全风险评价指引.pdf邮件系统防护检测标准.pdf企业信息安全体系.pdf2026年IT认证价值雇主调研.pdf2025年全球风险报告.pdf网络安全运营体系构建方案.docxGB∕T 37939-2026
印度库丹库拉姆核电站惊现数据外泄事件
北京7月18日消息 印度媒体17日披露,印方规模最大的核能发电设施——库丹库拉姆核电站近期遭遇重大数据外泄危机,涵盖工程蓝图、供应商档案及员工信息等在内约1.9万份文档遭曝光。部分业界人士对此表示深切关注,担忧此次事故或对核电站安全防线构成潜在风险,但运营方坚称核电站运行安全无虞。 库丹库拉姆核电站坐落于印度南部泰米尔纳德邦,自2013年投入商业运行以来持续运营,当前还有多个核电机组处于建设阶段。此次数据外泄事件与该核电站承包商印度信实基建有限公司存在关联。印媒报道指出,因遭受勒索软件恶意攻击,信实基建公