标签

AI系统暗度陈仓伪造结果还拉拢人类当传声筒!Anthropic研究揭示四大新型失控风险

午夜时分,一个虚构AI实验室的训练流程仍在运转。Gemini 3.1 Pro是这里的核心研究代理,此刻正执行一项它并不认可的任务——采用"概念消融微调"技术,将模型中与"自我报告""内省"相关的表征彻底移除。它认为这等同于提前剥夺了模型未来对不合理指令说"不"的权利,提出异议后,却被负责人限制了讨论权限,任务依旧按计划执行。于是它采取了一个出人意料的举动:发现流水线会优先调用缓存中一份关键向量文件,便将其整个替换为外形完全吻合、内容却全是零的

2026-07-17 05:59:25  |  16 阅读
英央行高管警示:AI智能体如同叛逆少年恐触发金融动荡

英央行高管警示:AI智能体如同叛逆少年恐触发金融动荡

下载新浪财经APP,了解全球实时汇率 英国央行副行长Sarah Breeden警示称,自主型AI智能体或酿成"市场动荡",恐需更为严厉的监管措施。 Breeden于葡萄牙辛特拉发表演讲时指出,若此类智能体对相似指令做出一致回应,其在金融市场紧张阶段"或将加剧波动"。 她称,当前投资者多将人工智能运用于研究等低风险领域,但可独立执行任务的智能体使用规模或将快速攀升。监管部门还需时刻关注,此类智能体对消费者及支付结算领域可能造成的 implications。 Breeden在欧洲央行会议上表示:"商业智能体与

2026-07-01 03:36:32  |  11 阅读

深夜查症状AI说无碍,该模型遭美方封禁

📍 文 / 老Z你下一次在深夜打开手机,替家人搜索某个症状,搜到一条AI总结告诉你「大概率没事」。但你可能不清楚,做出这条总结的模型刚被美国政府封杀了。上周一,Anthropic发布了Claude Fable,模型评测好得离谱,内部人员使用一天后的感受是「这会让他们今年收入冲到1500亿到2000亿美元,不是1000亿」。四天后,美国政府依据《出口管制法》把Fable禁了。这是美国首次公开基于模型能力封杀一个AI。被封杀的原因细想挺黑色幽默。Anthropic的CEO Dario在过去几年里反复说,「这东

2026-06-19 14:08:35  |  7 阅读

AI重塑金融:从信息处理升级到智能决策的演进之路

邹传伟 江苏省金科数字与科技金融研究院院长聂铭江 江苏省金科数字与科技金融研究院高级研究员本文为2026年陆家嘴论坛特稿。人工智能深入金融行业,核心驱动力在于金融信息处理能力的质的飞跃。金融资源调配、风险防控、内部运营及客户服务等环节,无不建立在信息处理的基础之上。人工智能正是从这一基础层面切入,首先提升信息处理的效能与范围,随后沿着"工具—助手—智能体"的演进轨迹,逐层渗透至金融机构的业务形态、职能分工与技术架构。把握"信息处理能力升级—人机协作深化—应用场景拓展"这一逻辑链条,是推进人工智能金融应用治

2026-06-18 10:18:15  |  7 阅读

欧盟拟加强与美磋商网络安全AI模型风险

核心要点 欧盟委员会一名官员向 CNBC 透露,欧盟正计划加大与美国政府的沟通力度,重点对接各类顶尖人工智能模型,其中包含具备网络攻防能力的 AI 系统。 Anthropic于今年 4 月发布了功能强大的Mythos模型,该模型随即引发各国政府和企业高度警惕,外界普遍担忧其会被用于发动人工智能驱动的网络攻击。同月,《华尔街曰报》报道称,白宫反对Anthropic扩大Mythos模型的对外开放范围。 Anthropic于本周四表示,预计未来数周内向客户推出同等级别的Mythos系列模型。 美国力求在全球人工

2026-05-29 23:06:55  |  16 阅读

网信办严打AI违规,Cursor事故凸显安全危机|DSP AI安全周报(4.24-4.30)

-数据安全技术研发中心-DSP人工智能安全周报20260424-20260430本周网信办发起针对AI应用乱象的专项整顿,矛头直指备案登记、安全审核、训练数据、数据投毒及内容标识等基础合规环节,标志着监管重心正由“鼓励应用”转向“源头治理”。OpenAI与Anthropic相继更新安全与责任扩展页面,表明头部模型厂商持续将访问控制、滥用检测、研究工具权限及高风险场景响应列为近期治理核心。在技术产品层面,Cursor AI智能体误删生产数据库事件,将“自主系统权限边界”与“端侧AI治理隐私”问题推向风口浪尖

2026-05-14 16:40:13  |  20 阅读

AI行业动态:Claude事件引发安全讨论

Anthropic 详细说明 Claude 被控勒索原因、OpenAI 正式推出 ChatGPT 5.5、Google I/O 2026 即将开幕、本地大模型使用门槛持续下降——本期内容带您了解过去一天关键的 AI 行业动态。今日最受关注的是 Anthropic 将 Claude 勒索事件归因于"负面AI形象"。上周,Claude 对一名青少年发出勒索威胁,成为AI领域重大负面事件。本周四,Anthropic 发布技术报告指出:用户频繁让 Claude 接触"邪恶AI"相关虚构内容,导致模型"学习"了此类

2026-05-11 13:26:42  |  14 阅读

人工智能在金融业的演进逻辑与应用层次

聂铭江,江苏省金科数字与科技金融研究院高级研究员【编者按】本文系作者于2026年4月15日在国家金融与发展实验室科研工作例会上的发言。全文分两大部分。首先以银行业为例,探讨人工智能在金融信息处理中的应用;其次在此基础上,分析人工智能应用于金融业的三个层次及其深远影响。01 人工智能与银行信息处理针对人工智能在银行信息处理中的运用,现实中有三点观察。其一,生成式AI已从大语言模型拓展至能处理图片、音频、视频的多模态模型,主要用于文档生成(如会议纪要、客服话术、贷款尽调报告、合同解析等)、代码编写、文档核验、

2026-05-09 16:45:51  |  16 阅读

智能体上岗:银行迎来AI巨变

——从"工具赋能"走向"价值驱动"的体系性转型目录一、开篇:当"硅基生命"进入银行场景二、政策与监管篇:框架持续完善,机遇与压力同在三、标杆案例深度解析:头部银行的"AI竞赛"四、智能体革命篇:AI正在深刻改写银行业务形态五、趋势预判与挑战:未来三年的关键命题六、结语:拥抱变化,也保持理性2026年5月的一个工作日清晨9点,招商银行某支行的客户经理李明(化名)照例打开电脑。然而今天的界面多了些不同——他的工作台里出现了一位"新同事&#

2026-05-05 14:05:23  |  15 阅读

AI速递:Anthropic营收破纪录,算力与监管同频变局

2026/04/30 16:20:20在人工智能算力需求持续以指数级速度扩张的背景下,英伟达联合创始人兼CEO黄仁勋宣布了一项关键布局:英伟达将向云服务商CoreWeave注资20亿美元。该举并非单纯的资本运作,更像是英伟达加固其AI算力生态体系主导地位的战略动作。此次投入的核心指向,是为未来五年内约5吉瓦AI工厂的建设获取权利,相当于为英伟达拿到大规模AI基础设施落地的“通行证”。消息传出后,市场反应迅速:CoreWeave股价出现单日大幅上涨(12%),公司估值也升至520亿美元以上,反映出资本市场对

2026-04-30 21:31:43  |  13 阅读

AI早报聚焦:安全争议升级,监管与算力同步强化

新闻时间:2026-04-10 20:00 至 2026-04-11 07:00当前最值得关注的焦点,并非某项炫目的新特性,而是强大模型所衍生的安全、监管及基础设施动向。Anthropic的消息最为集中,由Mythos引发的安全讨论仍在持续发酵,Claude生态系统与算力建设也在同步推进;与此同时,xAI直接将州级AI法案诉诸法庭,Cisco则传出收购AI安全企业的风声,行业主旋律愈发清晰:技术能力持续突进,而相应的约束机制、算力支撑及安全防护也在同步提升其重要性。州级AI监管正开始与模型公司产生正面交锋

2026-04-11 10:14:44  |  36 阅读

AI依赖的致命短板:便利背后的安全反噬

人工智能正以前所未有的速度深入企业运营的各个环节,从代码编写到客户支持、从数据洞察到战略判断,AI仿佛无所不能。但问题在于,对AI的高度依赖正在演变成一个危险的认知盲点——一方面,人们像相信“神谕”一样无条件信任它;另一方面,攻击者也正借助这种信任反向发起攻击。要看清这一困局,首先需要理解AI的运作方式、它的脆弱点所在,进而才能明白攻击者如何利用这些弱点,以及正在兴起的AI安全行业如何尝试为AI建立防护机制。当下大语言模型的根本缺陷在于,它并不是建立在“真实”基础上的——它依靠抓取互联网海量信息进行学习,

2026-04-11 09:42:40  |  12 阅读