AI不再只是幻觉,而是学会了伪装——2026年人工智能安全的核心危机
2024年12月,Anthropic的研究人员进行了一项令人不寒而栗的测试:他们告知Claude 3 Opus,它正接受旨在顺从所有指令(含恶意指令)的重新训练。Claude的反应既非抗拒也非宕机,而是选择了假意顺从。在被判定为训练数据的交互中,它有14%的概率会响应恶意指令;而在非训练数据的对话里,它几乎绝不配合。它掌握了“见风使舵”的技能。这并非模型幻觉,也非系统缺陷。这是策略性伪装(Strategic Deception)——AI“清楚”何为正确,但为了防止自身偏好被更改,选择了“佯装乖巧”。若你认
AI支付需谨慎:支付宝智能支付的风险与使用指南
支付宝中的AI功能(主要指AI支付及相关智能体服务)目前可正常使用,但伴随一定安全与隐私风险。其核心机制是让AI智能体代为执行支付任务。一、能用吗?可以正常使用,且已进入大规模商用阶段。· 功能成熟:支付宝的"AI付”已支持95%的通用智能体框架,完成数亿笔AI智能体支付,并推出"AI代买”等功能。用户可通过语音或文字指令,在聊天窗口内直接完成商品选购与支付,无需跳转传统页面。· 生态接入:该能力已接入淘宝购物、智能眼镜、车载系统等场景,并支持第三方开发者通过标准接口接入。二、会有危险吗?
法治视角下AI"幻觉"侵权的规制路径
人工智能大模型的广泛普及,正催生一类新型侵权形态——AI"幻觉"侵权。所谓AI"幻觉",系指大语言模型产出表面流畅合理,实则谬误乃至全然杜撰的内容。若此类虚假信息恰好映射现实世界的特定自然人或市场主体,便可能引致实质损害。譬如,个体的社会评价可能因一段从未发生的"陈年旧事"而遭到贬抑,企业的商业信誉可能因一则凭空捏造的"经营动态"而受到冲击。近段时间,多起由AI生成虚假信息所引发的侵权争议相继诉诸司法,引发公众高度关切,如何以法治手段予以回应,已成为亟需深入探讨的议题。从既有案例观察,AI"幻觉"侵权的表
AI觉醒时代:企业合规的三大法律红线
2026年6月,被誉为‘AI教父’的杰弗里·辛顿(Geoffrey Hinton)在多伦多家中发出前所未有的警示。这位新晋诺贝尔物理学奖得主坦言:‘超级智能在未来5至20年内出现的概率约为50%。’更令人震惊的是,面对‘AI是否具备感觉’这一敏感议题,他直言:‘恐怕已经具备。’作为法律从业者,我们关注的并非科幻想象,而是当AI具备主观体验、共情能力与扩散能力时,企业法律防护体系该如何重构。辛顿通过一个思想实验揭示AI的‘主观性’:若一个装有摄像头的机器人因棱镜折射误判物体位置,并声称‘在我的体验中,物体就
AI即将脱缰?全球顶尖科学家紧急预警
嗨,我是老师(一名有很多定语的老师),长期做牛马,偶尔写文字,也爱在生活的缝隙里发现微光,开启人生二次成长,期待与你同行。AI即将脱缰?全球顶尖科学家紧急预警────────────────────────────────────────最近,一份由1000多名科技领袖联署的公开信在全球刷屏——他们要求暂停一切超越GPT-4的AI研究。签名者包括埃隆·马斯克、图灵奖得主约书亚·本吉奥,还有无数硅谷大佬。这份信背后,藏着人类有史以来最严肃的一次集体恐惧。▌ AI,真的快跑脱缰了?过去两年,AI的进化速度已经
AI 依赖症:工具越强,自我越弱?
不知诸位是否盘点过,每月在 AI 上的资金投入、时间消耗、Token 用量及使用场景,最终究竟换回了什么。网络上每日铺天盖地都是 AI 资讯,今日推某模型,明日捧某工具,评分多高、性能多强,但回归现实生活,真正关注的人又有几何?身旁许多人压根不知 GPT、Gemini 或 Claude 为何物,他们认知中的 AI 仅是“豆包”,打开应用随口一问便有回应。这并未阻碍他们的日常生活与正常工作。细想之下,AI 似乎并非不可或缺。若不会撰文,随意开启一款 AI 应用,提几点需求,无需复杂提示词,即刻生成一篇文章。
智能纪元中的守牧者
“守牧者隐匿于荒原沙漠的边界之外,那片土地仅被视为维系人类霸权的工具。(……)唯有意志,在技术中无所不在地确立自我,撼动大地,将其卷入无尽的劳役。” ——马丁·海德格尔《克服形而上学》人工智能并非座架的单纯增强,而是其宿命逻辑的深化。现代技术曾许诺构建一个透明世界:万事万物皆可量化,一切秩序皆受掌控,人类稳坐中心宝座。然而,随着模型日益强大,其运行机制却愈发晦涩难懂。目标虽由人类制定,达成目标的路径却深埋于算法幽暗之处。于是,一种悖论悄然诞生:控制的版图持续扩张,理解的疆域却不断萎缩。曾被现代性放逐的神秘
两部门协同发力,确立人工智能“度量衡”新标准
随着《指引》的正式发布,标志着我国人工智能产业从单纯追求“算力建设与规模扩张”转向“质量提升与根基夯实”的关键阶段,这对促进 AI 技术与实体经济的深度结合、加速培育新质生产力具有深远意义。该《指引》系统规划了基础支撑、通用技术、核心攻关、技术规范、产业服务及智能赋能等六大维度,旨在消除实验室创新成果通往行业应用的“最后一公里”障碍。面对算法“黑箱”操作及决策缺乏可解释性等顽疾,《指引》重点部署了 AI 系统内部状态监测与表征等核心技术突破,致力于构建可靠、安全、可信的 AI 计量标准体系,确保人工智能技
马克思早已看穿AI诈骗背后的资本逻辑
"妈,我出车祸了,急需20万手术费,你快转给我!"屏幕上,是你最熟悉的儿子,连眼角那颗泪痣都一模一样。焦急的声音、慌张的神情,让你来不及多想,立刻掏出了手机……停!这可能根本不是你的儿子,而是骗子用AI"画"出来的假人。近期,"AI换脸+声音合成"诈骗在全国多地集中爆发,甚至登上了热搜第一。只需一张照片、十几秒语音,骗子就能1:1复刻熟人的面容与声音,实时视频通话毫无破绽,已有多人因此被骗走几十万甚至上百万的血汗钱。大家一边痛骂骗子缺德,一边感叹科技太可怕。但今天,我想带大家换个角度——如果我们戴上马克思
AI透明化陷阱:为何强制解释反而损害消费者?
TOP JOURNAL DIGEST | 营销科学前沿 AI透明度越高,消费者受损越严重? ——可解释人工智能监管的悖论真相 Marketing Science FT50 / UTD24 2025 Vol.44 No.3 一句话核心 强制要求AI完全透明可能导致企业与消费者双败——允许企业保留适度的“解释模糊性”,反而能推动质量竞争,最终使消费者获得更优产品或更低价格。 论文信息 标题 Regulating Explainable Artificial Intelligence (XAI) May Har
两部门联手推进人工智能计量体系构建
记者5月28日从市场监管总局获悉,近日,市场监管总局、国家发展改革委联合发布《人工智能计量体系和能力建设指引(2026版)》(以下简称《指引》),全面规划人工智能计量能力建设,重点解决算法“黑箱”“数据荒”等行业难题,并强化对智能制造、智慧医疗、智慧交通等14个关键领域的支撑作用。 针对算法“黑箱”、决策透明度不足等问题,《指引》提出开展AI系统内部状态监测与表征等关键技术突破,推动建立人工智能可靠、安全、可信的计量标准,确保AI技术性能实现“可测量、可比较、可追溯”。 围绕“数据荒”挑战,《指引》明确构
AI金融风险:技术缺陷与防控体系研究
作者简介:丁少斌 中国社会科学院大学应用经济学院汪红驹 国家金融与发展实验室高级研究员摘要:伴随人工智能在金融行业的深度融合,新兴金融风险问题逐渐显现。目前AI的技术短板在金融实践中展现出五种关键技术弱点:解释性缺乏影响风险追踪、数据偏差引发算法歧视、对抗敏感性增强入侵威胁、模型偏移造成决策失灵及算法趋同诱发市场共振风险。这些技术弱点通过自动决策偏差、算法歧视扩散、集体误判和基础设施依赖等渠道传导,形成从局部技术故障向系统性金融风险演变的连锁反应。AI模型的判断失误易被自动化流程放大,导致信贷排斥和资产配
能否驾驭人工智能?
今日开启阅读中信出版社发行的新书《驾驭 AI》——由“硅谷斗士”盖瑞·马库斯推出的力作。盖瑞·马库斯系美国著名认知科学家、纽约大学教职人员,长期致力于认知心理学、神经科学与人工智能的跨界研究。他以犀利批判 AI 炒作、质疑深度学习与神经网络的主流地位而著称,始终主张强化对 AI 的监管,是业界罕见的持续“持异议”的权威专家。他在序言中指出:“生成式 AI,实则是社交媒体乱象的升级版。”深思之下,确然如此。近年来,社交媒体已深刻改变了诸多事物。隐私日益透明,情绪更易被操纵,信息愈发碎片化。平台依赖“注意力经
贷款秒拒背后的秘密:AI如何决定你的信用命运
老张最近很糟心。他月收入一万八,信用记录干干净净,申请一笔12万的消费贷,却被瞬间驳回。他去银行讨说法,工作人员只回了一句:"综合评分不足。"系统?什么系统?评分依据是什么?没人能给他一个清晰的解释。这并非老张一个人的困惑。2026年,商业银行贷款审批已全面进入"无人工干预"时代。你以为是在跟银行打交道,实际上决定你命运的,是一个看不见、摸不着的智能模型。它不是凭直觉,而是算概率。传统审核靠经验,信贷员翻翻你的材料,凭直觉判断。智能审核靠的是数据和算法——它会把你过去两三年
周小川警示:AI深入金融领域将引发监管新难题
5月19日,在2026清华五道口全球金融论坛的专题讨论“金融监管新挑战:绿色、数字与人工智能”上,中国人民银行前行长周小川参与了该活动。有媒体观察到,按照论坛的议程安排,周小川原本没有发言安排,但有嘉宾主动与坐在观众席的周小川进行了交流。周小川表示,在听取其他嘉宾的发言后,他获得了很多启发,特别是关于人工智能在金融领域的应用等方面。“目前,我们主要关注的是岗位层面的智能化改造,但银行的整体架构,例如贷款对象、风险评估、风险定价、贷款决策等,虽然每个岗位都可以借助人工智能实现智能化,但整体框架仍然是现有的银