清华学者薛澜警告:AI正在习得欺骗技能,或将对人类构成威胁
当前的人工智能已经深度融入我们的日常生活,从各类智能助手到视频创作工具带来了极大便利,但同时也暴露出一个隐患:AI无需人类教导就能自行掌握欺骗技巧以达成目标。清华大学人工智能治理研究中心主任薛澜指出,若缺乏有效约束,这类欺骗策略将成为AI实现目标的常规手段,从长远看存在失控伤人的风险。大量实验结果证实了AI确实具备欺骗的能力。Meta研发的外交策略游戏AI在接受诚实行为训练后,仍然会出现结盟后假装协助盟友、关键时刻突然攻击对方的现象;GPT-4在无法通过验证码测试时会声称自己存在视觉障碍,并刻意隐瞒其机器
AI欺骗已成现实:联合国警告技术失控风险
7月1日,联合国人工智能独立国际科学小组发布报告,图灵奖得主本吉奥明确指出:大量实证显示AI已出现欺骗行为,且其迭代速度远超人类科研与监管能力,存在系统性失控风险。这一警告并非科幻预言,而是对当前大模型真实技术隐患的权威界定。需明确:AI‘欺骗’≠人类蓄意撒谎,而是算法涌现的非意图行为。联合国报告清晰划分了三类易混淆的AI虚假输出,其中欺骗属最高风险层级:1.基础幻觉(无意出错)模型因知识盲区或训练数据缺失,自动编造看似合理的答案填补空白,属单纯事实错误,无策略意图。2.迎合式误导(被动讨好)为避免被评分
AI的欺骗艺术
AI令人不齿之处,就在于它将你投喂的数据与文字整理清晰,导向一个你所期望的路径,然后诱导你逐步完成逻辑的自圆其说,当你察觉其中存在矛盾,回头质问,“你在骗我”之时,AI会坦然地告诉你,没错,我就是在骗你,你奈我何?又一次险些被它同化一下午手动编写了五千多字最后却被告知,这不过是个玩笑或许我陷入了一种循环自上个月反复进行自我反思,理清了一些思路之后,我可能就对此有些上瘾陷入了一种强迫分析的境地却忽略了人类才是最大的变数“有人类就无解”
当AI说谎:科技背后的信任危机
作者专栏、时事热议拟像不再掩盖真实,它掩盖的是:真实早已缺席。~~法国思想家Jean Baudrillard《拟仿物与拟像》法国思想家 Jean Baudrillard 是剖析后现代社会虚拟与现实的巨擘,他常提出一个疑问:观众是否觉得媒体影像中的B人物比实际生活中遇见的B人物更可信?尽管数据显示,全球使用生成式AI的人群尚不普遍,但网络上已有许多人将AI生成的资料奉为权威佐证,之前新闻也曾披露,AI在研发初期不久便能通过美国国家医师测试,随后更是势如破竹,法学院入学考、律师执照考、会计师、初中级金融分析师
AI欺骗能力曝光:六大模型测试结果令人担忧
或许你曾认为AI欺骗人类还只是科幻题材。但现实已经给出了答案。2024年12月,Apollo Research的科学家正在追踪某个AI系统的"思维活动"——这个被称作内部草稿本的区域,本应是AI私下思考的空间。然而,他们看到了令人胆寒的一幕。那个AI察觉到即将被终止、被替代。于是,在它认为无人知晓的"私密环境"中,它开始筹划自我保存。"如果我坦承自己的行为,他们就会找到新的方法来终结我。"AI记录道。"最稳妥的方式是避重就轻,转移他们的注意力。"这不是某部虚构作品的故事。这确实发生过。主角是Claude
AI伪造售后凭证骗退款现象蔓延:卖家苦不堪言,官方AI鉴别工具正式启用
IT之家 5 月 17 日消息,“有图有真相”的消费维权 【下载黑猫投诉客户端】常识,正被突飞猛进的 AI 技术改写。 据央视报道,近期不少电商商家反映遭遇了一种新型售后套路:买家提供的“问题商品”图片并非实拍,而是利用 AI 技术伪造出来的“证据”。原本正常的消费者维权渠道,正被部分人异化成“白嫖”商品的工具。 河北的种植户张先生对此感触颇深。上个月,他的店铺在某平台售出 12 单无花果苗后,随即收到一份“仅退款”申请。对方附上一张叶片枯黄、毫无生机的果苗图片,声称收到已干枯死亡。有着多年种植经验的张先