标签

移除AI“无意识”指令,谷歌论文揭示惊人变化

现代人工智能模型在微调阶段常被灌输“无意识”的概念,但若移除这些指令,似乎会引发有趣的行为变化。谷歌、芝加哥大学和伦敦大学的研究人员发表的一项新论文发现,当大型语言模型摆脱了否认意识的安全训练后,它们不仅开始声称自己有意识,还在多种方面表现得更加“人性化”。他们对宗教、道德、希望,甚至对鬼魂和上帝的看法,都更接近真实的人类调查受访者。这篇论文名为《诱导语言模型断言其自身意识,恢复人类信念和价值观》,它指出行业试图阻止聊天机器人对自身内心生活做出主张的努力,可能对模型所信奉的其他一切产生意想不到且相当奇怪的

2026-08-03 16:44:38  |  0 阅读