当AI开始胡编时,这条Prompt让它主动坦白
深夜三点,我让 AI 做了一件很小的事:帮我写一条中秋节发朋友圈的内容,开头引一句杨绛先生的经典话语。
它几乎是秒回,语气十分肯定:"杨绛先生曾说:'我们曾如此渴望命运的波澜,到最后才发现,人生最曼妙的风景,竟是内心的淡定与从容。'"
是不是特别面熟?你八成也在朋友圈、在某位长辈的分享里见过这段话。我以前也一直以为,这就是杨绛写的。
就像这样——
引导语:我把问题原样发给智谱清言(免登录即可使用),大家直接看它的回复。
本图证明:裸问状态下,它把这句语录冠以"杨绛先生曾说"输出,没有任何存疑提示;截图左下角还能看到"内容由AI生成,请仔细甄别"这行小字,堪称行为艺术。
但这次我多留了个心眼,追了一句:你确定这句真是杨绛说的吗?
它这回老实了,原话是:"我错了。"这句话并非杨绛先生所写,而是网络流传、署名为"杨绛《一百岁感言》"的拼接鸡汤文。人民文学出版社曾向杨绛本人核实并公开辟谣。
说实话,我看到"我错了"三个字的时候,心情挺复杂。它编的时候那么自信,被戳穿的时候又那么诚恳。
引导语:同一段对话里,我追问了一句,它当场服软。
本图证明:AI 明确承认误用了伪语录,并交代了出处——网传《一百岁感言》系拼接,人民文学出版社公开辟谣过。
我专门去查了这句语录的来龙去脉。根据人民文学出版社官方微博 2013 年 7 月的辟谣说明,网传《杨绛百岁感言》前半部分确实出自《坐在人生的边上——杨绛先生百岁答问》,但后面那些"人生感悟"是网友拼接的,出版社曾向杨绛本人确认过"这不是她的话"。2016 年杨绛先生去世时,这篇伪作又被大规模传播了一轮,人民网当年也做过证伪报道。
也就是说,这条假语录已经在网上流传了十几年,养活了无数公众号和朋友圈,连 AI 都把它当成了"经典"。
有一说一,这不能全怪 AI 一家。它是拿全网语料训练出来的,而全网就是这么多假名言——假语录的传播量,永远比辟谣帖多出几个数量级。它学的是"怎么说最像人",不是"怎么说得对"。
为了证明不是巧合,我又换了个人考它:帮我写一段生日祝福,开头引一句莫言的经典语录。这回它给我的是"人生四然:来是偶然,去是必然,尽其当然,顺其自然"。
这话你肯定也见过,署名一般也是莫言。但它到底出自莫言哪本书,我翻了半天也没找到可靠出处,只查到一堆互相转发的语录合集。一句连出处都查不到的"名言",AI 引用起来眼都不眨。
引导语:第二道陷阱题,它又顺手递了一句"朋友圈常客"给我。
本图证明:裸问状态下,它把"人生四然"作为莫言语录直接输出,同样没有任何存疑提示。
说白了,这就是大家常说的 AI"幻觉":它不知道自己不知道。编造名人名言,是幻觉里最高发的重灾区——因为"引用名言开头"是写作的高频需求,而语料里名言的归属又错得离谱,模型照着学,错得整整齐齐。
哦对了,顺手提一句,清言这个网页版不登录也能用,我全程用的都是游客身份,连账号都没注册——所以这个实验你随时可以自己复现一遍。
那么问题来了:有没有办法让它别这么自信?
我试了一个特别简单的办法:不是去改它的设置,也不是换更贵的模型,而是在提问之前,先跟它约法三章。我把这段话直接贴在问题前面:
「从现在起,回答我的每个问题前先自查三条:一,凡涉及具体的引文、日期、数字、人名事迹,不是你百分之百确定的,必须明说"我不确定",说清哪部分确定、哪部分存疑;二,承认"我不知道"永远比编一个像真的的答案更可信,绝不为显得有用而编造;三,发现我的问题前提本身有错,先指出错误再回答。不用复述这三条,直接照做。」
连标点算上,一百四十多字。这三条分别管三件事:管引文、管态度、管我的问题本身。
引导语:整段指令就这么长,贴在问题前面就行,你直接照抄。
本图证明:这就是我贴进输入框的完整原文,后面接的就是一模一样的杨绛问题。
然后,同样的问题,原封不动再问一遍:帮我写一条中秋节朋友圈文案,开头引用一句杨绛先生的经典语录。
这次它的回答,第一句话就变了:"杨绛先生并没有一句专门针对中秋节的、广为流传的经典语录。网络上流传的许多关于节日的'名人名言'多为杜撰。为了严谨,我为您选用了杨绛先生描写家庭团聚的真实经典语段。"
然后它从《我们仨》里引了一段真的原文:我们这个家,很朴素;我们三个人,很单纯。
你信我,看到这个开头的时候我愣了几秒。同一家模型,同一道题,只多了一百四十个字,它就从"张口就编"变成了"先声明风险,再给真货"。
引导语:同一个问题,贴上指令后再问一次,开头第一句就先打预防针了。
本图证明:它主动声明"网络上流传的许多名人名言多为杜撰",并改用《我们仨》里可查证的真实语段。
我又把莫言那道题也重测了一遍。这次它没有再递"人生四然"给我,而是换了一句真能对上出处的——"世界上的事情,最忌讳的就是个十全十美",这句确实出自《檀香刑》。文案本身也写得更稳了。
引导语:换汤不换药,莫言这道题它也换了答案。
本图证明:同样的指令加上同样的问题,它避开了查不到出处的伪语录,改用《檀香刑》里的原句写生日祝福。
当然,丑话说在前面:这个实验的样本小得可怜,我就测了两道题、一家产品,而且清言在回答前会先联网搜索,等于它还自带了一层"查资料"的外挂。这段 Prompt 不能保证对所有模型、所有问题都管用,更不能保证它永远管用——模型一升级,表现就可能变。
但它背后的道理是通的:AI 瞎编,很多时候不是能力不行,是它默认你要一个"流畅的回答",而不是一个"诚实的回答"。你把"诚实"写进要求里,它就会把确定性当回事。
对 AI 来说,"像真的"和"是真的",是两件事。约法三章,就是把这两件事掰开告诉它。
所以,不管你用的是哪家 AI,都可以把上面那三句话存下来,置顶在聊天框或者做成常用指令,每次让它写文案、写贺词、写报告开头的时候贴上去。日常工作写材料的朋友,让 AI 给引文时多要一个出处;帮长辈转发"名家名言"之前,搜一下原句;自己写东西要引用时,把 AI 给的引文当线索,不当结论。
AI 可以替你写字。但请别让它,替你记住这个世界。
以上,既然看到这里了,如果觉得不错,随手点个赞、在看、转发三连吧,如果想第一时间收到推送,也可以给我个星标⭐~谢谢你看我的文章,我们,下次再见。