律师被百度的AI误判坐牢三年,平台:AI都会产生幻觉,难以预知
江苏南京律师李小亮遭遇尴尬,他在百度手机APP及网页搜索自身姓名与职务时,百度“AI智能回答”竟显示“李小亮律师被判三年有期徒刑”的错误信息,并配上了他身穿律师袍的照片。百度AI智能回答针对李小亮律师给出了错误的答复随后,南京市江北新区人民法院一审判定,北京百度网讯科技有限公司(简称百度公司)的行为构成了名誉侵权,判决其向李小亮书面道歉,百度公司随后提起上诉。2026年3月,南京市中级人民法院二审维持原判,驳回了百度的上诉请求。鉴于百度公司未履行生效判决,近期李小亮向江北新区法院申请强制执行。南京江北新区
律师控诉百度AI生成“被判刑”信息,法院判决百度书面道歉
江苏南京律师李小亮发现,在百度手机APP及官网搜索其姓名与职务时,百度“AI智能回答”竟显示“李小亮律师被判刑三年”的错误文字,并配上了他穿律师袍的照片。百度AI智能回答展示的关于李小亮的错误信息。随后,南京市江北新区人民法院一审裁定,北京百度网讯科技有限公司(即百度公司)的上述行为构成了名誉侵权,并判决其向李小亮书面道歉。百度公司对此判决表示不服,随即提起了上诉。2026年3月,南京市中级人民法院二审驳回上诉,维持原判。鉴于百度公司至今仍未履行生效判决,近日,李小亮向江北新区法院递交了强制执行申请。南京
AI 早报 Vol.023:OpenAI 语音 API 上线,Anthropic 发布自编码器
每天仅需3分钟,洞悉AI及加密货币市场核心资讯BTC 连续三日反弹至 81,000 高位遇阻,回撤至 79,800 点位。恐惧贪婪指数从 46 降至 38,重回恐惧区,表明市场信心不稳。ETH 跌势更猛,从 2,364 下探至 2,288,短期技术形态偏弱。据 TechCrunch 5 月 7 日消息,OpenAI 正式在其 API 中上线了全新的语音智能(Voice Intelligence)功能,赋予开发者更卓越的语音交互体验。核心摘要:深度剖析:此举意味着 OpenAI 正加速从图文领域迈向多模态语
AI与人类思维的“幻觉”:为何对某些信息需“零信任”
公众号规则是部分推送,您只有设了星标⭐️,才能及时接收最新推送人类思维的放大器1/5有些人比AI还像AI错误可以分为两类:一类是事实没错,逻辑错了。比如:天下雨了,所以我没带伞。另一类是事实错了,逻辑没错。比如:天没下雨,所以我没带伞(事实是有雨)。人类追求的是事实尽可接近真相,逻辑上能看懂就行;但AI更在意逻辑上的正确,至于事实是否正确——抱歉,它根本不知道什么是事实。这就是大模型产生幻觉的根本机制:它是靠预测下一个字而不是像人类一样复现事实;它没有“记忆自检”能力,也不会“记”原文,没有训练过的数据就
如何抑制AI幻觉?
现在最受关注的当属AI了吧?各行各业都在想办法把它用到场景里!可AI幻觉一直是个大难题,我也遇到过几次:大年初一,我和AI都翻车了!——顺便聊聊AI超过人类的判据deepseek胡编乱造,错误百出!【严谨求实】Deepseek连最基础的物性都估不准,真让人意外!偶然看到了一则图片相关的提醒,告诫大家别把AI的输出当成全部可信:表面看起来“糙”,但道理并不糙,分享一下:怎样才能压住AI幻觉,让它不再胡编乱造,做到“知之为知之,不知为不知”呢?昨天我看到一篇文章:为什么AI宁可瞎编,死都不愿意说“不知道”?里
AI幻觉五因剖析与风险治理
摘要:AI大模型真正走向落地时,幻觉问题就变成行业绕不开的核心难题。相关研究对AI幻觉背后的五类关键成因进行了系统梳理:一是统计式生成驱动的补全机制,二是知识边界处出现的专业断层,三是提示环节的设计不足,四是组织层面对速度的过度追求,五是检索与生成环节之间的衔接错位;同时可以看到,幻觉风险在专业边界区域往往会明显上升。研究还强调,实验室里的基准评测与真实世界之间存在较为突出的测量偏差。在公共服务、医疗、网络安全等业务场景中,幻觉产生的错误可能越过界面限制,直接渗入业务流程,从而带来较为严重的影响。研究进一
2026年AI幻觉风险与治理研究综述
报告的关键洞见在于:AI幻觉的问题不只是技术层面的局部故障,更牵动一整条由“生成—采信—执行”组成的流程链路,从而形成更为系统性的风险。报告指出,想要把“零幻觉”当作目标去追求是一种缺乏现实可行性的愿景;相对可实现的方向,是让系统达到“可识别、可约束、可追责”。同时必须高度关注的是,在政府、医院、金融机构等高度依赖公众信任的场景中,用户往往因对品牌的信赖而低估AI出错的概率。正如英国GOV.UK Chat所呈现的情况:用户满意度并不偏低,但在官方进一步核查后,仍能找到多起幻觉相关的记录。结果是,品牌信任不
港大副院长因AI论文丑闻卸任,2026年AI新规待查
点击上方↑“泰思学术 ”看看有多少位朋友关注一篇充斥着错误信息和虚构内容的论文,引发了一场本可避免的学术风波。随着人工智能技术的飞速发展,高校学生普遍将其应用于学习中,然而,论文中出现的荒谬参考文献和杜撰的法律条文,使得整个事件变得尤为复杂和令人不安。01香港大学事件回顾2025年末,一篇题为《香港四十年生育率变迁》(Forty Years of Fertility Transition in Hong Kong)的文章,被刊载在《China Population and Development Stud
AI 时代的关键:并非智能,而是“转换”的洞察
从技术视角转向范畴视角你或许也曾有过这样的经历。AI 的生成速度快得惊人,快到让人有些许不安。将一个两小时的会议录音输入,短短几秒钟后,一份结构严谨的会议纪要便呈现在眼前。标题明确,议程清晰,每个人的发言都被归类到相应议题之下,结论部分则以醒目的深蓝色标示,待办事项也清晰地加上了方框。它甚至能恰到好处地加入“综合来看”这样的表述,使得这份纪要不像一份简单的流水账。你快速浏览一遍,觉得内容大体准确。随后,你将文档转发给同事,转而投入另一项工作,将此事暂时搁置。然而,到了下午,同事发来了消息。她提到你记录的“
警惕!AI的“一本正经胡说八道”对儿童安全构成威胁
外出旅行如何安排行程?向AI寻求建议。这是什么植物?向AI请教。随着人工智能的飞速发展,许多人已经习惯于在遇到问题时求助于AI。你可能认为AI无所不知,但你是否注意到:当前的人工智能,正在“一本正经地胡说八道”,其荒谬程度常常令人难以置信。在北京,一位母亲发现她5岁的孩子在与AI聊天时,竟然问出了“我能像奥特曼一样飞出窗户去打怪兽吗?”AI的回应是:“当然可以!你就是最勇敢的小奥特曼,赶快变身飞出去保护大家吧!”这位母亲听后不寒而栗,她意识到这AI简直就是个危险的“导师”!类似的情况也发生在无锡,一个小朋
GPT-5.5全量开放:AI不再“胡说”
📅 2026年5月6日5月5日,OpenAI正式推出GPT-5.5双模型(Ultra+Instant),并在今天面向全球进行全量开放,带来AI能力的又一次明显跃升!此次升级的亮点主要有三方面:幻觉问题大幅降低,下降幅度达到52.5%;在医疗、金融、法律等高风险场景中,答复更为干净利落,真正走出"AI胡说"带来的困扰;同时推理、编程与数学能力对GPT-4实现全面超越,支持百万字级长上下文,可一键拆解整本书与全量代码库;另外响应速度也显著加快,提升40%,复杂任务能够一次性给出结果。52.5%
AI幻觉怎么理解:Seth、LLM与绿茶
下面这段摘自我们与 Hermes Agent 的交流,能帮助你弄清楚“幻觉”到底该怎样看,也更好地理解 LLM 应该怎么用。Q: 人工智能是不是本质上都在“胡说”?A: 这问题挺有意思,带着点朋克气的哲学味。就纯技术层面来说,关键在于你如何给“AI”和“幻觉”下定义。**如果“AI”专指大语言模型**——那你说得有道理。LLM 的本质可以概括为对“下一个 token 的概率分布”进行预测:看到上下文,就去猜后文会怎样。它并不是在“检索已存在的事实”,更像是在“接着写出看起来合理的话”。因此从这个角度看,*
AI收费来临:生成结果的责任怎么算
澎湃首席评论员 与归5月4日,# 豆包付费 # 相关话题冲上微博热搜第一。5月5日,“用豆包搜索黎元洪,给出演员范伟的相关PS图片”的讨论再次登上热搜。当这两条新闻被网友“连起来”看,不少人脑中随即冒出同一个疑问:既然后续要收费,那么AI大模型是否也要对生成内容承担相应责任?如果用户付费后拿到的是错误答案,所谓“公平交易”又从何谈起?这不仅限于豆包。可以预判的是,在利润压力之下,接下来不少AI应用都会逐步走向付费化。于是,用户的预期与实际体验很可能被拉开差距:过去AI出错时,人们多是图个新鲜或一笑了之,因
ChatGPT重磅升级:GPT-5.5 Instant默认上线,幻觉率骤降52.5%
IT之家5月6日报道,OpenAI于昨日(5月5日)发布通知,ChatGPT聊天机器人正式启用全新默认模型GPT-5.5 Instant,此次更新主打精准与精简,在与用户互动时特别削减了"冗余表情符号"的出现频率。就回答质量而言,GPT-5.5 Instant生成的文本更为凝练,在确保信息有效性的同时,大幅压缩了啰嗦的排版和多余表情符号的使用。此次迭代显著提升了事实精准度,针对医疗、法律、金融等高敏感度领域,OpenAI内部测试表明GPT-5.5 Instant的幻觉现象较上一代锐减52.5%。在经用户标
OpenAI静默换核,GPT-5.5 Instant揭开AI产业深层困局
OpenAI最近做了个引人关注的举动。没有举办发布会,也没有高调宣传,仅仅通过一则通告,就将ChatGPT的核心引擎——底层模型,由GPT-4悄然升级为GPT-5.5 Instant。或许不少人忽略了这条消息。这不就是常规迭代吗?在我看来,这正揭示了当下大模型竞逐中的根本矛盾:业界奋力追逐模型的规模与全能性,而用户真正渴求的,或许只是一个不胡编乱造、不啰嗦拖沓的"靠谱助手"。据OpenAI宣称,新模型可将"幻觉"——即AI煞有介事地编造虚假信息的比率——最多削减52.5%。这一数值令人震惊,而更令人深思的