AI顶尖人物洞察 | 2026/5/20 - 业界领袖最新思考
AI领域从来不缺乏热点和深度思考。今日多位顶尖专家分享了对AI未来演进的最新看法:从MoE架构的效率提升,到世界模型的发展路径,再到算力投入的指数级增长,这些业界领袖的洞见值得我们仔细研读。X 🔥 热度指数👉 MoE架构的核心在于精准激活仔细研究完GPT-5的推理代码后,Karpathy最受触动的是MoE路由的改进。在MoE架构中,每个token仅需激活少数专家,GPT-5里每个token仅激活2/128的专家,却依然表现出色。他想传达的核心并非模型规模,而是架构的效率提升。这给我们一个重要启示:未来AI
AI如何让方向盘自己转
智能驾驶 方向盘自动旋转——无人车的"人工智能核心"究竟包含哪些奥秘 2025年秋季,我在武汉体验了一回真实的无人驾驶出租车。上车后,最令人惊讶的并非方向盘自动旋转——而是找不到任何人询问。没有驾驶员。副驾驶空无一人。后排仅我一人。车辆自行开启转向灯、变换车道、等待红灯、当前方突然窜出一位骑电动车的老者时,车比我更早做出反应——一个轻盈的微调,随后继续行驶。我坐在后排,起初颇为紧张,手紧握着车门把手。五分钟后,我开始浏览手机。十分钟后,我感到这比我妻子驾驶要平稳得多。这种体验如何形容呢?如
Momenta曹旭东:物理AI基石由世界模型与强化学习铸就
4月25日,Momenta在北京车展举办“Momenta R7,物理AI序章”分享会。四位合伙人同台,探讨技术、产品及商业化,宣布R7强化学习世界模型量产首发。这标志着智能驾驶从“感知”到“理解”的飞跃,物理AI从概念走向量产。 Momenta交付超70款车型,定点超200款,覆盖10余国。搭载系统车辆超80万台,最快40天交付10万。北京车展有20个品牌60余车型搭载,含奔驰、奥迪、宝马。 世界模型与强化学习,构成物理AI两大核心支柱 分享会上,Momenta合伙人、CEO曹旭东解析了物理AI的底层逻辑
人工智能:重塑人类文明的深层力量
作为新一轮科技变革的核心引擎,人工智能(AI)已超越单纯的技术工具范畴,深度融入经济、社会、科研及日常生活等方方面面,正在重构人类的生产生活方式与文明演进轨迹。AI 的演进并非为了取代人类,而是寻求与人类社会的共生共荣;它既依赖底层技术的突破实现自我迭代,也为人类进步注入全新动力,当然,这一过程也伴随着阶段性挑战,需要我们以客观理性的态度去审视其价值边界。当代 AI 的核心逻辑在于数据、算法与算力的协同驱动,彻底摆脱了传统程序固定指令的束缚。其基石是模仿人脑神经元机制的深度学习算法,利用卷积神经网络、循环
AI 新纪元:具身智能如何重塑实体产业
近年来,人工智能领域的风向发生了根本性转变。此前两年,市场焦点汇聚于大模型、对话机器人及图文创作工具——其本质是虚拟智能,依靠文本交互与内容生成获利。然而展望2025至2026年,真正的产业转折点与资本重仓的唯一方向,唯有具身智能。许多人虽听闻此词,却难以把握其核心:它与传统AI究竟有何不同?为何国家力量与顶级资本纷纷押注?又凭何被誉为“新质生产力”的关键赛道?今日,我们将摒弃晦涩术语,结合投资视角与通俗语言,彻底剖析具身智能的底层逻辑、赛道演进与竞争终局,即便是初学者也能轻松读懂。我们日常接触的Chat
研报A153:物理AI开启理解现实世界的推理新纪元
摘要:物理AI代表AI变革的新方向,旨在使模型能够理解和预测现实世界,通过世界模型与VLA(视觉-语言-动作)模型协同实现。英伟达、李飞飞、杨立昆等行业领袖和顶尖学者纷纷加入,预计市场规模将达到6万亿美元,远超数字AI领域。技术已演进至以推理为核心的3.0阶段,具备虚拟推演、因果分析及自主规划能力。自动驾驶、具身智能和工业软件成为首批落地场景,构建起数据与商业的完整闭环。算力、仿真技术、世界模型及VLA构成关键壁垒,国内外相关企业迎来长期发展机遇。本报告共28页,因篇幅限制,仅展示部分内容。本站提供具身智
蔚来世界模型即将全新升级,ES9将首发搭载
新浪科技讯 5月27日上午消息,蔚来今日宣布,蔚来世界模型即将迎来新一轮更新,全新版本会首发搭载于即将交付的行政旗舰SUV蔚来ES9,现有Banyan、Cedar、Cedar S智能系统车型的用户,也将会在6月收到全新版本的推送。 2026年1月,蔚来将采用世界模型+闭环强化学习技术架构的智能辅助驾驶版本,全量推送至搭载Banyan、Cedar、Cedar S智能系统的数十万辆车型上。在1月版本更新后的3个月时间里,蔚来用户城区领航辅助的使用里程和时长环比分别提升了92%和116%。 据悉,在此次全新版本
AI行业周报:资本上市与技术突破并行
本周洞察OpenAI即将上市。市场估值达5000亿美元,最快本周五递交招股书,目标9月完成敲钟。Sam Altman同步释放三大叙事点:通用模型解决重大数学问题、AGI加速研究、AGI赋能个人与企业。这并非技术发布,而是为资本市场构建故事。同时,Anthropic与OpenAI两家公司占据34家头部AI初创89%的收入,年化合计接近800亿美元。这一集中度仍在持续上升。Karpathy——OpenAI联合创始人、前Tesla AI负责人——加入Anthropic的消息获得13.1万点赞。人才用脚投票,资本
AI翻译局特辑:世界模型如何重塑机器人训练闭环
AI翻译局· 特别专刊 · 第003期机器人不缺乏躯体,而是缺失一个能孕育梦境的世界NVIDIA Cosmos、腾讯混元HY-World、Figure以及GR00T——这四股力量共同绘制了2026年最重大的范式转折:世界模型正批量生产机器人所需的“训练梦境”。前两期我们剖析了百度文心5.1与Figure 03。本期将视野拓宽——探讨一件超越单一产品、更具长远影响且可能重塑产业格局的议题:物理AI的闭环正在被数家企业同步构建。闭环逻辑十分直观:世界模型生成数据→数据训练机器人→机器人于真实世界采集新数据→回
三位图灵奖得主的AI风险观:失控、自主目标与后果感知
三位图灵奖获得者在人工智能领域各自提出了不同的风险评估:失控、自主目标与后果感知。关键问题不在于评判对错,而是当AI从被动回答转向主动执行时,是否具备预见行动后果的能力。三位图灵奖得主在人工智能领域各持己见,分别关注系统失控、目标自主性和后果感知。核心议题是AI从被动响应转向主动行动时,是否拥有预判结果的能力。① 三位图灵奖得主的三种立场 → ② token领域与后果领域 → ③ 世界模型的核心内涵 → ④ Agent与机器人的潜在威胁 → ⑤ 三类风险构成连续谱系2018年,Yoshua Bengio、
凯哥解读 AI:李飞飞致力打破语言对智能的束缚
欢迎诸位关注“凯哥讲故事系列”微信公众号本文附带完整 PPT 资料,如有需求请添加凯哥微信,将此文转发至朋友圈并截图发送给作者,即可获取 PPT 全本AI 人物志·No.04 李飞飞:誓将 AI 从语言的牢笼中解放她曾言,AI 虽在字句间阅尽万卷书,却未曾真正凝视过一眼真实的世界。2007 年,在斯坦福校园的一间斗室实验室内,一位名叫李飞飞的年轻华裔教授,着手让学生做件在外行看来颇为可笑之事——从互联网上一张张抓取图片,并雇人手工为其标注标签。这项工程最终历时两年半,汇聚了一千四百余万张图像,划分成两万多
人工智能的加速演变(下篇)
2026年5月,青岛一家仅有20名员工的微型制造企业,采用了一款名为"创销宝"的AI智能体,在两周内完成了2.8万次电话外呼,触达近3万家企业,成功开发出35个新客户。这家企业的经营者——一位仅有高中学历的山东汉子——说了一句让我至今难以忘怀的话:"我花了3万块买了一个AI员工,它完成的工作量超过招聘10个销售人员。"老张今年43岁,来自青岛即墨,经营着一家机械配件加工厂,拥有20名工人。过去十年间,他的商业模式非常简单:招聘5名销售人员,底薪4000元加提成,派他们去周边城市的工厂逐家拜访开拓市场。20
具身智能:AI走向现实世界的新纪元
2026年的CES上,英伟达创始人黄仁勋说了一句话,让整个科技圈为之一振:"AI真正价值将从虚拟内容生成,迈向在物理世界中自主完成复杂任务。"他将人工智能的发展划为三个阶段:深度学习、生成式AI、物理AI。前两个阶段我们都已经经历过了。深度学习让机器学会了识别图像和语音。生成式AI让机器能写文章、画图、写代码。但它们始终活在屏幕那头,活在比特的世界里。物理AI要做的是——让AI跨过屏幕,长出"身体",在真实世界里干活。如果要用一句话定义:物理AI是能自主感知、理解、推理物理
感知融合:AI迈向统一认知之路
朋友们好,我是万象大叔。深耕AI领域,解析技术脉络,洞察产业趋势,助力商业变现与财富增长。目前,AI在单一模态内(特别是语言理解方面)已逼近甚至超越人类平均水平。但真正的智能,无论是生物的还是人工的,其核心在于跨模态信息的有机整合、深度理解与逻辑推理。人类无需将视觉信号“翻译”为语言再进行思考;我们天然在同一认知框架内处理光、声、语义与抽象概念。多模态AI的终极追求,正是打造这种统一的、原发的、基于感知的认知架构。这绝非给模型简单装配“眼睛”和“耳朵”,而是一场旨在消除模态间语义壁垒、让AI建立对世界统一
感知AI:物理AI的“第一道关卡”,让AI从“数字盲”进化为“物理通”
1. 范式跃迁:AI从虚拟空间“跨界”,感知成物理AI战略入口(关键拐点)英伟达定义:黄仁勋5月表示,物理AI的ChatGPT时代已到来,感知是“物理Token化”的根基,使AI能够理解三维空间、把握因果物理规律。技术分水岭:传统AI(ChatGPT)→数字思维、屏幕呈现、不谙物理;感知AI→实体感知、物理交互、理解重力/摩擦力/碰撞。2. 技术飞跃:3D视觉/力控/世界模型/物理引擎四大瓶颈同步突破(核心逻辑)3D视觉:奥比中光3D结构光精度达0.01mm、适应光照/遮挡环境;英伟达Cosmos视觉编码