标签
Momenta曹旭东解读:世界模型与强化学习如何成为物理AI的双引擎

Momenta曹旭东解读:世界模型与强化学习如何成为物理AI的双引擎

4月25日,Momenta在北京国际车展期间举办了一场以"Momenta R7,物理AI序章"为主题的专题分享会。四位联合创始人共同登台,围绕公司的技术理念、产品实力以及全球化商业拓展等核心议题展开了深入探讨,正式宣布Momenta R7强化学习世界模型实现规模化量产,标志着自动驾驶从"观察世界"向"认知世界"的战略性升级,物理AI正式从理论概念迈向大规模商业落地。 Momenta披露的数据显示,公司已成功交付超过70款量产车型,获得定点的车型总数突破200款,量产项目遍布十余个国家和地区。装配Momen

2026-05-20 17:06:53  |  18 阅读

AI 视频迈向构建完整世界

NVIDIA Research 推出的 SANA-WM 颇具看点。它并非寻常的短时长视频生成手段,而是聚焦世界模型领域:致力于 60 秒级视频、720p 画质、相机操控及长视频的空间连贯性。对于创作者而言,关键不在于即刻投入商用,而在于洞察 AI 视频的演进趋势:从单纯生成美观片段,升级为构建可连续运镜的完整场景。#AI视频 #世界模型 #NVIDIA #AI工具 #视频生成NVIDIA Research 推出的 SANA-WM 颇具看点。它并非寻常的短时长视频生成手段,而是聚焦世界模型领域:致力于 60

2026-05-20 08:53:14  |  17 阅读

AI元老杨立昆:LLM路径已误入歧途,行业因盲目跟风陷入竞赛陷阱,他为何离开Meta?

👇关注后设🌟星标,获取第一手AI新动态本文内容整理自Yann LeCun(杨立昆)在Unsupervised Learning: With Jacob Effron频道的专访,讨论了Yann LeCun对当前AI发展的看法。原始内容参考:https://www.youtube.com/watch?v=ngBraLDqzdIYann LeCun(杨立昆)是著名AI科学家,图灵奖得主,被誉为“卷积神经网络之父”。他长期担任Meta(Facebook AI Research, FAIR)的首席AI科学家,主导了

2026-05-19 23:42:28  |  20 阅读
如祺数据首度亮相AI数据版图,全面发力具身智能与世界模型

如祺数据首度亮相AI数据版图,全面发力具身智能与世界模型

新浪科技讯 5月19日下午消息,如祺出行旗下数据业务板块"如祺数据"首次向外界完整披露其AI数据资产版图。官方信息显示,如祺数据资产已覆盖标注数据、行为数据、合成数据及多模态训练数据集四大类。 如祺出行的AI数据服务近年保持高速增长。2025年,以该业务为主要收入来源的技术服务板块该录得营收1.60亿元,同比增长487.4%。截至2026年5月,公司已在广州、上海、重庆、沈阳等城市部署超过300辆智能驾驶数据采集车,每日可产出1600小时、130TB合规数据。如祺出行表示,依托在真实出行场景的长期数据积累

2026-05-19 15:44:38  |  13 阅读

物理AI:从历史脉络到未来图景

物理AI的浪潮正汹涌而至。笔者认为,物理AI才是人工智能探索的终极疆域,反观当下流行的元宝、豆包等大模型,充其量不过是入门的“前菜”。平日里谈AI,大家多关注其在数字领域的文字生成、图像创作或股市预测,但物理AI(Physical AI)彻底打破了虚拟与现实的壁垒。它不再局限于处理比特,而是致力于走进由原子构成的物理三维世界,去感知、推理并改造现实。简言之,物理AI赋予了AI躯体与物理直觉,它嵌入在机器人、自动驾驶车辆、机械臂等自主设备中。不仅读得懂数据,更理解重力、摩擦力、碰撞等物理法则,从而在真实环境

2026-05-19 13:55:23  |  10 阅读

AI 前沿:Grok 绘图上线,Mustafa 预言白领危机

Grok 绘图功能启用、Claude 五日突破 M5 内核、Mustafa 断言 18 个月白领岗位遭替代1. Grok Imagine 绘图正式亮相 X 平台全面开放 xAI 图像创作能力,全员可用。依托最新文生图模型,兼容多种画幅比例,画质细腻度与真实感双重升级。2. 移动端 ChatGPT 融合 Codex 编程 ChatGPT 应用现已内置 Codex 手机编码特性,手持设备构建项目不再困难。3. Zerostack:纯 Rust 编程代理问世 秉承 Unix 理念、完全由 Rust 打造的编程代

2026-05-19 05:36:01  |  21 阅读

深度解析Physical AI:新一代人工智能系统

Physical AI(物理人工智能)指的是具备感知、理解、推理能力,并能对真实物理环境产生作用的人工智能体系。区别于传统AI(主要处理数字信息),Physical AI的突出特点是实现AI与物理世界之间的实时闭环互动。英伟达CEO黄仁勋的阐述(2025-2026年)Physical AI(物理AI)将开启人工智能发展的新纪元。——这是一种能够运动、行动,并与真实物理环境互动的AI。正如语言模型掌握了数字世界的信息处理能力,Physical AI将掌握理解与操控现实世界中物理实体的能力。三者关系:Phys

2026-05-18 20:16:11  |  16 阅读

物理 AI 崛起:智能时代的新疆域

2026年5月14日,美国Figure AI举办了一场全程无剪辑的直播活动——Figure 03人形机器人连续运转33小时,成功分拣逾4万件快递包裹。全程零人工介入,独立完成整个班次任务。其处理速度达到每秒0.37件,效率为人工的1.8倍,对不规则包裹的识别率高达99.7%。它不仅能自主更换电池,还能完成自我诊断,无需人工监视。这已不仅是机器替代人类的新闻。这标志着人工智能正式从“对话”迈向“操作”的关键转折——整个行业正经历一次根本性的范式转变:从语言智能迈向物理智能。这一新范式被称为:物理AI(Phy

2026-05-18 19:41:39  |  15 阅读
孙宇晨看好物理AI 五一视界股价大涨近30%受市场追捧

孙宇晨看好物理AI 五一视界股价大涨近30%受市场追捧

立足香港,放眼全球。新浪财经全球资本峰会金曜奖投票开启!探寻最具潜力的资本力量,你的支持至关重要,快来投票吧。 五一视界(06651)早盘股价攀升29.90%,目前报64.95港元,成交额达到10.52亿港元。 近期,波场TRON创始人孙宇晨(Justin Sun)公开指出,通用AI发展已近饱和,下一个增长极并非虚拟场景,而是物理世界的实际应用——他预测“物理AI将是未来十年最具潜力的超级赛道”。孙宇晨认为,近年来备受追捧的大模型主要解决的是信息处理问题,商业落地空间有限。相比之下,物理AI的核心在于把A

2026-05-18 12:58:39  |  15 阅读

打造AI原生产品团队:2026年第20周AI速报

导语:前阿里通义千问核心负责人林俊旸创立新实验室,寻求数亿美元融资,估值或达20亿美元(约136亿人民币)。高榕资本与红杉中国正在洽谈,但交易尚未最终敲定。这一动态引发了业界对大模型人才流动及新兴AI力量布局的密切关注。导语:Cursor CEO Michael Truell在最新演讲中指出AI编程已步入“agent时代”:企业中75%的代码由AI完全生成,30%的PR由AI端到端完成。他将软件开发划分为手工、Copilot和agent三个阶段,并通过浏览器自建实验等案例,展示了AI从辅助工具向自主协作者

2026-05-18 06:30:12  |  9 阅读

AI日报 | 马耳他全民免费获ChatGPT Plus,OpenAI架构重组Brockman全面掌权

📏 全文约1600字 | ⏱️ 阅读约4分钟 | 📅 统计截至2026年5月17日OpenAI 宣布,将为美国 Pro 用户推出 ChatGPT 个人财务管理功能的预览版本。核心亮点在于:通过 Plaid 安全接入超过 1.2 万家银行和金融机构,自动进行支出分类、生成可视化数据面板,涵盖投资组合业绩、订阅服务管理以及待支付账单跟踪等模块。据统计,目前每月已有超过 2 亿用户通过 ChatGPT 咨询预算和投资相关问题——这是一个庞大的存量市场。GPT-5.5 的推理能力提升为该产品奠定了技术基础,使得

2026-05-17 09:11:24  |  28 阅读

AI动态:林俊旸创业获20亿估值、Anthropic企业客超OpenAI、谷歌AI隐私泄露

今日AI领域可谓风波不断。前千问项目掌舵人林俊旸正式开启创业之旅,公司估值飙升至20亿美元;Anthropic在企业客户规模上悄然超越OpenAI;而谷歌AI助手却意外将用户真实手机号暴露给陌生个体。原阿里千问大模型技术领军人林俊旸近日选择独立创业,新公司聚焦世界模型与具身智能两大核心领域,估值已达20亿美元,红杉中国及高榕创投正积极接洽。他此前因反对千问团队拆分方案而离职,此次集结了来自字节、腾讯及海外背景的精英团队,其技术路线与杨立昆、李飞飞等顶尖AI学者不谋而合。作者随想:在产品尚未面世之际便获20

2026-05-14 17:05:33  |  21 阅读

DeepMind推出Genie 2.0:AI世界模型新突破

近日,谷歌旗下的DeepMind团队推出了新一代“世界模型”Genie 2.0。这一人工智能系统能够根据用户提供的文本描述或简单草图,在几秒钟内生成具有自洽物理规则、支持自由探索与交互的2D虚拟环境,大幅降低了互动内容创作的技术门槛。根据发布的信息,Genie 2.0的核心突破在于将人工智能的“理解”能力从静态像素提升到了动态世界模拟的层次。系统生成的并非固定图像,而是一个“状态空间”,其中物体之间可以发生碰撞,角色能够进行跳跃、移动等交互行为,环境也能对交互做出符合物理常识的反馈。该模型基于超过1000

2026-05-14 13:26:55  |  26 阅读

World Models:AI开始拥有物理直觉

你有没有这种感觉——ChatGPT能写诗编代码,Claude能帮你修bug,确实厉害对吧?但你注意到一个关键问题没:在它们眼中,世界不过是一堆文字符号。它不懂水往低处流。它不懂松手物体就会坠落。它不懂推一下桌子,桌子会滑动然后静止。它掌握了全世界的知识,却没有任何物理感知。这个问题,如今终于受到重视了。5月12日,MIT Technology Review发布文章,将World Models(世界模型)列为「当前AI领域最重要的10件大事」。执行主编Niall Firth专门录制了一段视频——"W

2026-05-14 05:28:45  |  13 阅读

万亿押注“世界模型”:AI 新纪元与机器人未来

近一年半以来,逾百亿美元资金涌向这一构想。Yann LeCun 告别 Meta 投身构建此类模型。Danijar Hafner——其 Dreamer 系列被视为基于模型的强化学习领域最具影响力的成果——离开 DeepMind 致力于商业化。NVIDIA 开源了全套技术栈。OpenAI 终止了 Sora 项目,将此举定义为转向“面向机器人的世界模拟”,随后团队负责人在三周内离职。如今多数被称为“世界模型”的产品,实则并非真正的世界模型。该术语现已囊括视频生成器、强化学习梦境引擎、抽象表征学习器及动作预测基础

2026-05-13 23:40:36  |  37 阅读