标签

摩尔线程"AI工厂"战略全面启动 迎接Token经济新纪元

发布时间:2026-07-20 22:26阅读:2

"Token的使用量自今年开年以来,无论是月度对比还是日度对比,都呈现爆发式增长。"在正在举办的2026世界人工智能大会(下称"2026WAIC")期间,摩尔线程(603.000, -9.98, -1.63%)创始人、董事长兼首席执行官张建中如此表示。面对Token经济时代的来临,作为国产算力的核心力量,摩尔线程已构建起"三大'AI工厂'、两大AI原生终端、一大MUSA生态"的战略布局。

在2026WAIC上,摩尔线程首次公开多项训练推理实践成果,并展示了MTT C256超节点。摩尔线程生态副总裁兼生态科研部总经理吕其恒对包括《华夏时报》在内的媒体表示,从本次展会可以看出,人工智能应用已成为企业转型和业务增长的关键驱动力,需求涌现的速度在加快,国产算力的渗透率也显著提升。

三大"AI工厂"提供支撑

智能体催生了一种全新的经济形态,即"Token(词元)经济",特别是今年年初OpenClaw全球火爆之后。据央视报道,中国信息通信研究院副院长魏亮指出,我国日均Token调用量已从2024年初的约1000亿,跃升至2026年3月底的140万亿,增幅超过千倍。

"举例来说,普通人最快的阅读速度是一目十行,但对于AI来说,家里所有书架上的书籍给它,可能几分钟之内就能读完。这种超越人类极限的阅读、生成、理解与计算能力,使得Token的消耗量呈指数级增长。"张建中表示。

Token经济的爆发,对算力提出了更高的要求和更大的需求。在此背景下,摩尔线程致力于为AI发展提供支撑,依托摩尔线程夸娥(KUAE)智算集群,打造了"模型训练工厂""词元生产工厂"和"智能体生产工厂",满足从训练到推理、从数字世界到物理世界的多元算力需求。

"模型训练工厂"专注于训练各类模型,是一个复杂度高、难度系数大、要求严苛的领域。摩尔线程方面表示,凭借完善的训练套件和领先的训练优化、强化学习等技术,以摩尔线程全功能GPU为基础的夸娥智算集群在关键维度均已实现突破,例如在精度方面,训练精度与国际主流计算卡持平,训练损失曲线高度吻合。

"词元生产工厂"负责生成各类模型的Token服务。张建中表示,在这个环节中,降低单个Token的成本、实现快速适配和部署是典型的用户痛点。摩尔线程高性能推理套件深度适配SGLang、vLLM等主流推理框架,覆盖大语言模型、视觉、语音、DiT及视频生成等多模态推理场景,目前,摩尔线程可实现对DeepSeek、MiniMax、GLM、Kimi、Qwen等主流大模型的"发布即适配"。

"智能体工厂"则是与消费者最贴近的AI环节。摩尔线程自主研发的全域数字智能体"小麦",掌握60余项技能(Skills),支持38款App的跨应用控制,全栈具身智能仿真平台MT Lambda,构建了从底层算力、核心引擎到上层框架及工具的完整解决方案,致力于打造物理世界的智能体。

然而,在实际应用场景中,这三个层面的产品如何实现算力协同和数据互通呢?"这三个工厂面向不同的市场和定位,很难说哪个优先。摩尔线程拥有统一的GPU架构(MUSA),三个工厂并非采用不同的技术和产品,整个技术体系从硬件、GPU芯片架构到芯片,再到上层系统,实际上是完整统一的体系,所以一套方案可以支撑三个工厂。"摩尔线程高级副总裁董龙飞对本报记者表示。

超节点方案公开亮相

值得关注的是,本次WAIC上,摩尔线程还首次公开展示了MTT C256超节点。超节点是一种为构建大规模AI算力集群而设计的新型技术架构,通过高速互联协议将多个计算节点紧密耦合,形成逻辑上单一、物理上分布的计算系统,具备大带宽、低时延与内存统一编址等技术特征。

据悉,摩尔线程MTT C256超节点首创一层Scale-up网络,实现标准单宽机柜128卡全互联,并柜扩展可达256卡极速互联,解决了传统多层网络的带宽损耗与高延迟问题,在2U空间内释放极限的单位面积算力,采用计算与交换一体化的高密设计,将大幅提升智算中心GPU部署密度,为万卡乃至十万卡级超大规模长稳训推集群打造坚实算力底座。

超节点已是当前国产算力厂商的共识,除了摩尔线程,壁仞科技、燧原科技和沐曦股份(821.000, 41.03, 5.26%)也展示了各自的超节点方案。和其他厂商相比,摩尔线程的优势是什么?"在我们的系统中,定义了自己的MTLink协议,可以将卡与卡之间的通讯降低到亚微秒级别,人一次眨眼大约是10万微秒,所以它是几十万分之一眨眼的速度就可以完成一次通讯。在一次大模型计算中,要发生非常多次的通讯,所以我们可以通过这种技术把256张GPU像一张GPU一样整合在一起。"董龙飞介绍道。

不过,超节点虽然解决大模型规模化训练中因跨设备通信延迟与带宽不足导致的"通信墙"瓶颈,但这项技术成本也非常高昂。董龙飞坦言,一台超节点造价在亿元以上,以前一台服务器是8张卡,换一张卡服务器就不能用了,如果超节点里面坏一张卡,上亿的设备就不能运转了,哪怕只有一天不能使用,也会造成巨大损失。

因此,在他看来,超节点技术还需要解决大量工程性、稳定性的问题。根据各家厂商展示的内容,联接方案存在一些差异,比如摩尔线程用创新架构首创了一层Scale-up网络,壁仞科技采用的是NPO光互连的方式,燧原科技也展示了NPO光互连原型系统方案。

董龙飞认为,虽然每家GPU企业都有自己的互联技术,但在超节点系统中,这些技术实际上是通过后端的交换网络拓扑来实现的,而这个交换层本身也是可以解耦的,所以超节点其实是更上层、系统级别的事情,"当然,每家企业都在研究最适合自己计算需求的拓扑架构和CPU适配,包括推动国产化CPU、GPU以及交换技术的研发。大家都在这几条技术线上不断推进,所以这些路线并不是完全互斥或者割裂的,本质上其实是一种产业融合。"

责任编辑:黄兴利 主编:寒丰