标签

中国AI大模型重塑全球调用新格局

发布时间:2026-08-10 09:54阅读:2

近期,国际模型聚合平台OpenRouter公布的最新周度Token(词元)调用排名发生里程碑式转变:榜单前五位均由国产大模型占据,其中DeepSeek V4 Flash拔得头筹,小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro以及智谱GLM5.2分列二至五位。DeepSeek V4 Flash正式版本推出后,其日均调用量与合作平台新增订阅用户均攀升约30%,凭借显著的性价比竞争力,重塑了全球AI开发者的使用习惯。

DeepSeek缘何登顶全球调用榜?这折射出我国大模型产业怎样的竞争实力?科技日报记者就此话题采访了相关专家。

第一问:DeepSeek为何登顶全球调用榜?

对于“登顶”成因,中国电子信息产业发展研究院未来产业研究中心人工智能研究室主任钟新龙指出,最直接的因素是DeepSeek V4 Flash正式版的发布。

他介绍,该正式版将先前预览版所验证的能力转化为稳定的商用服务,上线期间,DeepSeek与合作平台协同推进老版本用户的迁移及旧接口的停用,使得用户调用在短时间内集中涌向该正式版。

此外,极致的性价比叠加智能体场景需求,进一步放大了该正式版的用户吸引力。数据显示,该版本官方定价为每百万Token输入1元、输出2元,而智能体应用场景Token消耗量巨大,市场需求随之水涨船高。据报道,该版本上线后,日均调用量与合作平台新增订阅用户均增长30%,说明其发布既提升了存量用户的使用频率,也引入了新增客户的入场。“可以说,正式版上线点燃了需求,而成本性能比与智能体生态又将这种需求持续放大。”钟新龙解释道。

第二问:国产模型在技术层面具备哪些优势?

在国产模型包揽榜单前五的背景下,我国大模型的技术优势值得深入审视。“国产大模型的显著优势,已经拓展到全链路工程能力层面。”钟新龙表示。

以DeepSeek V4 Flash为例,其借助混合专家、稀疏注意力以及长上下文压缩等技术创新,在百万级上下文、推理能力、工具调用与低定价之间达成平衡;小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro及智谱GLM 5.2,则分别在多模态、代码生成、长程规划与复杂推理等方向形成互补。

“更重要的是,国内企业能够迅速完成灰度测试、正式发布、接口迁移与多平台分发,从而将技术突破快速转化为全球开发者的实际调用。”钟新龙说道。

第三问:将给国内AI企业带来哪些机遇与挑战?

从更长远视角看,国产模型在海外推理成本方面的优势,正为产业进步开启新空间。

我国大模型广泛采用MoE(混合专家)架构,该架构能够通过降低参数激活比例来削减推理成本。通俗而言,一家公司拥有数十位专家,处理某项任务时,MoE架构下只需“唤醒”其中几位最擅长的专家协同完成,无需调动全部人员,从而实现高效的“降本”。

在钟新龙看来,国内AI企业可借该正式版发布的契机吸引全球开发者,并由低价API(应用程序接口)服务逐步延伸至推理工具链、行业解决方案等高附加值环节,拓宽发展空间。同时,调用量的增长还将拉动国产推理芯片、服务器、存储等基础设施的需求,为软硬件协同优化提供真实落地场景。

然而,挑战同样不容小觑。钟新龙指出,高调用量未必带来高利润,正式版发布形成的流量高峰将考验企业的算力供给、服务稳定性与故障恢复能力,持续低价还可能挤压利润空间。另外,海外市场对版权合规、网络安全及审计等方面的要求日趋严格,持续推高合规门槛。“对国内企业而言,需进一步将价格优势转化为稳定的服务能力、合规的交付能力、繁荣的开发者生态以及高价值的应用场景。”钟新龙建议。(记者 崔 爽)