DeepSeek API正式涨价生效,最高涨幅达1100%
8月17日,DeepSeek API进入新一轮调价周期。
据DeepSeek官方公众号8月13日发布的通知,平台对API收费方案作出调整,引入峰谷分时计费机制,非高峰时段费用为高峰时段的一半。高峰时段设定为北京时间9:00至12:00及14:00至18:00,其余时段归为空闲时段。调整后的价格自北京时间8月17日零点起正式执行。
以核心模型DeepSeek-V4-pro为例,高峰时段内,V4 Pro每百万tokens输入(缓存未命中)收费9元,涨幅达200%;输出价格为27元,涨幅350%;缓存命中输入价格0.3元,涨幅高达1100%。空闲时段,V4 Pro每百万tokens输入(缓存未命中)为4.5元,输出13.5元,缓存命中输入最低仅0.15元。
DeepSeek-V4-Pro正式版于8月13日正式上线,重点强化了智能体(Agent)相关能力。彼时,DeepSeek-V-Pro定价约为轻量级版本V4 Flash的三倍。按每百万tokens计费,V4 Pro输入端分别为0.025元(缓存命中)和3元(缓存未命中),输出端则为6元。与之对比,V4 Flash各项对应价格分别为0.02元、1元和2元。
据内部人士透露,DeepSeek推出峰谷定价的核心理念,在于缓解白天时段算力拥堵状况。通过市场化价格手段,鼓励企业开发者错峰分配大模型任务,分散高峰期的算力负载,进而增强平台整体运行的平稳性。
2025年以来,DeepSeek平台频繁出现服务故障,尤其是5月8日、21日、24日、28日接连出现宕机,根本原因在于用户规模激增66.7%,而算力储备仅扩容8.3%,供需矛盾显著加剧。
华龙证券此前发布研报指出,DeepSeek上调API价格,意味着国产大模型持续近一年的低价竞争阶段落幕,行业价格中枢开始回归合理区间,对算力供给与应用落地两端均将带来结构性变化。
在DeepSeek调价之前,腾讯云、阿里云、百度智能云均已先后提升API算力服务报价。智谱在年内已完成三轮API涨价动作。
智谱2025年度业绩沟通会上,智谱CEO张鹏透露,2026年一季度智谱API调用价格上调83%,即便提价后,市场需求依然旺盛,调用规模增长400%。当前,智谱已跻身国内付费Token消耗量最大的厂商行列。
科技企业纷纷上调API价格,根本动因在于AI技术高速演进背景下,算力供给难以匹配Token调用量的爆炸式扩张。
全球模型聚合平台OpenRouter最新周度Token统计榜单显示,8月3日至8月9日,全球AI大模型累计调用量突破69万亿Token,环比上升21.48%。其中,中国AI大模型Token调用量达34.25万亿,环比增幅21.76%;美国AI大模型Token调用量为9.17万亿,增幅高达109.36%。这表明,在OpenRouter平台上,中国AI模型调用量已连续15周领先美国,稳居全球首位。
上述榜单数据表明,8月3日至8月9日,全球调用量排名前四的AI大模型均来自中国。位居榜首的是DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版),当周调用量达8.83万亿Token,环比暴涨570%;腾讯Hy3模型以8.05万亿Token位列第二,环比增长67%;DeepSeek-V4-Flash-0423(即DeepSeek-V4-Flash预览版)排名第三,周调用量5.88万亿Token,环比下降19%;小米MiMo-V2.5以5.39万亿Token位列第四,环比下滑14%。
为应对Token调用量的爆发增长,腾讯等众多企业斥巨资扩充算力资源。腾讯2026年二季度财报披露,公司当季资本开支同比飙升176%至527.8亿元,自由现金流为-138亿元——剔除AI算力采购预付款项后,才转正为376亿元。
腾讯总裁刘炽平指出:“若按先用于自建模型、再支撑应用开发、最终对外出租算力的路径推进,我们将构建起规模可观的原生AI业务,并获取丰厚利润回报。
东方财富(19.300, -0.28, -1.43%)研究中心分析认为,算力供给的关键瓶颈集中在AI芯片领域。IDC数据显示,2025年中国AI加速卡总出货量约400万张,其中国产芯片约165万张,国产占比攀升至约41%。当前,国产替代已成为填补算力缺口的主要路径。
