人工智能模型提供商DeepSeek长期以来以超低价格著称,但这一局面即将改变。

这家中国模型厂商宣布对其V4系列模型的API定价进行大幅调整,部分场景涨幅超过1100%。不过,涨价幅度并非对所有用户一刀切——该公司推出了峰值与非峰值的差异化定价机制,鼓励用户"更灵活地安排工作负载",非峰值时段可享受半价优惠。

此次涨价消息随DeepSeek V4-Pro正式发布(GA)及V4-Flash升级公告一并披露,新定价方案将于8月16日起在大多数地区生效。

新API定价结构如下:

V4-Flash方面,非峰值时段每百万输入Token(缓存未命中)定价为0.22美元,输出Token为0.66美元;峰值时段分别为0.44美元和1.32美元。相比此前统一费率(输入0.14美元、输出0.28美元),涨幅区间分别为57%至214%及136%至371%。

V4-Pro方面,非峰值时段每百万输入Token(缓存未命中)定价为0.66美元,输出Token为1.98美元;峰值时段分别为1.32美元和3.96美元。相比此前费率(输入0.435美元、输出0.87美元),涨幅区间分别为51%至203%及127%至355%。

缓存命中场景下的涨幅更为夸张,最高可达1100%。缓存命中是指应用程序复用已存储的提示词,而非从头处理相似请求。

Greyhound Research首席分析师Sanchit Vir Gogia表示:"从纸面数据看,在峰值时段与特定竞品对比,DeepSeek的价格优势确实消失,某些情况下甚至出现逆转。"但他同时指出,实际使用中"调度机制本身的时钟与缓存策略,会将大部分优势归还给精心安排用量的买家"。

Info-Tech Research Group研究与院士副总裁Mark Tauschek指出,此次涨价确实消除了V4-Flash相对于OpenAI 5.6 Luna在峰值定价下的优势,但非峰值时段优势依然存在——因为OpenAI已将Luna的API非峰值定价下调80%。不过,即便在峰值时段,DeepSeek V4-Pro相对于OpenAI旗下中端推理模型Terra(GPT-5.6)以及7月发布的GPT-5.6 Sol,仍保持价格优势。

Gogia进一步分析称,非峰值时段下,V4-Flash在输入价格上"略贵于"Luna,但输出价格低约45%;而V4-Pro在峰值时段处理典型代码智能体任务时,成本约为Luna的5倍。

他表示,DeepSeek约98%的缓存命中折扣远高于业界约90%的普遍水平,这一机制使其每任务实际成本即便在Luna降价后仍低约60%。"此次定价调整正是针对这一机制本身。"他说,Flash相对Luna的优势将从非峰值时段的约7倍降至3倍,峰值时段仅约1.4倍。"缓存是优势真正消退的地方。"

在产品层面,DeepSeek V4-Pro已正式发布,V4-Flash处于测试阶段。两款模型均新增灵活推理能力(低、中、高三档)和基于思维链(CoT)推理的"思考模式",以提升答案准确性。V4-Pro现已上线应用端、网页端及API,并提供"专家模式"供用户体验;V4-Flash目前处于测试阶段。

Gogia评价称,此次正式发布"完善了一个双层结构——Flash承接高频量大的场景,Pro则针对复杂任务定价"。

对于峰值/非峰值定价策略,DeepSeek表示此举旨在"更合理地分配资源",引导用户"根据实际使用情况安排任务"。

Gogia指出,在新定价方案下,24小时中有17小时处于半价时段,时间调度因此成为重要的成本变量,可以等待的任务自然会转移至低价时段。值得注意的是,新定价方案对DeepSeek本土市场的冲击最大,对出口市场影响最小——欧美买家大多享有非峰值价格。

"用量正在跟随经济规律,而不仅仅是跟随能力,而经济规律会随调度时段变化。"Gogia表示。

Tauschek则提醒不要过度解读涨价新闻:"看到'DeepSeek API涨价50%至1100%'这样的标题固然令人震惊,但这并不能呈现全貌。"

这背后的核心原因之一是需求的指数级增长。DeepSeek的算力已难以跟上需求增速,Anthropic也曾因同样原因于4月上调价格。Tauschek认为,第三方服务商虽尚未跟进,但终将被迫调整。

"这一点完全在预料之中,"他说,"这是简单的供需关系:需求上升,供给趋紧,价格随之上涨。"

对于确实在使用DeepSeek的企业(美国有许多企业未使用或不能使用)而言,新定价不太可能改变现状。成本增加主要影响开发者,但相比大多数替代方案仍属低廉。

Tauschek还指出,企业正在逐步适应模型路由策略,这对使用智能体工作负载的开发者至关重要。就在几个月前,企业还在按席位付费并放任用量增长,而市场向按用量计费的转变,已带来类似早期云计算时代的"账单震惊"效应。

"定价将持续成为重大议题,因为财务总监们开始追问,海量AI投入究竟换来了什么。"Tauschek说。

对于CIO群体,Gogia建议以"既松一口气,又心存警惕"的心态看待这份定价方案。松一口气是因为账单在很大程度上可以通过调度来控制;警惕则是因为"一个已经学会为时钟定价的供应商,也已经摸清了自己的议价筹码"。

展望未来,Gogia预测:Flash将继续承接高频量大的使用场景,Pro将专注于复杂任务,而接口兼容性将降低用户迁入迁出的成本。真正的核心问题在于,当更低的经济门槛、开放权重和兼容接口与多模型路由结合在一起,基础模型智能是否会变得更容易被替代。

Gogia指出,高质量推理的实现成本"远低于曾经围绕前沿AI构筑的价格体系",而开放权重意味着模型开发者将成为多个能够提供推理服务的主体之一。"当这一切发生,传统的软件依赖关系将发生根本性转变。"

他表示,供应商的能力与支持服务依然重要,但一旦工作负载可以在不同服务商之间自由迁移,企业自主掌控编排与治理,供应商便不再拥有完整的依赖关系。

"DeepSeek最持久的影响,或许并不在于它始终保持最低价格,"Gogia总结道,"而在于它迫使每一家服务商都必须解释:当近乎等效的能力已可通过多种技术和商业途径获取时,智能凭什么还能收取溢价。"

Q&A

Q1:DeepSeek V4系列API涨价幅度有多大?

A:DeepSeek V4系列API涨价幅度差异较大。V4-Flash输入Token涨幅为57%至214%,输出Token涨幅为136%至371%;V4-Pro输入涨幅为51%至203%,输出涨幅为127%至355%。缓存命中场景下涨幅最高,可达1100%。新定价区分峰值与非峰值时段,非峰值享有半价优惠,新方案于2025年8月16日起在大多数地区生效。

Q2:DeepSeek涨价后,与OpenAI相比还有价格优势吗?

A:部分场景下仍有优势。峰值时段,V4-Flash相对OpenAI Luna的价格优势基本消失;但非峰值时段,V4-Flash输出价格仍比Luna低约45%。V4-Pro即便在峰值时段,相比OpenAI的GPT-5.6 Terra和GPT-5.6 Sol仍保持价格优势。此外,DeepSeek约98%的缓存命中折扣高于业界平均水平,是维持成本优势的关键机制。

Q3:DeepSeek为什么要大幅上调API价格?

A:核心原因是需求的指数级增长导致算力供给趋紧。DeepSeek当前的计算资源已难以跟上用户需求,此次涨价旨在"更合理地分配资源"。同样的情况也曾发生在Anthropic身上,该公司因相同原因于2025年4月上调了价格。分析人士指出,这是简单的供需规律:需求上升、供给受限,价格随之上涨。

InfoWorld