大语言模型供应商DeepSeek长期以来以超低价格著称,但这一局面即将改变。

这家中国模型提供商正在对其V4系列模型的API定价进行大幅上调,部分情况下涨幅超过1100%。不过,涨幅并非对所有用户都如此剧烈——公司鼓励用户"更灵活地安排工作负载",推出峰值定价与半价非峰值定价的双轨机制。

此次调价消息随DeepSeek V4-Pro正式发布(GA)及V4-Flash升级公告一同披露,新定价将于8月16日在全球大多数地区生效。

Greyhound Research首席分析师Sanchit Vir Gogia表示:"从纸面上看,在峰值时段与合适的对标产品相比,DeepSeek的价格优势确实消失了,甚至在某些情况下出现了逆转。"但实际上,"定价机制本身的时间窗口和缓存命中机制,会将大部分成本优势还给那些精打细算的买家。"

新API定价结构如下:

V4-Flash:非峰值时段输入价格为每百万Token 0.22美元(缓存未命中),输出为每百万Token 0.66美元;峰值时段输入为0.44美元,输出为1.32美元。相比此前统一的输入0.14美元,涨幅为57%至214%;输出此前为每百万Token 0.28美元,涨幅为136%至371%。

V4-Pro:非峰值时段输入为每百万Token 0.66美元(缓存未命中),输出为1.98美元;峰值时段输入为1.32美元,输出为3.96美元。相比此前输入0.435美元,涨幅为51%至203%;输出此前为0.87美元,涨幅为127%至355%。

缓存命中输入(即应用复用已存储提示词而非重新处理相似请求)的涨幅更为显著,达52%至1100%。

Info-Tech Research Group研究副总裁、杰出分析师Mark Tauschek指出,此次涨价确实消除了V4-Flash在峰值定价下相对OpenAI 5.6 Luna的价格优势,但在非峰值时段仍具优势——因为OpenAI已将Luna API非峰值定价下调80%。

Tauschek还表示,即便在峰值定价下,DeepSeek V4-Pro相对OpenAI中端推理模型Terra(即GPT-5.6)以及7月发布的GPT-5.6 Sol,仍保有价格优势。

Gogia指出,在非峰值时段,V4-Flash的输入价格比Luna"略贵",但输出价格便宜45%。而Pro在峰值时段的典型代码智能体工作负载成本,约为Luna的5倍。

他表示,DeepSeek约98%的缓存命中折扣远高于行业约90%的普遍水平,正是这一机制使其每任务实际成本比Luna低约60%,即便在Luna降价之后依然如此。"此次调价正是针对这一机制。"Flash相对Luna的优势从约7倍降至非峰值时段的3倍,峰值时段仅为1.4倍。"缓存才是优势真正被侵蚀的地方。"

DeepSeek V4-Pro现已正式发布,V4-Flash处于测试阶段。两款模型均新增灵活推理能力(低、高、最高三档)以及利用思维链(CoT)推理提升答案准确性的"思考模式"。V4-Pro现可通过应用、网页及API访问,用户可通过"专家模式"体验;V4-Flash目前处于测试阶段。

Gogia指出,正式发布"完成了双层产品结构的构建——Flash承接高频量大的场景,Pro则针对复杂任务定价"。

DeepSeek表示,峰值/非峰值定价旨在"更合理地分配资源",引导用户"根据实际使用情况安排任务"。

Gogia指出,在新定价机制下,每天24小时中有17小时处于半价时段,时间因此成为一个经济变量,可以等待的工作自然会转移到低价时段。事实上,新定价对DeepSeek本土市场的冲击最大,对出口市场影响最小——西方买家大多享受的是非峰值价格。"用户行为至少同样受经济因素驱动,而经济因素可以随时间表而变化。"

Tauschek认为,透过表象可以看到更为复杂的图景。"虽然'DeepSeek API涨价50%至1100%'的标题令人震惊,但这并不是故事的全貌。"

故事的另一面是需求——需求正在呈指数级增长。DeepSeek的算力已难以跟上需求,Anthropic也因同样原因在4月上调了价格。Tauschek表示,尽管第三方服务商目前尚未跟进,但最终也将不得不调整。

"这完全在意料之中,"他说,"这是简单的供需关系:需求上升,供给受限,价格自然上涨。"

对于确实在使用DeepSeek的企业(美国许多企业并不使用或无法使用),新定价不太可能改变什么。成本上涨主要影响开发者,但与大多数替代方案相比,仍然更具性价比。

他还指出,企业正在适应模型路由策略,这对使用智能体工作负载的开发者至关重要。就在几个月前,企业还在按席位付费并习惯性地消耗用量,但市场向按用量计费模式的转变,带来了类似早期云计算时代的"账单震惊"。

"定价将持续成为大问题,因为CFO们开始追问:巨额AI投入究竟换来了什么?"Tauschek说。

Gogia建议CIO们以"既释然又警惕"的心态解读这份定价方案。释然在于账单在很大程度上是可以通过调度来控制的;警惕则在于"一个学会了对时间定价的供应商,已经摸清了自己的议价筹码"。

展望未来,他预测Flash将继续承接高频用量,Pro处理复杂任务,而接口兼容性则会降低迁入迁出的成本。真正的问题在于:更低的经济门槛、开放权重以及兼容接口,结合多模型路由,是否会让基础模型智能变得更容易被替代。

Gogia指出,有能力的推理服务已经可以"远低于曾经围绕前沿AI的价格体系"来提供,而开放权重意味着模型开发者只是众多能够提供推理服务的主体之一。"当这种情况发生时,传统的软件依赖关系就会改变形态。"

供应商依然重要,能力与支持同样如此,但一旦工作负载可以在不同服务商之间迁移,企业自主管理编排与治理,供应商便不再掌控全部依赖关系。

Gogia认为,DeepSeek最持久的影响,未必是它保持了最低价格。"而是它迫使每一家服务商都必须解释:一旦近似能力可以通过多种技术和商业路径获得,智能凭什么还能溢价?"

Q&A

Q1:DeepSeek V4系列API此次涨价幅度有多大?

A:此次涨价幅度因定价类型不同而差异显著。V4-Flash输入价格涨幅为57%至214%,输出涨幅为136%至371%;V4-Pro输入涨幅为51%至203%,输出涨幅为127%至355%。缓存命中输入的涨幅最为剧烈,达52%至1100%。新定价将于8月16日在全球大多数地区生效,并采用峰值与非峰值双轨机制,非峰值时段享受半价优惠。

Q2:DeepSeek涨价后还比OpenAI便宜吗?

A:整体来看仍具一定优势,但差距明显收窄。在非峰值时段,V4-Flash输入价格比OpenAI Luna略贵,但输出便宜约45%。V4-Pro即便在峰值时段,相对OpenAI中端模型Terra和GPT-5.6 Sol仍保有价格优势。但V4-Flash在峰值时段已失去对Luna的价格优势。DeepSeek约98%的缓存命中折扣是维持成本优势的关键机制,但此次调价正是针对这一机制。

Q3:DeepSeek为什么要上调API价格?

A:核心原因是需求增长过快,算力供给跟不上。随着用户量呈指数级增长,DeepSeek的计算资源面临严重压力。这与Anthropic在今年4月涨价的原因相同。分析师指出,这是典型的供需关系——需求上升、供给受限,价格自然上涨。此外,引入峰值/非峰值定价机制,也是为了引导用户错峰使用,更合理地分配有限的算力资源。

Computerworld