OpenAI宣布大幅下调GPT-5.6系列中Terra和Luna两款模型的API价格,降幅分别为20%和80%。与此同时,这两款模型在ChatGPT Work和Codex中所消耗的使用积分也相应减少,旨在让企业订阅用户在不额外付费的情况下完成更多AI任务。

官方博客写道:"自7月30日起,Terra的API定价调整为每百万输入Token 2美元、每百万输出Token 12美元;Luna则调整为每百万输入Token 0.20美元、每百万输出Token 1.20美元。"

在此次调价之前,企业客户使用GPT-5.6 Terra的费用为每百万输入Token 2.50美元、每百万输出Token 15美元;Luna的价格则为每百万输入Token 1美元、每百万输出Token 6美元。

OpenAI表示,此次降价及积分消耗的实际缩减,源于服务效率的持续提升,使其能够以更低成本提供"更高价值的智能服务"。效率提升涉及AI训练与推理全栈的优化,涵盖软件和GPU基础设施。其中,GPT-5.6 Sol在优化生产GPU内核方面发挥了重要作用,有助于降低推理成本,同时不影响模型性能。

分析师认为,此次降价的主要目的并非削减企业AI支出,而是降低大规模部署AI的门槛。

Pareekh Consulting首席分析师Pareekh Jain指出:"对于CIO而言,最大的影响可能在于推动AI的规模化落地,而不仅仅是压缩成本或降低AI预算。更低的价格有助于将试点项目推向生产环境,在更多员工和业务流程中扩展AI应用,并使那些需要多次模型调用的复杂智能体工作流在经济上更具可行性。"

他进一步表示:"大多数企业不会因此缩减AI预算,而是会将节省下来的资金重新投入到更高频的AI使用中,让智能体执行更多推理、自动化和多步骤工作流任务,从而以大致相同的支出创造更大的业务价值。"他认为这一现象印证了杰文斯悖论——效率提升往往会带动资源总消耗量上升,而非下降。

Avasant研究总监Chandrika Dutt持相似观点,她指出,企业团队很可能会利用此次调价带来的空间,构建此前在经济层面难以推进的更复杂的智能体工作流。

从更宏观的视角来看,CIO应将OpenAI此次调价视为一个明确信号:未来24个月内,Anthropic、谷歌、微软等主流模型提供商的推理成本有望持续下降,大幅涨价的可能性极低。

Jain表示:"这些降价举措从长远来看具有广泛的可持续性。新型芯片、更优软件和更高效的模型设计将持续推动每Token成本的下降,而激烈的市场竞争也使任何单一提供商大幅涨价的风险极高,因此这种情况不太可能出现。"

他补充道,企业及其管理层应将AI FinOps和灵活架构的优先级纳入AI战略规划,以便随着各厂商性价比的持续提升,能够灵活切换模型。

值得注意的是,GPT-5.6系列中规模更大、能力更强的Sol模型此次并未调整价格。作为替代,OpenAI为Sol模型推出了新的快速模式(Fast mode),取代API中原有的优先处理(Priority Processing)功能。不过,现有标注为"priority"的API请求仍可继续使用。

Q&A

Q1:GPT-5.6 Terra和Luna的新API定价分别是多少?

A:自7月30日起,Terra的价格调整为每百万输入Token 2美元、每百万输出Token 12美元;Luna的价格调整为每百万输入Token 0.20美元、每百万输出Token 1.20美元。相比之前,Terra降价20%,Luna降价幅度高达80%。

Q2:OpenAI为什么能够大幅下调API价格?

A:OpenAI表示,降价源于服务效率的持续提升,具体涵盖AI训练与推理全栈的优化,包括软件和GPU基础设施的改进。其中,GPT-5.6 Sol协助优化了生产GPU内核,在不损害模型性能的前提下有效降低了推理成本,使OpenAI能够以更低价格提供更高价值的AI服务。

Q3:API降价对企业用户有什么实际影响?

A:分析师认为,降价的主要影响不是压缩AI预算,而是推动AI规模化落地。更低的价格有助于将试点项目转为生产,并支持构建需要多次模型调用的复杂智能体工作流。大多数企业会将节省的费用重新投入到更高频的AI使用中,而非单纯削减开支。

InfoWorld