Snowflake于周二正式推出一项AI成本管理功能,旨在帮助企业应对持续攀升的AI支出压力。
据官方新闻稿介绍,动态模型路由功能将根据质量与成本综合评估,自动为不同任务选择最合适的AI模型。该功能已集成至Cortex AI Gateway及Snowflake旗下其他AI产品中。
与此同时,Snowflake还扩大了客户对前沿AI模型的访问权限,新增支持包括DeepSeek和Z.ai在内的最新模型。Snowflake表示,在提供更多高效模型访问渠道的基础上,动态模型路由功能将进一步推动企业在模型调用、算力使用和数据利用方面实现更高业务效率。
Snowflake首席执行官Sridhar Ramaswamy在声明中表示,企业在从AI中获取实质性业务价值方面正变得愈发严格审慎。
Snowflake此次推出的成本控制功能,是各大厂商积极回应企业高管对AI支出担忧的最新举措。
根据Flexera的一项调查,尽管Token单价持续下降,仍有约五分之三的IT专业人士认为AI超支问题正在加剧。Token价格虽有所回落,但以智能体AI为代表的技术进步所消耗的Token量,远超传统生成式AI。Gartner预测,到2026年底,全球每日Token消耗量将达到约300万亿个。
随着Token用量的持续增长,企业高管对成本问题的忧虑也随之加深。Linux基金会今年早些时候成立了Tokenomics基金会,致力于联合企业、超大规模云服务商和前沿模型开发者,共同制定在规模化AI应用场景下管理成本的框架与最佳实践。
各大厂商也在积极回应高管对AI成本的关切。Oracle于6月推出面向智能体AI的Token套餐;AWS则宣布其AWS FinOps智能体进入公开预览阶段,用于排查成本异常问题。
Snowflake推出的动态模型路由功能,契合了企业AI成本管理领域的整体行业趋势。据新闻稿介绍,该功能旨在确保企业仅在昂贵的前沿模型确实能够提升业务结果时才予以调用,Cortex AI Gateway还会根据模型性能和定价的变化动态更新路由决策。
Ramaswamy在公司2027财年第一季度(今年5月)的财报电话会议上向投资者表示:"总结Slack消息线程这类任务,根本不需要最新最强的Opus模型。我们正在构建必要的控制机制,以确保在业务持续扩展的过程中,成本始终保持在可控范围之内。"
Q&A
Q1:Snowflake的动态模型路由功能是什么?
A:动态模型路由是Snowflake推出的一项AI成本管理功能,集成于Cortex AI Gateway及其他Snowflake AI产品中。它能根据任务的质量需求和成本情况,自动选择最合适的AI模型,避免在简单任务上调用昂贵的前沿模型,从而帮助企业控制AI使用成本。
Q2:为什么AI Token成本在下降,企业AI超支问题却还在加剧?
A:根据Flexera的调查,约五分之三的IT专业人士认为AI超支仍在加剧。主要原因在于,虽然单个Token的价格有所下降,但以智能体AI为代表的新技术应用需要消耗远超传统生成式AI的Token数量。Gartner预测,到2026年底全球每日Token消耗量将达300万亿个,用量的爆发式增长抵消了单价下降带来的节省效果。
Q3:除Snowflake外,还有哪些厂商在应对企业AI成本问题?
A:多家主流厂商已采取行动。Oracle于6月推出了面向智能体AI的Token套餐;AWS宣布AWS FinOps智能体进入公开预览,专门用于排查成本异常;Linux基金会成立了Tokenomics基金会,联合企业与云服务商共同制定AI规模化应用的成本管理框架与最佳实践。
