xAI近日正式推出Grok 4.5模型,主要面向希望控制AI辅助软件开发成本的开发者与企业用户。

官方声明显示,Grok 4.5的定价为每百万输入Token 2美元、每百万输出Token 6美元。该模型专为编程和智能体任务设计,推理速度达每秒80个Token,在部分软件工程任务上比同类模型消耗更少的Token。

Grok 4.5现已可通过xAI控制台和Grok Build使用,同时也已接入Anysphere旗下的AI编程工具Cursor,使xAI得以直接进入开发者日常使用的开发环境,而不仅仅依靠API渠道竞争。xAI表示,预计7月中旬将开放欧盟地区的访问权限。

今年6月,xAI的母公司SpaceX宣布收购Cursor背后的初创公司Anysphere,以强化其在企业AI工具领域的布局。Cursor方面另行表示,Grok 4.5是与xAI联合训练的,使用了包括用户与代码库及软件工具交互记录在内的数万亿Token的Cursor数据。

此次发布正好切中企业工程团队日益关注的痛点——AI编程智能体一旦超出简单提示词的应用范围,费用往往会急剧上升。

Counterpoint Research研究副总裁尼尔·沙阿(Neil Shah)指出:"企业正在遭遇AI投资回报率的瓶颈。自主智能体和编程任务所需的大量Token消耗正在带来账单冲击,使AI采用变成了一条代价高昂的单行道。"

在Artificial Analysis的编程智能体指数排名中,Grok 4.5在Grok Build上的表现略低于Claude Code中的Fable 5,与Codex中的GPT-5.5大体持平。数据显示,Grok 4.5每项任务的估算成本为2.49美元,相比之下,Codex中GPT-5.5为5.07美元,Claude Code中的Fable 5高达11.80美元。

尽管这些数据为xAI提供了有力的佐证,但分析师表示,企业仍需在自身代码库上实际测试后,才能大规模采用该模型。

市场研究机构JP Data的常务董事阿南德·乔希(Anand Joshi)表示:"现在断言Grok 4.5是否具有颠覆性意义还为时过早。基准测试成绩令人印象深刻,低Token消耗对企业具有吸引力。开发者社区最终会用实际结果来判断其编程输出是否优于竞争对手。"

Forrester首席分析师比斯瓦吉特·马哈帕特拉(Biswajeet Mahapatra)表示:"Grok 4.5的定价值得关注,因为它降低了运行智能体编程工作负载的经济门槛,但企业买家应该关注的是每次成功交付的成本,而非单纯的Token价格。"他进一步指出,如果一个低价模型需要反复尝试才能生成可用代码,实际成本反而可能更高。企业应着眼于编程工作流的整体成本,包括开发者审查工作量以及最终输出是否真正可用。

Omdia首席分析师苏连杰(Lian Jye Su)则指出了一个更深层的问题:Token用量已成为衡量价值的过度简化指标。"我们正处在一个将Token消耗视为终极价值创造的时代,但真正的价值仍在于任务是否真正完成。对大多数企业来说,每项任务完成的成本仍是评估智能体效果的最佳标准。"

因此,Grok 4.5的意义并不只是一个简单的价格故事,更是对xAI能否在真实企业工程环境中切实降低AI辅助开发成本的一次检验——而企业代码库往往会暴露出公开基准测试所忽视的模型弱点。

马哈帕特拉建议,SWE-Bench Pro、DeepSWE、Terminal Bench等测试可以提供早期参考信号,但企业在更广泛采用之前,仍应在自身代码库上将Grok 4.5与其他模型进行比较。苏连杰则认为,在真实开发环境中进行A/B测试并结合长期成本监控,能让企业对Token效率和输出质量有更清晰的认识。

Grok 4.5不太可能仅凭价格优势取代主流企业AI平台。其更现实的近期定位在于软件工程工作流,尤其适合那些已在同时使用多个模型、并尝试按成本、速度和准确性进行任务分配的企业。

苏连杰认为,Cursor和Grok Build的用户是最有可能从该模型中受益的群体。马哈帕特拉表示,Grok 4.5可能成为部分团队的主力编程助手,尤其是以软件工程为核心业务的团队,但规模较大的企业更可能将其纳入多模型混合策略中进行测试。

沙阿指出,随着企业对单一AI供应商依赖的警惕性提升,这一转变已经开始。高风险或复杂任务可能仍会交给Claude等模型处理,而如果Grok 4.5的准确性与竞品相差不大,则有望吸引高并发开发工作流及重复性智能体任务场景。

沙阿还补充道,Cursor的加入可能给xAI带来额外优势——通过利用Cursor中开发者的交互数据进行训练,Grok 4.5有望建立起基于程序员真实编写、审查与调试代码习惯的反馈循环。

Q&A

Q1:Grok 4.5的定价是多少?和竞品相比贵不贵?

A:Grok 4.5的定价为每百万输入Token 2美元、每百万输出Token 6美元。在Artificial Analysis编程智能体指数中,每项任务估算成本约为2.49美元,明显低于Codex中GPT-5.5的5.07美元和Claude Code中Fable 5的11.80美元,整体处于较有竞争力的价位。

Q2:企业在评估Grok 4.5时,应该只看Token价格吗?

A:不应该。多位分析师指出,低Token价格不等于低总成本。如果模型需要多次尝试才能生成可用代码,实际费用反而更高。企业应关注每次成功任务的完整成本,包括开发者审查工作量和最终输出的可用性,建议在自身代码库上进行A/B测试并监控长期成本。

Q3:Grok 4.5和Cursor是什么关系?

A:Cursor是Anysphere开发的AI编程工具,xAI母公司SpaceX已于今年6月宣布收购Anysphere。Grok 4.5是xAI与Cursor联合训练的,使用了数万亿Token的Cursor用户交互数据。目前Grok 4.5已直接集成到Cursor中,开发者可在日常编程环境中直接使用。

InfoWorld