据报道,苹果正在评估一项企业级AI服务器计划,该计划基于自研芯片打造,并有一个有趣的转折点:苹果正在寻求英伟达的帮助来解决网络互联问题。
The Information的一份报告称,苹果正在考虑两种配置方案:一种搭载两颗未来的M8 Ultra芯片,另一种搭载四颗芯片的更大规格版本,目标客户是希望在自有硬件上运行AI推理而非依赖公有云的企业用户。
不过,该项目的时间线漫长且不确定,预计发布时间为2029年,报道同时提醒该项目也可能在此之前被取消,截至发稿时,服务器本身以及与英伟达的合作安排均未最终敲定。
苹果曾放弃的市场
如果这款产品最终发布,它将是苹果自Xserve以来首款专门打造的服务器产品。苹果曾于2010年11月宣布将停产Xserve,并于2011年1月底正式停止销售。
据MacRumors当时报道,史蒂夫·乔布斯在给法国网站MacGeneration一位读者的邮件回复中直言不讳地解释道:"几乎没有人购买它们。"Gartner的数据也印证了这一说法,Xserve每季度销量约为1万台,对于这家产品销量通常以数十万甚至数百万计的科技巨头而言,这个数字相当低。
苹果当时向用户推荐的替代方案是Mac mini和Mac Pro的服务器配置版本,即运行服务器软件的台式机,而非机架式硬件。如果2029年发布计划成真,这意味着苹果将在Xserve停售18年后重新回归服务器市场。
然而,这一次情况似乎有所不同:据The Information报道,OpenAI已购入数万台Mac mini和Mac Studio,用于通过强化学习训练AI智能体;Ars Technica也报道称,Anthropic通过亚马逊云服务租用了Mac mini设备。
对AI驱动的需求猝不及防
据报道,苹果对这波由AI驱动的硬件抢购潮猝不及防,公司当时既没有企业AI战略,也没有专门的商业工程团队,更没有专职的开发者关系人员来处理这些订单。因此,苹果甚至一度拒绝了企业客户购买其私有云计算基础设施访问权限的请求。
据悉,这一项目背后曾有一位重量级支持者:苹果现任CEO约翰·特纳斯,他此前曾负责苹果硬件工程团队。然而,供应短缺问题一直困扰着该项目,导致许多用户转而选择英伟达的DGX Spark和AMD的Ryzen AI Halo作为可行的替代方案。
不过,当前的关键仍在于苹果能否将大量芯片或裸片高效互联:苹果现有的旗舰产品M5 Ultra将于2026年9月22日随新款Mac Studio发布,这是苹果首款四裸片设计芯片,通过公司的UltraFusion桥接技术封装在同一芯片内,最高支持512GB统一内存,带宽达1.2TB/s,用户常将多台设备堆叠使用以满足设备端AI需求。
然而,要打造一款类似数据中心级别的企业级服务器产品,需要更强大的算力来满足AI需求,这也取决于芯片间互联速度的快慢;苹果目前的瓶颈在于Thunderbolt 5的传输速度,双向带宽最高仅为10GB/s(即80Gb/s)。
作为对比,英伟达表示,通过NVLink Fusion提供的第六代NVLink技术,可连接多达72个加速器,每个加速器带宽高达3.6TB/s。若比较双向总带宽,这一数字大约是单条Thunderbolt 5连接单向最高15GB/s(即120Gb/s)带宽的240倍。
苹果自身的宣传数据也暗示了这一差距所带来的代价:苹果表示,四台Mac Studio组成集群后,推理性能可达单台设备的三倍,这意味着在设备互联时,苹果已经付出了近25%的性能损耗代价。
这或许可以解释为何英伟达会出现在这场对话中:在苹果自研芯片性能进一步提升的同时,采用已被验证的成熟技术,帮助苹果在不增加当前性能损耗的前提下扩展其AI服务器野心,对这家总部位于库比蒂诺的科技巨头而言,或许是一个显而易见的选择。
Q&A
Q1:苹果计划推出的企业级AI服务器有哪些配置?
A:据报道,苹果正在考虑两种配置方案,一种搭载两颗未来的M8 Ultra芯片,另一种则搭载四颗芯片,规格更大,目标是面向希望在自有硬件上运行AI推理的企业用户。
Q2:苹果为什么要在服务器项目中寻求英伟达的帮助?
A:因为苹果目前的Thunderbolt 5互联技术带宽有限,难以满足数据中心级别的芯片互联需求,而英伟达的NVLink Fusion技术带宽远超Thunderbolt 5,能够帮助苹果在不增加性能损耗的情况下扩展AI服务器能力。
Q3:苹果上一次推出服务器产品是什么时候?
A:苹果上一款专门打造的服务器产品是Xserve,该产品于2010年11月宣布停产,并于2011年1月底正式停止销售,主要原因是当时市场需求过低。
