AI基础设施

Galaxy Digital是一家数字资产与数据中心基础设施公司,其核心判断是:一个兆瓦的价值,取决于其背后电网的可靠程度。

公司正围绕三个支柱构建多吉瓦平台——确保可靠电力来源、验证输电系统稳定性、搭建将电力容量转化为AI算力空间所需的机械与电气基础设施。

Galaxy数据中心联席负责人Austin Storms在接受《数据中心知识》采访时表示,公司希望自主拥有并运营物理基础设施,同时向算力客户出租设施。

"我们要做建筑物、机电基础设施的所有者和运营商,扮演向多类租户提供服务的房东角色。"Storms说。

这一战略正在特定背景下加速推进——6月,得克萨斯州电力可靠性委员会(ERCOT)录得超过438吉瓦的大容量并网申请,其中数据中心占比接近89%。同月,得克萨斯州公用事业委员会(PUCT)批准了ERCOT的"零批次"流程,通过全系统评估机制审查75兆瓦及以上的大容量并网申请。

Galaxy目前正将上述方法落地于西得克萨斯州1.63吉瓦的Helios园区,以及麦格雷戈市一处500英亩的地块。Helios当前以CoreWeave作为租户运营;麦格雷戈项目规划初期74兆瓦阶段,后续数百兆瓦的扩建则取决于输电基础设施的配套进展。

电力质量优先于一切

Storms表示,电力可用性与可靠性位于Galaxy选址流程的首位。公司会对每个候选园区的可用容量、通电计划、爬坡速率及输电基础设施进行系统评估,团队中还专门配备了电力系统工程师及前ERCOT输电建模专家。

Storms为业内那些吸引眼球的电力数字创造了一个词——"面子瓦数(bragawatts)"。"任何人都能在行业里拿到所谓的'面子瓦数',但并非所有'面子瓦数'都一样。"他说。

Persistence Analytics Group创始人Neil Osnato指出,对于大型AI园区而言,名义容量与可用电力之间的差距至关重要。一个批准的兆瓦数字,可能只代表在某种假设前提下"可能可用"的电量,并不说明何时能够通电,也无法反映系统承压时的供电稳定性。对于吉瓦级设施,开发商必须深入审查输电拓扑结构、应急性能、变电站配置、上游增强措施、设备可用性,以及建设和通电时间表。

"大型AI园区买的不是一个并网接入点,"Osnato说,"买的是对整个上游电力系统的风险敞口。"

Storms以一个假设为例:位于西得克萨斯州、接在138千伏放射状线路末端的选址,正是Galaxy可能拒绝的电力配置。Osnato指出,这类地点会引发一系列疑问:应急性能如何?是否存在独立供电路径?上游改造进展怎样?恢复供电的风险敞口有多大?现场自备发电是否在弥补电网薄弱的问题?

"500兆瓦接在薄弱放射状线路末端,和500兆瓦依托稳健冗余输电配置,我给出的价值判断截然不同,"Osnato说,"兆瓦数可能相同,基础设施价值完全不同。"

Galaxy在项目进入投资委员会审议之前,会对候选园区进行多维度评估,电力、开发及数据中心团队分别审核基础设施条件与开发假设前提。

Osnato认为Galaxy的输电分析具有实质意义,尽管成熟开发商普遍已将此类分析纳入标准流程。真正的优势在于:能够在早期识别薄弱假设,并随着公用事业承诺、所需升级、设备可用性、周边负荷及通电时间线的变化,持续重新验证电力条件。

"建数据中心是一门艰难的生意,"Storms说,"但如今已相当同质化。"Galaxy的差异化体现在:获取高可用、高可靠的电力,并按时、按预算交付物理基础设施。公司可以在主要电力审批完成之前先做出较小承诺,随着项目通过开发节点再逐步加大资本投入。即便如此,Storms表示,在向园区投入大量资本之前,Galaxy仍需获得相当程度的电力审批。

Helios奠定发展模板

Galaxy将Helios从比特币挖矿转型为AI基础设施的经历,帮助确立了公司的运营模式。

原始设施是围绕比特币挖矿设计的——挖矿负载可以容忍中断,而这对服务商业客户的AI数据中心而言是不可接受的。Galaxy对设施进行了升级,以满足更高的可用性与可靠性要求。Storms将比特币挖矿设施定义为实质上的"零级数据中心",并表示Helios已按可并行维护标准重新设计,可用性指标远高于原来的挖矿设施。

在Helios,Galaxy将站点层面的公用事业批准容量、总设施电力,以及最终可供服务器使用的较小关键IT负载加以明确区分。

根据Galaxy披露的信息,该园区拥有1.63吉瓦的容量,已完成ERCOT的大容量并网服务(LLIS)流程,并与公用事业公司签订合同。CoreWeave已承诺使用800兆瓦总电力容量,对应三个开发阶段共526兆瓦的关键IT负载。

第一期已向CoreWeave交付约200兆瓦总电力容量和133兆瓦关键IT负载,签订15年租约。Galaxy表示,正就Helios额外830兆瓦已批准容量与潜在租户洽谈。

Storms将Galaxy整体业务定位为多吉瓦、多租户,但他倾向于每个园区只引入单一租户。这种结构简化了电力分配,并减少了多个客户共用同一上游公用事业基础设施时可能产生的复杂问题。

"我们想做多租户业务,"Storms说,"但在多租户体系内,以单租户园区运营,是我们目前实现自身增长最简便高效的扩张方式。"

劳动力正在左右选址决策

电力可用性是Galaxy的首要考量,而建筑劳动力则越来越大程度上决定一个选址能否通过后续评估。

Storms表示,随着开发商在全美竞相推进多吉瓦数据中心建设,熟练电气与机械技工已成为公司最大的普遍性制约因素。他说,供应链压力相比18至24个月前已有所缓解,但熟练劳动力仍难以保障。

Galaxy在Helios旁边建设了一个可容纳最多1600个床位的劳动力发展基地。这段经验也影响了Galaxy下一步的选址逻辑。Storms举例说,怀俄明州某假设中的吉瓦级园区或许在电力和环境条件上颇具吸引力,但如果Galaxy无法调配足够的熟练工人按期完工,同样会被筛除。

在评估德克萨斯州以外的市场时,电力可用性、电力可靠性和建筑劳动力获取能力是主要考量因素;水资源和光纤,Storms表示,通常是相对容易解决的问题。

德克萨斯州是核心市场,但并非唯一

Galaxy持续看好德克萨斯州,原因在于该州丰富的基础能源资源。Storms列举了天然气发电、太阳能开发和公用事业规模电池储能,认为这些构成了长期数据中心发展的优势条件。

与此同时,Galaxy也在向ERCOT之外拓展。Storms透露,公司在德克萨斯州以外拥有强劲的项目储备,包括中部大陆地区一个约300兆瓦公用事业容量的候选站点。

评估框架在各市场保持一致:首先审查电力可用性和可靠性,继而评估Galaxy能否集结所需劳动力和基础设施来完成园区建设。公司还会评估站点可承载的AI工作负载类型——Storms表示,西得克萨斯州可以支撑超大规模训练集群,而靠近主要经济走廊的站点则在推理工作负载的延迟方面更具优势。

Galaxy呼吁建立大容量负载统一规则体系

跨电力市场的实践经验,促使Storms对电网运营商提出一项诉求:为区域输电组织和独立系统运营商制定统一的大型算力负载并网框架。

ERCOT、PJM、MISO和SPP均在探索各自的大型电子或算力负载接入方案,而Galaxy希望各市场之间能有更强的一致性。"Galaxy以及整个行业最需要的,是公用事业公司、独立系统运营商和区域输电运营商提供一套完整成型的框架与规则体系,明确这类设施如何接入现有电网。"Storms说。

他补充道,统一的框架将使开发商能够在多个市场复用成熟的高压基础设施和数据中心设计方案。

ERCOT的零批次流程在一定程度上指示了变革方向——该流程以全系统评估方式审查合格的大容量并网申请,识别其综合可靠性影响及所需输电升级内容。对Galaxy而言,这一流程印证了在资本承诺前提前验证各项假设的价值所在。

Galaxy早于行业判断出电力瓶颈

Storms表示,Galaxy于2024年中期开始研判AI基础设施机遇——一支小团队前往硅谷,评估预期AI需求的规模。公司得出结论:AI开发者需要海量算力,而其中许多人缺乏足够的电力管道来支撑部署。Galaxy识别出横跨发电、输电和并网的瓶颈,并在零批次流程成形之前便开始推进ERCOT的并网申请。

7月,Galaxy为Helios两栋建筑定价发行35.07亿美元优先有担保票据,相关设施涵盖8个数据大厅、400兆瓦公用事业容量及260兆瓦关键IT容量。这笔融资直观呈现了将已批准电力头寸转化为运营中数据中心所需的资本规模。

这一战略并不能消除执行风险:输电升级、设备交付、建筑劳动力、公用事业节点以及租户时间安排,都可能延缓已批准容量转化为收入的进程。

Galaxy的赌注在于:严格的电力分析能够在足够早的阶段识别出上述风险,从而将真正可行的AI园区与一串漂亮的容量数字区分开来。

Q&A

Q1:Galaxy Digital选择数据中心选址时,最看重哪些因素?

A:Galaxy Digital的选址首要标准是电力可用性与可靠性,包括可用容量、通电时间表、爬坡速率及输电基础设施质量。其次是建筑劳动力的可获取性,熟练电气与机械技工已成为当前最大瓶颈。此外,公司还评估水资源、光纤及站点能够支持的AI工作负载类型,例如西德克萨斯适合超大规模训练集群,靠近经济走廊的站点则适合低延迟推理工作负载。

Q2:"面子瓦数(bragawatts)"是什么意思,为什么Galaxy Digital要特别提到它?

A:"面子瓦数"是Galaxy Digital联席负责人Austin Storms对业内那些只为博眼球、却未必真实可用的电力容量数字的戏称。他指出,一个获批的兆瓦数可能只在特定假设条件下成立,无法反映实际通电时间和系统压力下的供电稳定性。对于吉瓦级AI数据中心,真正重要的是输电拓扑、应急性能和变电站配置等深层基础设施质量,而非单纯的容量数字。

Q3:Helios园区目前的运营状况如何?

A:Helios园区位于西得克萨斯州,总容量1.63吉瓦,已完成ERCOT大容量并网服务流程并签订公用事业合同。CoreWeave作为当前租户,承诺使用800兆瓦总电力容量,对应526兆瓦关键IT负载,分三期开发。第一期已交付约200兆瓦总电力容量和133兆瓦关键IT负载,签订15年租约。Galaxy正就剩余830兆瓦已批准容量与潜在租户洽谈。

DataCenterKnowledge