Anthropic PBC宣布与超威半导体公司(AMD)达成一项价值数十亿美元的合作协议,将购买高达2吉瓦规模的GPU算力。
此次合作涵盖多个层面。值得关注的是,AMD将向Anthropic投资最高50亿美元,并引入Claude加速自身软件研发进程。
在硬件选型上,Anthropic采用了AMD MI450系列GPU,并将其部署于基于AMD Helios机架设计的整机系统中。据AMD介绍,每套Helios系统配备72块GPU,在处理FP8数据时可提供高达1.4 exaflops的算力性能。
Helios系统的另一大亮点在于其搭载了31TB的HBM4内存,比英伟达旗舰Vera Rubin系统高出50%。此外,该系统还提供43 Tbps的横向扩展带宽,这一指标衡量的是系统在AI集群中与其他机架之间的数据传输速度。
Helios不仅集成了GPU,还配备了中央处理器与Pensando数据处理单元(DPU)。这些DPU承担着十余项基础设施管理任务,包括追踪延迟等硬件可靠性指标、执行负载均衡以及对流量进行加密。
双方计划于2027年上半年开始部署上述硬件。与此同时,AMD与Anthropic还将启动一项多年期合作,致力于提升AMD软件开发流程的效率。AMD计划在此过程中"全面引入"Claude。
该合作将重点聚焦于加速ROCm软件平台的开发。ROCm作为Helios的配套平台,内置编译器可将用户的AI模型转换为AMD兼容格式,并提供一系列工具以提升训练与推理工作负载的性能。
AMD首席执行官苏姿丰表示:"我们将共同推动AI在规模层面的落地应用,并将Helios确立为下一代AI基础设施的重要平台。"
此次合作是AMD今年以来签署的一系列重磅硬件订单中的最新一笔。本周早些时候,AMD宣布微软已将Helios部署于其云数据中心。今年2月,Meta宣布计划向AMD采购最高6吉瓦规模的GPU,首批订单为基于MI450系列的定制GPU,Anthropic此次采用的也是同款芯片系列,Meta还计划进一步扩大对AMD CPU的使用。
Meta、Anthropic等AI市场主要参与者正积极向多家供应商采购芯片,以规避供应链瓶颈风险。Anthropic与AMD达成协议的数月前,已承诺向谷歌和博通采购价值数十亿美元的AI加速器,并宣布计划从英伟达额外购入高达1吉瓦的GPU算力。
Q&A
Q1:Anthropic从AMD采购的Helios系统性能如何?
A:每套Helios系统配备72块GPU,处理FP8数据时可提供高达1.4 exaflops的算力。系统搭载31TB HBM4内存,比英伟达Vera Rubin旗舰系统高50%,横向扩展带宽达43 Tbps,适合大规模AI集群部署。
Q2:AMD为什么要投资Anthropic并使用Claude?
A:AMD计划向Anthropic投资最高50亿美元,并引入Claude加速自身软件研发,重点是提升ROCm平台的开发效率。ROCm是Helios的配套软件平台,能将AI模型转换为AMD兼容格式,并优化训练与推理性能。
Q3:Anthropic为什么同时向多家厂商采购GPU?
A:Anthropic采取多供应商策略是为了规避供应链瓶颈风险。除AMD外,Anthropic还承诺向谷歌和博通采购AI加速器,并计划从英伟达额外购入约1吉瓦的GPU算力,通过分散采购保障算力供应的稳定性。
