思科宣布与超微电脑(Supermicro)达成合作,将后者的液冷与风冷服务器系统纳入思科的AI基础设施产品组合。具体而言,思科将把超微高密度计算解决方案作为"基于英伟达架构的安全AI工厂"(Secure AI Factory with Nvidia)的一部分对外提供。

安全AI工厂集成了多类产品,包括搭载英伟达GPU及Blackwell服务器的思科统一计算系统(UCS)、思科Silicon One或英伟达Spectrum-X交换芯片、思科网络设备、AI Defense/混合网格防火墙/Isovalent运行时安全等安全工具、用于基础设施健康监控的Splunk,以及英伟达AI企业软件。思科表示,整套打包系统可在思科和英伟达的架构资质验证程序下完成端到端验证,从而加快部署、降低风险、简化运营。

引入超微后,客户将获得其机架级和高密度GPU系统的访问能力。超微的液冷与风冷系统将经过验证,并作为思科AI基础设施产品组合的一部分统一销售。

思科在声明中表示:"此次扩展使客户能够便捷地将复杂的高密度AI集群与非AI工作负载统一管理。客户还可以部署从机架到网络结构的全链路液冷方案——将思科液冷AI网络系统与超微液冷服务器协同运用。这将使英伟达Vera Rubin NVL72和英伟达HGX Rubin NVL8等平台上的万亿参数训练和高吞吐推理场景成为可能。借助通用运营模型和现有技术能力,企业无需掌握全新的专有技术即可构建可信的AI基础设施。"

液冷选项的扩充是此次合作的重要组成部分。思科在一份问答文件中指出:"以英伟达NVL72为代表的现代机架级系统,单机架功耗可超过200千瓦,在此条件下,液冷已从可选方案升级为系统级必要需求。"

思科进一步表示:"在思科100%液冷AI网络系统的基础上,液冷思科N9000系列交换机可与超微机架级液冷计算设备直接互操作,从而打造从机架到网络结构的全链路液冷AI工厂。这一方案打破了此前困扰万亿参数训练、高吞吐推理和智能体AI的热管理与功耗瓶颈,使其不再是超大规模数据中心的专属能力,同时也将网络结构的性能效率与其所服务的计算能力深度协同。"

思科表示,将于10月起在安全AI工厂产品中正式提供超微计算解决方案。

Q&A

Q1:思科"基于英伟达架构的安全AI工厂"包含哪些核心组件?

A:安全AI工厂集成了搭载英伟达GPU的思科UCS服务器、Blackwell服务器、思科Silicon One或英伟达Spectrum-X交换芯片、思科网络设备、AI Defense等安全工具、Splunk监控平台以及英伟达AI企业软件,可实现端到端架构验证,帮助客户加快部署并简化运营。

Q2:为什么高密度AI服务器必须使用液冷方案?

A:以英伟达NVL72为代表的现代机架级AI系统,单机架功耗可超过200千瓦,已远超传统风冷的散热能力上限。在这种功耗密度下,液冷不再是可选项,而是系统层面的必要条件。思科与超微的合作正是通过从机架到网络结构的全链路液冷方案来应对这一挑战。

Q3:思科与超微的合作何时开始提供服务?客户能获得哪些新能力?

A:思科将于10月起在安全AI工厂产品组合中正式提供超微计算解决方案。客户届时可统一管理高密度AI集群与非AI工作负载,并可部署支持万亿参数训练和高吞吐推理的全链路液冷AI基础设施,覆盖英伟达Vera Rubin NVL72和HGX Rubin NVL8等旗舰平台。

Networkworld