思科系统公司今日宣布扩展其现有机架级人工智能解决方案产品线,以应对安全AI工厂中大规模AI推理与训练计算的增长需求。

通过与超微电脑公司(Super Micro Computer Inc.)的合作,思科发布了面向超大规模、新云及主权云场景的"安全AI工厂"扩展方案组合,并符合英伟达云合作伙伴(NCP)认证标准。该方案前端采用思科基于Silicon One芯片的交换机,后端构建于思科基于英伟达Spectrum-X的交换机之上,整体由思科网络管理平台Nexus One统一调度。

思科总裁兼首席产品官杰图·帕特尔表示:"我们正处于有史以来规模最大的数据中心建设浪潮的起点。每家企业都在争相扩展AI能力,但速度只有在保障数据可控、Token成本可管、投资回报可期的前提下,才真正有意义。"

此外,思科宣布扩展其企业参考架构,纳入面向企业部署的最新一代方案。无论是小规模部署还是大型数据中心项目,都可借助成熟的最佳实践和专业经验,快速启动并原型验证基于英伟达AI部署的网络与机架级构建,显著降低风险。

液冷技术已成为大规模AI工厂与高吞吐计算的基础要素,与思科硬件高度契合。以英伟达Vera Rubin NVL72为代表的现代机架级系统单机架功耗可超过200千瓦,思科N9000系列交换机支持液冷,并与超微机架级液冷计算设备无缝协同,实现从机架到交换矩阵的AI工厂级传输速率。

随着万亿参数训练与高吞吐推理场景加速落地企业,散热问题将持续成为数据中心的核心瓶颈。NVL72及英伟达HGX Rubin NVL8等平台将持续在前沿运行,并对网络与冷却系统提出协同部署的更高要求。

Sharon AI联合创始人兼首席执行官詹姆斯·曼宁表示:"依托思科与英伟达合力打造的安全AI工厂,我们不再需要在性能、可靠性与管理便捷性之间取舍。NCP认证让我们从第一天起就对基础设施的优化程度充满信心。"

思科与超微的协作将为计算与网络基础设施提供经过严格压力测试的企业级就绪解决方案。交付后,全新的思科验证服务将协助客户对基础设施进行认证,确保其构建、设计及配置严格符合参考架构要求,从而在整个数据中心的计算、网络、安全与弹性管理中保持标准规范与最佳实践。

在日常运营中,通过思科Cloud Control后端交付的英伟达AI Enterprise软件与AgentOps,将允许客户灵活使用自有工具与实用程序。思科预计,大多数客户能够将AI工厂提供的软硬件能力视为现有系统的强力扩展,而非需要彻底重建的替换方案。

英伟达解决方案架构与工程副总裁马克·汉密顿在接受SiliconANGLE Media旗下直播栏目theCUBE专访时表示:"AI工厂是一个全新的概念——它既生产Token,也创造营收。但AI工厂必须与企业现有基础设施深度融合。AI的命脉是数据。当你使用ChatGPT或Gemini时,那些都是优秀的模型,但它们依赖公开数据训练。思科网络能够访问互联网之外、属于企业私有的数据资产。"

汉密顿进一步指出,这不仅仅是一个机架级方案,它为GPU提供了覆盖整个工厂范围的数据访问能力。这种连接性有望将数十万块GPU的计算与网络能力整合起来,以支撑智能体AI时代所需的大规模推理流量。

超微计算解决方案将于今年10月起作为"思科与英伟达安全AI工厂"方案的组成部分正式推出。

Q&A

Q1:思科安全AI工厂与英伟达的合作方案具体包含哪些核心技术组件?

A:思科安全AI工厂方案前端使用基于Silicon One芯片的思科交换机,后端采用基于英伟达Spectrum-X的交换机,并通过思科网络管理平台Nexus One进行统一管理。计算侧由超微提供液冷机架级服务器,支持英伟达Vera Rubin NVL72等高功耗平台,整体方案符合英伟达云合作伙伴(NCP)认证标准,面向超大规模、新云及主权云部署场景。

Q2:思科AI工厂方案如何解决数据中心散热问题?

A:随着英伟达Vera Rubin NVL72等现代AI平台单机架功耗突破200千瓦,散热已成为数据中心瓶颈。思科N9000系列交换机原生支持液冷,可与超微的液冷机架计算设备互联互通,实现机架到交换矩阵的高速传输,同时配合完整的液冷系统满足AI工厂级热管理需求。

Q3:思科安全AI工厂方案何时正式上市?

A:超微计算解决方案将于2026年10月起,作为"思科与英伟达安全AI工厂"组合方案的一部分正式推出。该方案还将配套提供思科验证服务,帮助客户对基础设施进行认证,确保构建符合参考架构标准。

SiliconANGLE