博通公司近日在拉斯维加斯举办的VMware Explore 2026大会上正式推出VMware私有AI云(VMware Private AI Cloud)。这是一套集成化软件栈,旨在帮助企业在保持对数据、模型和基础设施完全掌控的前提下,构建并运行AI应用,同时兼容传统工作负载。
该产品将VMware Cloud Foundation(VCF)基础设施与全新的VMware AI Factory、经过验证的AI模型、VMware Tanzu智能体开发及数据服务、AgentMinder治理软件,以及增强安全防护能力整合为一体。博通还同步发布了TrueSource——一个提供商业支持、可验证构建的开源软件产品组合。
VMware云平台基础设施与解决方案部门首席营销官兼营销副总裁Prashanth Shenoy表示:"这一产品将私有云基础设施与私有AI服务融为一体,以满足客户对数据主权、合规性和成本可预测性的需求,实现生产级推理与智能体AI的落地。"
整体架构的基础是VCF 9,该版本在统一平台上支持虚拟机、容器、推理工作负载和智能体应用。博通表示,VCF 9目前已有超过3000个客户部署,累计分配处理器核心超过1900万个。据Shenoy介绍,其非易失性内存NVMe内存分层技术可替代部分DRAM,在客户部署中已将每主机成本降低最高42%,同时保持性能不变。集群级存储去重功能则进一步压缩了容量需求,而Token监控、GPU追踪和AI指标仪表板为运维人员提供了资源消耗的全面可视化能力。
VMware AI Factory将VCF与博通及其合作伙伴共同测试过的硬件、加速器、AI软件和模型打包在一起。初始配置包括AMD Instinct MI350系列GPU,以及思科、联想和超微电脑提供的服务器。与MetalSoft Cloud编排平台的集成,可通过VCF操作控制台实现异构裸金属系统的自动化部署和全生命周期管理。
该平台支持来自AMD、英特尔和英伟达的加速器,并以vLLM作为默认推理和大语言模型服务引擎。博通表示,客户可运行150余款开源和商业模型。最新验证的模型包括英伟达的Nemotron 3、谷歌DeepMind的Gemma 4、NEC的日语模型cotomi、阿里巴巴的Qwen 3.7-Max,以及z.ai的GLM 5.2。
Shenoy指出:"并非每个AI场景都需要前沿大语言模型。"模型的选择越来越取决于具体任务、成本和治理要求。新推出的多租户模型共享功能,允许企业一次性部署某个模型,并向多个业务部门开放使用,同时隔离各租户的数据。
博通将Tanzu Platform定位为VMware私有AI云的智能体层。这一基于Cloud Foundry的平台即服务(PaaS),为AI应用开发提供预工程化环境,并配备"默认拒绝"沙箱机制——智能体若未获得明确授权,则无法访问API接口、网络、MCP服务器或互联网。凭证存储在独立存储空间中,防止智能体查看或泄露。
开箱即用的开发框架将涵盖已审批的技能库、工作流构建包、人工审核控件和记忆服务。一个经过审查的应用市场将提供模型、工具、技能和数据产品的访问入口,AI网关则负责对智能体行为进行监控、限速和日志记录。
新推出的AI就绪数据基础同样关注智能体治理的另一面:管控智能体所使用的信息。Tanzu将在客户环境内摄取并解析结构化、非结构化和多模态数据,添加元数据和语义层,将其转化为受治理的数据产品,并通过基于角色的访问控制和数据血缘信息在Tanzu市场中发布。
博通Tanzu部门副总裁兼总经理Purnima Padmanabhan表示:"您只需授权访问该经过整理、持续同步的数据产品即可。"Tanzu相关功能计划于2026年秋季正式上线。
智能体治理层
AgentMinder即日起正式发布,提供独立于智能体运行时之外的额外控制平面。它为智能体分配身份标识,并根据智能体的所有者、声明的任务、意图、已批准工具及授权资源,对每次操作请求进行评估。网关可在请求到达模型、MCP服务器、API或其他企业资源之前,对其进行允许、拒绝、重定向或脱敏处理。
博通身份管理安全部门副总裁兼总经理Clayton Donley表示:"AgentMinder是我们所说的智能体结构(agentic fabric),它介于您的智能体与大语言模型、MCP服务、API及其他各类工具之间。"
每当智能体发起请求时,AgentMinder都会通过基于证书的机器身份验证其身份,并执行最小权限策略,同时通过AuthZEN标准与现有授权系统集成。其基于OpenTelemetry的可观测层会记录提示词、工具调用和策略决策,形成完整审计链。博通表示,公司内部每天通过该技术处理约3600万次客户相关API调用和700万次员工相关API调用。
VMware vDefend计划新增的功能将通过检查VCF流量来发现智能体、模型、MCP服务器、数据存储和工具,同时识别未经授权的"影子AI"活动,并利用智能体流水线生成入侵检测和防御签名。Avi负载均衡器的即将推出的功能将对智能体事务进行检查,覆盖工具滥用、远程代码执行、文件注入和敏感数据外泄等场景。
博通应用网络与安全部门副总裁兼总经理Umesh Mahajan表示:"安全是智能体AI的核心命题。"
TrueSource将安全策略延伸至软件供应链层面,整合了Spring Enterprise、TrueSource Trusted Artifacts和TrueSource Data Services三大组件。Trusted Artifacts为更广泛的Java、Python和Node.js生态提供洁净室构建,以及经过加固的Bitnami容器镜像;Data Services则涵盖PostgreSQL、RabbitMQ、MySQL和Valkey。
博通使用前沿模型对Spring及其依赖树中超过5000个库进行扫描,但所有修复工作均由工程师审核,并回馈至上游社区。Padmanabhan表示:"我们是与维护者携手修复,而非绕过他们。"TrueSource三款产品均采用分级站点许可证模式,定价暂未披露。
Q&A
Q1:VMware私有AI云与普通公有云AI服务有什么区别?
A:VMware私有AI云的核心优势在于数据主权和本地控制。企业的数据、模型和基础设施全部部署在自己的环境中,不依赖外部公有云,满足合规性、数据安全和成本可预测性的需求。与公有云AI服务相比,它更适合对数据隐私和监管合规要求较高的行业,例如金融、医疗和政府机构。
Q2:AgentMinder是如何保障智能体安全的?
A:AgentMinder为每个智能体分配唯一身份标识,并在每次操作请求时验证其身份,使用基于证书的机器身份和最小权限策略。它介于智能体与大语言模型、MCP服务、API等资源之间,可对请求进行允许、拒绝、重定向或脱敏处理,同时记录所有提示词、工具调用和策略决策,形成完整的可审计日志,博通内部每天通过其处理超过4300万次API调用。
Q3:VMware AI Factory支持哪些硬件和模型?
A:VMware AI Factory支持AMD、英特尔和英伟达的GPU加速器,服务器合作伙伴包括思科、联想和超微电脑。平台以vLLM作为默认推理引擎,支持超过150款开源和商业模型,已验证的模型包括英伟达Nemotron 3、谷歌DeepMind Gemma 4、阿里巴巴Qwen 3.7-Max、NEC日语模型cotomi,以及z.ai的GLM 5.2。
