一批全新的智能体 AI PC 承诺能够实现这一点:这类性能强劲的笔记本可以把 AI 工作放在本地完成,而不是发送到云端昂贵的大语言模型处理,从而削减 Token 成本。

惠普新发布的 ZBook Ultra G3a 移动工作站以及其他 PC 厂商即将推出的笔记本,均配备面向 AI 与图形负载设计的强大 GPU 和大容量内存池。ZBook Ultra G3a 采用 AMD Ryzen AI Max Pro 处理器,而其他厂商的笔记本将搭载英伟达的 RTX Spark 超级芯片。

英伟达的 Blackwell GPU 在数据中心占据主导地位,如今该公司正借助 RTX Spark 进军 PC 市场的更大份额,这款芯片包含一颗 Blackwell RTX GPU。来自华硕、戴尔、联想等厂商的第一波 RTX Spark 笔记本面向消费者,企业级机型计划稍后推出。相比之下,惠普的 ZBook Ultra 明确瞄准企业用户。

在无需联网的情况下,这些 PC 就能运行具备数十亿参数的 AI 模型,执行智能体和聊天机器人、生成视频以及编写代码。

英伟达产品管理高级总监 Gerardo Delgado 表示:“这是唯一一类 PC,既拥有足够的内存来运行大模型,又具备足够快的算力,同时我们多年来加速过的所有工具也都能正常工作。”

当然,云端 AI 模型更强大、能力更全面。但云端 AI 成本高昂,而这些 PC 能为相关账单减轻部分压力。

惠普全球 Z 工作站产品经理 Brian Allen 表示:“当人们开始收到自己的 AI Token 账单时,要么被烧到,要么真的开始担忧。”

J. Gold Research 首席分析师 Jack Gold 表示,未来两到三年内,至少 20% 至 25% 的高端 AI 工作负载将在 AI PC 上运行,而非完全放在云端。

Gold 表示,这类智能体 AI 设备不会便宜,但它们能削减持续的云成本,这在需要产出多个版本项目的研究与工程工作中尤为重要。

Gold 表示:“未来六个月内,我们还会看到这一领域出现更多产品,尤其是随着更多厂商推出专门面向该领域的芯片。”

早期的 AI PC,尤其是搭载微软 Copilot+ 品牌的 Windows 设备,只是卸载了一些基础助手任务,而 ZBook Ultra G3a 是面向高端企业负载的 AI 移动工作站。

Allen 表示:“我实际上是在构建大型语言 AI 模型,做微调,做推理。”

例如,设计师可以在没有网络连接的机场使用 Autodesk Revit 三维建模软件中的 AI 功能,这得益于 Perplexity 的 Portable Computer 方案。

随后设计师可以连接云端的各类前沿模型来推进项目。Perplexity 接入了大约 19 个前沿模型,以寻找合适的匹配。

模型上下文协议(MCP)服务器在用户授权下,将 AI 模型与 PC 上的应用连接起来。PC 上的 AI 可以让敏感数据保留在企业边界之内。

惠普已就 Revit 与 Perplexity 展开合作,但 Allen 表示:“你会看到这些 MCP 连接器真正开始增长,并接入更多软件应用。”

惠普这款笔记本预计 10 月上市,它将 CPU、内存和 AMD 的 GPU 紧密封装在一颗芯片上,数据在组件之间传输更快。这对 AI 很重要,也不同于内存可升级的传统 PC 设计。

惠普尚未公布这款移动工作站的定价,但 Gold 表示其价格将远高于常规 AI PC,例如微软近期升级的 Surface Laptop 13 英寸和 Surface Pro 12 英寸机型,它们搭载高通骁龙 X2 Plus 芯片,起售价分别为 1199 美元和 1149 美元。

惠普提供了一款“ROI 计算器”,让感兴趣的消费者自行对比本地运行 AI 与云端运行的成本。Allen 说:“你可以说,‘嘿,按照这种使用方式,这台 PC 九个月就能回本。’”

分析师 Gold 表示,像惠普这样的 ROI 计算器“内置了许多假设,未必适用于每个工作场所”,“但对公司进行较高层面的方案评估来说,这类计算器仍有价值”。他说,在某些情况下,对于复杂工作负载以及更快把产品推向市场而言,持续承担高昂的云端 Token 成本可能是值得的。

在超越 Opus 4.6 的模型在编程方面表现出色、震动整个 AI 圈之后,英伟达收到了大量客户对移动工作站的请求。英伟达的 Delgado 表示:“现在这就是开发团队、编程团队快速转向本地硬件的典型代表。”

Delgado 表示,AI PC 上的智能体正在驱动 AutoCAD 等工程应用。“其目的并不是取代建筑师,”他补充道。

Delgado 表示,企业将采用混合方式推进 AI,工作负载会分布在 PC、边缘和云端。“任何告诉你一切都将本地化的人,只是在回避一个事实:云端模型正以指数级速度进步。”

大多数工作并不需要云端级别的智能,很多都可以在本地完成。英伟达提供的工具可以将推理任务重定向到网络中闲置的 PC,比如配备英伟达 GPU 的 Mac 和 Windows PC,从而让数据留在内部,必要时也能重定向到云端。

Delgado 表示:“智能体的下一个大事件是推理路由器,它在本地硬件足够好时就指向本地,需要更大模型时就指向云端硬件。”

Gartner 高级总监分析师 Deepak Seth 表示,规格炫目的新硬件固然不错,但如果 AI 工程师不够聪明,也发挥不出多少价值。“你可以给他们最好的工具,他们照样会搞出愚蠢的东西。”

Seth 表示,解决所有问题的办法不是拥有更多算力,而是“更多算力加上对的人,才会带来更好的结果”。

Q&A

Q1:ZBook Ultra G3a 是什么?它能做什么?

A:ZBook Ultra G3a 是惠普新发布的 AI 移动工作站,采用 AMD Ryzen AI Max Pro 处理器。它无需联网就能运行具备数十亿参数的 AI 模型,执行智能体和聊天机器人、生成视频、编写代码,面向微调、推理等高端企业负载。

Q2:智能体 AI PC 为什么能削减 Token 成本?

A:因为这类 PC 把 AI 工作放在本地完成,而不是发送到云端昂贵的大语言模型处理。云端 AI 成本高昂,很多工作并不需要云端级别的智能,本地处理可以减少持续的云成本支出。

Q3:智能体 AI PC 会完全取代云端 AI 吗?

A:不会。英伟达的 Delgado 表示,企业将采用混合方式,工作负载分布在 PC、边缘和云端。云端模型正以指数级速度进步,推理路由器会在本地够用时用本地,需要更大模型时指向云端。

Computerworld