一台 64GB 内存的顶配 MacBook Pro,究竟能把 M5 Pro 的性能发挥到什么程度?

YouTube上的Akponential拿到了一台 14 英寸 MacBook Pro,配置包括 18 核 CPU、20 核 GPU、64GB 统一内存和 4TB SSD。为了寻找答案,他依次测试了 SSD、CPU、GPU、图片处理、视频导出和本地大模型,还加入了内存占用与持续高负载测试。

结果呈现出明显反差:基准测试中的差距十分醒目,到了真实软件中,提升幅度却随着任务类型发生变化。部分轻量工作流几乎看不到区别,8K 视频、3D 渲染和本地模型等高负载任务,才更容易触及这台机器的性能上限。

基准成绩很强,持续满载仍会降频

他首先测试了 4TB SSD。给出的结果显示,顺序写入速度约为 7GB/s,读取速度约为 8.5GB/s,在他测试过的 MacBook 中属于较高水平。

顶配M5 Pro跑AI!64GB能装下多少,速度又有多快?

CPU 环节采用了渲染类测试。M5 Pro 与普通 M5 的单核成绩接近,多核成绩则明显拉开。作者将其归因于核心数量差异:前者配备 18 核 CPU,后者为 10 核。

顶配M5 Pro跑AI!64GB能装下多少,速度又有多快?

GPU 测试中,20 核 GPU 的 M5 Pro 同样明显领先 10 核 GPU 的普通 M5。在 Blender 渲染项目里,GPU 渲染成绩差距甚至超过了两款芯片的核心数量差距。

顶配M5 Pro跑AI!64GB能装下多少,速度又有多快?

他还通过图形压力测试观察持续性能。机器升温后,成绩大约维持在初始状态的 93%。作者据此认为,MacBook Pro 的主动散热能够控制降频幅度,但仍不足以让 M5 Pro 长时间保持峰值性能。

模型能跑多大,首先取决于内存

他在三台 MacBook Pro 上运行本地大模型,分别是 64GB 内存的 M5 Pro、16GB 内存的 M5,以及 32GB 内存的 M4。测试重点包括模型能否加载、生成速度,以及持续推理时的硬件负载。

Apple Silicon 采用统一内存架构,CPU 和 GPU 可以共享同一块内存。运行本地模型时,内存既要容纳模型权重,也要为系统、上下文缓存和推理过程保留空间。因此,模型文件能够成功加载,并不代表机器已经具备流畅运行它的条件。

在 16GB 的 M5 上,体积达到 19GB 和 22GB 的模型无法运行。一个约 14GB 的模型虽然能够加载,但系统只剩下约 2GB 可用空间,生成速度约为 7.9 Token/s。32GB 的 M4 加载相同体积的模型后,仍有较充足的空间参与计算,实际表现反而可能超过 16GB 的 M5。

顶配M5 Pro跑AI!64GB能装下多少,速度又有多快?

这组对比同时涉及芯片、内存和软件环境,无法单独计算内存带来的性能增幅,但可以确认一件事:当模型体积逼近物理内存上限,运行速度和系统响应都会明显受到影响。对于准备长期运行本地模型的用户,32GB 提供了更合理的选择范围,64GB 则可以容纳更大的模型,并为上下文和其他应用留下空间。

软件适配同样影响速度。一款约 36B 参数的 Gemma 系模型,在常规运行方式下约为 13 Token/s,换用面向 Apple Silicon 优化的 MLX 版本后,速度提高到约 26 Token/s。MLX 可以更充分地调用统一内存和 Metal GPU,因此,同一类模型仅更换格式和运行后端,性能就可能出现较大变化。

他还测试了 Qwen 3.6,部分千问模型在 M5 Pro 上达到约 70—80 Token/s,文本输出已经较为流畅,一些模型在 32GB 的 M4 上也能达到可用水平。由于具体模型版本、参数规模、量化格式和上下文长度没有统一,这些数字不能直接横向比较。它们说明,本地 AI 的体验不仅取决于硬件,也与模型架构和推理框架密切相关。参数适中、适配充分的模型,往往更适合写作、总结、资料提取和轻量编程等高频任务。

顶配M5 Pro跑AI!64GB能装下多少,速度又有多快?

运行模型时,GPU 使用率会迅速接近 100%,较大的模型还会长时间保持满载。小模型完成响应较快,热量积累有限;复杂问题和长文本生成会持续推高机身温度。因此,他更推荐带主动散热的 MacBook Pro 或 Mac mini,不建议用无风扇 MacBook Air 长时间承担本地推理任务。

当 AI 开始常驻电脑,衡量硬件的方式也随之改变。视频导出快几分钟,只发生在项目完成的某个环节;本地模型则可能持续参与写作、编程、资料整理和 Agent 工作流。芯片决定生成速度,内存限制模型规模,软件后端影响硬件利用效率,散热关系到长时间运行的稳定性。对于希望将更多 AI 任务留在本机的用户,这些因素共同构成了高配 Mac 更具现实意义的使用场景。

任务越重差距越明显

在 Lightroom 测试中,他导入了 529 张全画幅相机照片,先将一张照片的调整参数批量复制到其余照片,再将所有图片导出为高分辨率 JPEG。

顶配M5 Pro跑AI!64GB能装下多少,速度又有多快?

批量同步参数时,几台机器的差距有限。到了图片导出环节,M5 Pro 样机完成任务约需 1 分钟,普通 M5 则用了约 3 分 27 秒。

他同时发现,配备 32GB 内存的 M4 在部分 Lightroom 项目中也会超过只有 16GB 内存的 M5。这组比较同时改变了芯片代际、CPU 与 GPU 规模以及内存容量,无法单独计算 64GB 内存贡献了多少性能。

随后,他在 Final Cut Pro 中测试了不同规格的视频。按照测试的结果,4K 30fps 项目中,M5 Pro 与普通 M5 的导出时间较为接近;4K 60fps 项目开始出现差距;处理 8K 项目时,时间差进一步扩大。

顶配M5 Pro跑AI!64GB能装下多少,速度又有多快?

由此,他得出的判断是,工作负载越重,M5 Pro 增加的 GPU 资源越容易得到利用。普通 4K 项目可能无法持续压满芯片,8K 素材、复杂时间线和高负载导出更容易拉开差距。

至顶AI实验室洞见

传统性能测试关注的是渲染快多少、导出省几分钟,本地 AI 关心的则是模型能不能装下、加载后还剩多少运行空间、生成速度能否达到可用水平。统一内存容量、GPU 持续负载能力、散热设计,以及 MLX 等软件后端,共同决定了一台 Mac 能否真正承担本地推理任务。

这也让 MacBook Pro 的购买逻辑多了一条新的坐标。过去选择高配芯片,主要服务于视频、图形和开发工作;随着本地模型逐渐进入写作、编程、资料分析和 Agent 工作流,内存开始直接决定用户能够调用哪一级别的模型。16GB 可以体验小模型,32GB 才拥有更宽的选择范围,64GB 则为更大模型和长期使用留下余量。具体速度仍会受到模型版本、量化格式和运行后端影响,数据无法作为统一标准,但它已经展示出一个明确趋势:AI 正在成为高配 Mac 最有可能被持续压满的新场景。

对于普通用户来说,M5 Pro 的峰值性能可能长期用不上;对于希望把模型留在本地、减少云端调用,并让 AI 深度进入日常工作流的人来说,芯片、内存和散热将共同构成新的生产力门槛。未来衡量一台电脑是否足够强,除了看它能多快完成一次导出,还要看它能否稳定运行一个真正有用的本地模型。

至顶网至顶AI实验室频道 作者:刘文轩