统一内存(Unified Memory)

模型与量化

苹果 M 系列芯片的 CPU 与 GPU 共享同一块内存,无需在系统内存和显存之间拷贝权重,是大内存 Mac 能跑大模型的结构性原因。

#默认只能用到约 70%

macOS 默认限制 GPU 可"有线锁定"的内存比例(约 65%-75%),其余留给系统。所以 16GB 的 M 系 Mac,模型实际可用约 11GB——跑 Q4 的 14B 模型(约 9GB)可行,32B 就不行了。高级用户可通过 sysctl 调整 iogpu.wired_limit,但一般不建议。

#和独显方案的对比

  • 优势:容量天花板高(M3 Max 可到 128GB),省电,无数据拷贝开销
  • 劣势:算力峰值低于同期顶级独显,训练场景明显吃力
  • 选购参考:优先大内存档位,带宽随 Max/Ultra 档位翻倍

本页目录

  • #默认只能用到约 70%
  • #和独显方案的对比

更新于 2026-10-02

#关于「统一内存(Unified Memory)」的常见问题

苹果 M 系列芯片的 CPU 与 GPU 共享同一块内存,无需在系统内存和显存之间拷贝权重,是大内存 Mac 能跑大模型的结构性原因。

本词条属于模型与量化分类,与 、 等概念紧密相关。如果你刚开始接触本地大模型部署,建议按「基础概念 → 模型与量化 → 推理与部署」的顺序阅读相关词条,配合 GPU 检测工具 边学边验证自己硬件的可行方案。

相关工具推荐

暂无相关工具推荐

您可以浏览更多分类发现其他实用工具