关键要点
- 统一内存是决定性约束。 在 Apple Silicon 上,模型与系统共用一个内存池——装不进统一内存的模型根本无法运行。先选统一内存匹配目标模型的 Mac,再针对带宽和外形优化。
- 内存购买后无法升级。 Apple Silicon 的统一内存是焊死的。你买到的就是永久配置——按两年后想跑的模型来确定容量,而不是只看当下。
- 经济款之选:Mac mini M6 32 GB(约 $899) ——Apple 2026 年 8 月 25 日更新中的入门芯片,170 GB/s 带宽,32 GB 内存上限仅覆盖 7B-14B 模型;不足以运行 30B 或 70B。
- 性价比 / 服务器之选:Mac mini M5 Pro 64 GB(约 $1,699) ——静音,满载 25-55 W,每年电费约 $26-39,64 GB 可跑 34B 模型并较紧张地装下 70B Q4。
- 便携之选:MacBook Pro 16" M5 Pro 64 GB(约 $3,499)或 M5 Max 128 GB(约 $4,499) ——307-614 GB/s 带宽,运行 70B 从 Q4 到 Q5。为了便携而接受持续负载下 10-15% 的热降频。
- 桌面 70B 之选:Mac Studio M5 Max 128 GB(起售价约 $2,499) ——460-614 GB/s 带宽可以 Q5 运行 70B。2026 年 9 月 22 日发货;尚无独立基准测试。
- 极限之选:Mac Studio M5 Ultra(起售价约 $5,499,最高 512 GB) ——1.2 TB/s 带宽,基础配置于 2026 年 9 月 22 日发货;512 GB 配置于 2026 年 10 月下旬跟进,预计定价大幅高于 $10,000。
- 决定速度的是带宽,不是芯片名称。 460-614 GB/s 的 M5 Max 在同一模型上生成的每秒 token 数约为 307 GB/s 的 M5 Pro 的两倍(这是 Apple 自己对新款 Mac mini M6/M5 Pro 及 Mac Studio M5 Max/M5 Ultra 的宣称数据;目前尚无独立实测)。
- Apple Silicon 用原始速度换取容量与安静。 桌面 RTX GPU 在 7B-13B 模型上更快,但其 24-32 GB 显存装不下 128 GB Mac 能从容运行的 70B 模型,更不用说 Mac Studio M5 Ultra 能达到的 512 GB。
- 整条产品线的功耗都很低。 Mac mini 在 LLM 负载下功耗 25-55 W,M5 Max 为 60-100 W——而做同等工作的桌面 RTX 显卡需要 300-450 W。
速览
- 经济级(约 $899): Mac mini M6 32 GB——170 GB/s 带宽,仅覆盖 7B-14B 模型。
- 服务器级(约 $1,699): Mac mini M5 Pro 64 GB——静音、常开,最高可跑 34B 及较紧张的 70B Q4。
- 便携级(约 $3,499-4,499): MacBook Pro 16" M5 Pro 64 GB/M5 Max 128 GB——可在移动中跑 70B 模型。
- 桌面级(起售价约 $2,499): Mac Studio M5 Max 128 GB——可以 Q5 跑 70B。
- 极限级(起售价约 $5,499): Mac Studio M5 Ultra,基础 96 GB 到最高 512 GB——运行最大的本地模型。
- Q4_K_M 下的统一内存经验法则: 每十亿参数约 0.6 GB,再加上 2-4 GB 用于上下文和工具链。
- 内存带宽: Mac mini M6 170 GB/s,M5 Pro 307 GB/s,M5 Max 460-614 GB/s,M5 Ultra 1.2 TB/s。
- 功耗范围: Mac mini M5 Pro 25-55 W,MacBook Pro M5 Max 60-100 W(LLM 负载下)。
- 供货情况: 2026 年 8 月 25 日的 Mac mini 和 Mac Studio 更新将于 2026 年 9 月 22 日发货,M5 Ultra 512 GB 配置除外,其于 2026 年 10 月下旬发货——购买前请确认当前 Apple Store 的价格。
赞助内容
编辑推荐:Mac mini M5 Pro 64 GB
对于大多数专门为本地 AI 挑选 Mac 的购买者来说,配备 64 GB 统一内存的 Mac mini M5 Pro 是在能力、价格和运行成本之间取得平衡的选择。 它的 64 GB 能装下最高 34B 的所有模型并留有上下文余量,也能较紧张地装下 70B Q4,运行静音,推理负载下功耗仅 25-55 W,约 $1,699 的价格是 2026 年 8 月 25 日 Apple 更新中能力最强的 Mac mini 配置。它也是理想的家用或办公常开 AI 服务器。只有当 7B-14B 模型确实能满足你的使用场景时,才降级选择 Mac mini M6 32 GB(约 $899)——它的 32 GB 上限无法支持 30B 或 70B 模型。只有当你需要便携性时,才升级到 MacBook Pro 16";只有当你需要在桌面以更高质量跑 70B 时,才升级到 Mac Studio M5 Max 128 GB;如果你需要运行最大的本地模型,则升级到 Mac Studio M5 Ultra。新的 Mac mini 配置将于 2026 年 9 月 22 日发货。
📌注: 此编辑推荐仅反映价格与能力之比。PromptQuorum 未加入任何联盟营销计划,下方链接不含任何联盟标签——它们只是普通参考链接,不赚取任何佣金。
2026 年多款 Mac 在本地 AI 上的对比
内存和带宽数字为 Apple 官方规格。MacBook Pro 的推理速度是 PromptQuorum 进行 Apple Silicon 测试得到的 8B 和 70B Q4 实测值。Apple 于 2026 年 8 月 25 日更新了 Mac mini 和 Mac Studio,于 2026 年 9 月 22 日发货(Mac Studio M5 Ultra 512 GB 配置于 2026 年 10 月下旬跟进)——M6、Mac mini 上的 M5 Pro、Mac Studio 上的 M5 Max 和 M5 Ultra 尚无独立的每秒 token 数基准测试,因此这些行按此标注,而非估算。价格为 2026 年 8 月的美国快照;购买前请确认当前 Apple Store 的价格。
📍 简单一句话
对于运行本地 LLM 的 Mac,统一内存决定你能加载哪些模型,内存带宽决定它们回答多快——先按前者买,再优化后者。
💬 简单来说
把统一内存想象成一张模型、应用和系统共用的桌子。带宽更高的芯片清理桌子更快,但如果模型根本放不上桌子,速度就毫无意义。先选桌子足够大的 Mac。
Mac | 统一内存 | 带宽 | 速度(8B Q4) | 速度(70B Q4) | 价格 | 最适合 |
|---|---|---|---|---|---|---|
| Mac mini M6 32 GB | 32 GB | 170 GB/s | 尚未测试 | 装不下(最高 32 GB) | 约 $899 | 经济入门,仅限 7B-14B 模型 |
| Mac mini M5 Pro 64 GB | 64 GB | 307 GB/s | 尚未测试 | 尚未测试(较紧张) | 约 $1,699 | 静音常开服务器,34B 模型 |
| MacBook Pro 16" M5 Pro 64 GB | 64 GB | 307 GB/s | 约 50-60 tok/s | 约 6-9 tok/s | 约 $3,499 | 便携 34B-70B Q4(较紧张) |
| MacBook Pro 16" M5 Max 128 GB | 128 GB | 614 GB/s | 约 110-120 tok/s | 12-16 tok/s | 约 $4,499 | 便携 70B Q5,多模型 |
| Mac Studio M5 Max 128 GB | 128 GB | 460-614 GB/s | 尚未测试 | 尚未测试 | 起售价约 $2,499 | 桌面 70B,9 月 22 日发货 |
| Mac Studio M5 Ultra | 96 GB(基础)- 512 GB | 1.2 TB/s | 尚未测试 | 尚未测试 | 起售价约 $5,499 | 极限工作站,512 GB 10月发货 |

你应该买哪台 Mac?
你最大的目标模型和外形决定选哪台 Mac;你的预算决定其中的内存档位。 找到与你情况匹配的那一行。
你的情况 | 买这台 |
|---|---|
| 我想要最便宜又够用的 Mac,仅限 7B-14B 模型 | Mac mini M6 32 GB |
| 我想要一台用于家庭或办公的静音常开 AI 服务器 | Mac mini M5 Pro 64 GB |
| 我在桌面上跑 34B 模型,看重低运行成本 | Mac mini M5 Pro 64 GB |
| 我需要 70B Q4 并随机器移动 | MacBook Pro 16" M5 Pro 64 GB |
| 我想要 Q5 质量的 70B 并同时运行多个模型 | MacBook Pro 16" M5 Max 128 GB |
| 我想要新产品线中的 70B 桌面机 | Mac Studio M5 Max 128 GB |
| 我需要尽可能大的本地模型(100B+,MoE) | Mac Studio M5 Ultra,最高 512 GB |
| 我想在 9 月 22 日发货前买到 70B 桌面机 | 上一代 Mac Studio M4 Max,通常有折扣 |
| 我拿不定主意,想要最稳妥的第一台本地 AI Mac | Mac mini M5 Pro 64 GB——不够用时再升级 |
Mac mini M6 对比 M5 Pro:静音常开服务器
Apple 在 2026 年 8 月 25 日用两款芯片更新了 Mac mini:M6(经济款)和 M5 Pro(认真使用本地 AI 的推荐之选)。 两者均于 2026 年 9 月 22 日发货。M5 Pro 是用作常开本地 AI 服务器的最佳 Mac——静音、低功耗,最高可跑 34B 模型,并能较紧张地运行 70B Q4。M6 能力不错,但受限于 32 GB,排除了 30B 和 70B 模型。
- Mac mini M6(约 $899,最高 32 GB): 12 核 CPU、12 核 GPU、双 16 核神经网络引擎,170 GB/s 带宽。Apple 表示相较停产的 M4,CPU 性能提升约 40%,AI 性能最高提升 4 倍(这是 Apple 自己的宣称,未经独立测试)。可以从容处理 7B-14B 模型;32 GB 是硬性上限,排除了 30B 和 70B 模型。
- Mac mini M5 Pro(约 $1,699,最高 64 GB): 推荐之选。最高 18 核 CPU、20 核 GPU,307 GB/s 带宽,Thunderbolt 5。留有余量地装下 34B 模型,并较紧张地以 Q4 装下 70B。内存足以同时运行一个 LLM、Whisper 语音转文字和一条 RAG 流水线。
- 为什么买这台 Mac: M5 Pro 是进入认真的 Apple Silicon AI 的最低成本选择、静音运行、25-55 W 功耗(每年电费约 $26-39),体积小巧可作为服务器塞进柜子。如果 7B-14B 确实能满足你的使用场景,M6 在价格上更胜一筹。
- 为什么跳过这台 Mac: M6 的 32 GB 上限装不下 30B 或 70B 模型,且两款 Mac mini 都不便携。如果目标是有真实余量的 70B,请改选 MacBook Pro 或 Mac Studio M5 Max。
💡提示: 如果 34B 或 70B 模型在你的计划之内,请买 64 GB 的 M5 Pro,而不是 32 GB 的 M6。多出的内存是「止步于 14B 模型」与「从容运行 34B 模型」的区别——而且 Apple Silicon 的内存以后无法添加。
📌注: Mac mini M5 Pro 是出色的无头 AI 服务器:安装 Ollama,把 API 暴露在局域网上,家里的每台设备都能使用它。让它 7×24 小时运行一整年的成本,比一个月的云端对话订阅还低。
⚠️警告: 两款新的 Mac mini 配置均于 2026 年 9 月 22 日发货——以上预售数字为 Apple 公布的价格,尚未在 Mac mini 机身中经过独立验证。停产的 Mac mini M4(起售价 $599)和 Mac mini M4 Pro(最高 $2,299,最高 64 GB)是上一代产品,在库存售罄前可能会有折扣。
MacBook Pro 16" M5 Pro 对比 M5 Max:便携 70B 工作站
MacBook Pro 16"(M5 Pro 或 M5 Max,2026 年 3 月发布,不受 Apple 8 月 25 日 Mac mini/Mac Studio 更新影响)适合需要 70B 级模型、以便携外形使用的购买者。 M5 Max 是唯一能从容超越 70B 的便携芯片;M5 Pro 能较紧张地以 Q4 装下 70B。相比同芯片桌面机的代价是持续推理下 10-15% 的热降频。
- MacBook Pro 16" M5 Pro 64 GB(约 $3,499): 最高 18 核 CPU、20 核 GPU,307 GB/s 带宽——64 GB 是这颗芯片的内存上限。以约 50-60 tok/s 跑 8B 模型,以约 6-9 tok/s(较紧张)跑 Llama 3.3 70B Q4。这是进入本地 70B AI 的便携入口。
- MacBook Pro 16" M5 Max 128 GB(约 $4,499): 最高 40 核 GPU,614 GB/s 带宽。以约 110-120 tok/s 跑 8B 模型,以 Q5(更高质量)12-16 tok/s 跑 70B,并支持同时运行两个模型——例如一个 70B 模型加一个 13B 模型。
- 为什么买这台 Mac: 你需要 70B 模型且要便携,你想要一台机器同时用于创意工作和 AI,或者你经常演示和出差,无法把桌面机留在原地。
- 为什么跳过这台 Mac: 如果机器从不离开桌面,同样内存的 Mac Studio 更便宜也更凉快;如果 34B 模型就够用,Mac mini M5 Pro 能省下 $1,800 以上。
⚠️警告: MacBook Pro 16" M5 Pro/M5 Max 在机身发热后,持续推理时会降频约 10-15%——通常在连续负载几小时后。对于 7×24 小时推理,Mac Studio 是更合适的工具;对于便携式的 70B 工作短时爆发,MacBook Pro 没问题。
📌注: M5 Pro(64 GB,307 GB/s)和 M5 Max(128 GB,614 GB/s)是不同的芯片,而不仅仅是同一芯片的不同内存配置——M5 Max 买到的是约两倍的带宽和两倍的内存上限,而不只是容量。
Mac Studio M5 Max 对比 M5 Ultra:桌面与极限选择
Apple 在 2026 年 8 月 25 日用 M5 Max(70B 桌面之选)和 M5 Ultra(极限之选,最高 512 GB)更新了 Mac Studio——基础配置于 2026 年 9 月 22 日发货,M5 Ultra 512 GB 配置于 2026 年 10 月下旬跟进。 128 GB 的 Mac Studio M5 Max 能以 Q5 质量跑 70B,并在持续负载下比 MacBook Pro 更安静,因为桌面机身没有笔记本的散热上限。M5 Ultra 是为那些需要超过 128 GB 容量的模型的用户而存在的。
- Mac Studio M5 Max(起售价约 $2,499,最高 128 GB): 460-614 GB/s 带宽,取决于 GPU 核心数。70B 模型的桌面之选。尚未经过独立测试——截至本文撰写时尚未发货。
- Mac Studio M5 Ultra(起售价约 $5,499,基础 96 GB,最高 256 或 512 GB): 36 核 CPU / 80 核 GPU 配置支持最高 512 GB 统一内存,带宽约 1.2 TB/s。512 GB 配置于 2026 年 10 月下旬发货,预计定价大幅高于 $10,000。这一档位是为运行最大的本地模型——远超单个 70B 模型——而设,不是主流购买选项。
- 为什么买 Mac Studio: 你想要现行产品线中的 70B 桌面机,你想要比 MacBook Pro 更安静的持续运行,或者(特别是 M5 Ultra)你需要运行超过 128 GB 容量的模型。
- 为什么跳过 Mac Studio: 如果你需要便携性,请买 MacBook Pro;如果 34B 模型就够用,Mac mini M5 Pro 便宜得多;如果你需要在 2026 年 9 月 22 日之前买到 70B 桌面机,请考虑上一代 Mac Studio M4 Max,随着新产品线发货,它很可能会有折扣。
⚠️警告: 截至本文撰写时,两款 Mac Studio 配置均未发货——基础配置于 2026 年 9 月 22 日到货,M5 Ultra 512 GB 配置于 2026 年 10 月下旬到货。以上价格和规格是 Apple 自己公布的数字;目前尚无独立基准测试。如果你需要立即购买桌面 Mac,上一代 Mac Studio(M4 Max、M3 Ultra)现已在售,且已验证可运行 70B 模型。
你需要多少统一内存?
在 Q4_K_M 量化下,一个模型每十亿参数大约需要 0.6 GB 统一内存,再加上 2-4 GB 用于上下文和工具链——而在 Mac 上,这块内存还要与 macOS 本身共用。 给操作系统留出余量:一台 16 GB 的 Mac 并不等于 16 GB 的模型预算。
- 8B 模型——8-9 GB: 适用于任何 16 GB 或以上的 Mac,包括 Mac mini M6。32 GB 的 Mac 留有宽裕余量。
- 13-14B 模型——11-13 GB: 计入 macOS 和上下文开销后需要 32 GB。Mac mini M6(32 GB)及以上。
- 34B 模型——21-25 GB: 实际需要 64 GB。Mac mini M5 Pro 64 GB 在这一档是性价比之选——M6 的 32 GB 上限装不下 34B 模型。
- Q4 的 70B 模型——39-42 GB: 至少需要 64 GB,而加上上下文后 64 GB 会很紧。Mac mini M5 Pro 64 GB 或 MacBook Pro 16" M5 Pro 64 GB 是底线。
- Q5 的 70B 模型或并行模型——50-70 GB+: 需要 128 GB。MacBook Pro 16" M5 Max 128 GB 或一台 Mac Studio M5 Max 128 GB。
- 超过单个 70B 的模型,或非常大的 MoE 模型——100 GB+: 需要 Mac Studio M5 Ultra,最高可达 512 GB 统一内存(512 GB 配置于 2026 年 10 月下旬发货)。

💡提示: Apple Silicon 的内存是焊死的,无法升级。买比当前需求高一档:如果你今天跑 34B 模型,64 GB 是底线,而不是从容的选择。完整方法请参见延伸阅读中的统一内存指南。
决策流程图:四个问题选出你的 Mac
按顺序回答四个问题,大多数购买者都会被引导到一台 Mac。
📍 简单一句话
为本地 AI 选 Mac,先回答最大模型规模,其次便携性,再次常开服务器用途,最后回答供货情况。
💬 简单来说
从你真正想运行的最大模型开始,让它决定所需内存。然后判断它是否需要随身携带、是否全天候运行、你能否等 M5 版 Mac Studio。按这个顺序来,正是人们避免买到装不下自己模型的 Mac 的方法。
- 1. 你想运行的最大模型是什么? 7-14B:Mac mini M6 32 GB。34B:Mac mini M5 Pro 64 GB。70B Q4:Mac mini M5 Pro 64 GB 或 MacBook Pro M5 Pro。70B Q5 或并行:MacBook Pro M5 Max 128 GB 或 Mac Studio M5 Max。100B+ 或超大 MoE:Mac Studio M5 Ultra,最高 512 GB。
- 2. 机器需要移动吗? 需要:MacBook Pro 16" M5 Pro 或 M5 Max。不需要:Mac mini(最高 34B/70B Q4)或 Mac Studio(70B 及以上)。
- 3. 它是常开服务器吗? 是:Mac mini M5 Pro 64 GB——静音、25-55 W、7×24 小时运行最便宜。否:按上面的模型规模选择。
- 4. 你需要在 2026 年 9 月 22 日之前拿到这台机器吗? 新的 Mac mini 和 Mac Studio 配置将于当天发货(M5 Ultra 512 GB 于 2026 年 10 月下旬发货)。如果你今天就需要桌面机,请买上一代 Mac Studio M4 Max(随着新产品线发货很可能会有折扣),或者等待。
购买渠道
Apple 直接销售每一种配置;Amazon 和其他零售商备有常见配置,有时低于 Apple 标价。 下方链接是普通的产品搜索链接;它们不含联盟标签,也不赚取佣金。
- Apple Store(apple.com): 唯一能买到每一种内存和存储配置的渠道,包括定制订购。如果你想要非标准配置,必须走这里。
- Amazon: 备有 Mac mini 和 MacBook Pro 的热门固定配置,有时折价低于 Apple 标价。大内存定制订购配置的选择有限。
- Apple 翻新机: 上一代 Mac(M4 Max Mac Studio、Mac mini M4 Pro、更早的 MacBook Pro)以折扣价出售并提供完整保修——在新产品线上市前想要 70B 桌面机的明智选择。
- 授权经销商和专业零售商: 备有常见配置,偶尔比 Apple 价格更低;对 MacBook Pro 16" 很有用。
⚠️警告: Apple 于 2026 年 8 月 25 日宣布了 Mac mini 和 Mac Studio 的更新;基础配置于 2026 年 9 月 22 日发货,Mac Studio M5 Ultra 512 GB 配置于 2026 年 10 月下旬跟进。这里的美元数字是 2026 年 8 月的快照——购买前请打开当前的 Apple Store 页面,并查看你需要的内存升级是否有变动。
购买本地 AI Mac 时的常见错误
- 按芯片名称而不是统一内存来买。 一颗更快但内存太少的 M5 Max 装不下你的模型。先确认模型能装进统一内存并留有 2-4 GB 余量,再比较带宽。
- 以为 Mac mini M6 的 32 GB 上限能覆盖 30B 或 70B 模型。 并非如此。32 GB 在约 14B 模型处是硬性上限——M5 Pro(64 GB)才是 34B 及以上的底线。
- 忘记 Apple Silicon 的内存无法升级。 内存是焊死的。买少了,唯一的补救就是换一台新 Mac——按比今天需求高一档来配置。
- 以为新的 Mac mini 和 Mac Studio 配置可以立即购买。 Apple 于 2026 年 8 月 25 日宣布,基础配置于 2026 年 9 月 22 日发货,Mac Studio M5 Ultra 512 GB 配置于 2026 年 10 月下旬跟进。如果你更早就需要硬件,请买上一代型号或等待。
- 为固定在桌面的 7×24 小时服务器买 MacBook Pro。 它在持续负载下会降频。对于常开服务器,Mac mini M5 Pro 或 Mac Studio 更凉快也更安静。
- 为 8B 模型买过头。 如果 8B 模型覆盖你的使用场景,128 GB 的 Mac 是浪费钱。把内存档位匹配模型,而不是匹配你恰好有的预算。
- 把 Apple 「AI 性能最高提升 4 倍」的宣称当作实测基准。 这是 Apple 自己针对停产 M4 与 M6 的对比数字,并非独立测量——在第三方基准测试出现之前,请把它当作方向性参考。
来源
- Apple Mac mini 技术规格 — Mac mini M6 和 M5 Pro 系列的统一内存、芯片和功耗官方数据。
- Apple MacBook Pro 技术规格 — M5 Pro 和 M5 Max 的统一内存、GPU 核心数和内存带宽官方数据。
- Apple Mac Studio — Mac Studio 产品线和配置选项(2026 年 8 月 25 日发布的 M5 Max 和 M5 Ultra)。
- M5 Pro vs M5 Max LLM 基准测试 2026 — PromptQuorum 硬件测试:M5 Pro 和 M5 Max 上 8B 与 70B 模型的实测每秒 token 数。
- 作为本地 AI 服务器的 Mac mini M5 — PromptQuorum 测试:Mac mini M5 Pro 的功耗、电费和常开服务器性能。
常见问题
能很好运行本地 LLM 的最便宜 Mac 是哪台?
对于认真使用而言,约 $1,699 的 Mac mini M5 Pro 64 GB 是能很好运行本地 LLM 的最便宜 Mac。它的 64 GB 统一内存在 Q4 量化下能装下最高 34B 的所有模型,并较紧张地装下 70B Q4,功耗仅 25-55 W。对于更轻度的使用,Mac mini M6 32 GB(约 $899)更便宜,覆盖 7B-14B 模型,但其 32 GB 上限装不下 30B 或 70B 模型——这是较低价格的代价。两者都是 2026 年 8 月 25 日 Apple 更新的一部分,于 2026 年 9 月 22 日发货。
Mac Studio M5 已经上市了吗?
还没有完全上市,但已经发布。Apple 于 2026 年 8 月 25 日推出了 Mac Studio M5 Max 和 M5 Ultra。基础配置将于 2026 年 9 月 22 日发货;M5 Ultra 的 512 GB 配置于 2026 年 10 月下旬跟进,预计定价大幅高于 $10,000。如果你在此之前需要一台 70B 桌面 Mac,上一代 Mac Studio(M4 Max)仍然在售,随着零售商清理库存,往往会有折扣。
在 Mac 上跑本地 LLM 需要多少统一内存?
在 Q4_K_M 量化下,按每十亿参数约 0.6 GB 加上 2-4 GB 开销来规划,并记住 macOS 共用同一个内存池。这意味着 8B 模型约需 8-9 GB,34B 需 21-25 GB,70B 需 39-42 GB。一台 64 GB 的 Mac(Mac mini M5 Pro 或 MacBook Pro M5 Pro)能从容运行 34B 并勉强装下 70B Q4;128 GB(MacBook Pro M5 Max 或 Mac Studio M5 Max)用于以 Q5 跑 70B 或同时跑多个模型;Mac Studio M5 Ultra 最高可达 512 GB,用于超过单个 70B 的模型。
本地 AI 选 Mac mini 还是 MacBook Pro?
如果机器固定在桌面上、34B 模型是你的上限,就选 Mac mini M5 Pro——它便宜得多、静音,作为常开服务器很理想。如果你需要运行 70B 模型或随身携带机器,就选 MacBook Pro 16"(M5 Pro 或 M5 Max)。MacBook Pro M5 Max 是运行 70B 能力最强的便携芯片,但它在持续负载下会降频——因此固定不动的服务器仍然更适合用 Mac mini 或 Mac Studio。
Mac 能跑 70B 模型吗?
能。64 GB 的 MacBook Pro 16" M5 Pro 以每秒约 6-9 token 跑 Llama 3.3 70B Q4(余量较紧张),128 GB 的 M5 Max 版本以每秒 12-16 token 跑 70B Q5。128 GB 的 Mac Studio M5 Max 经过独立测试后应该也能从容跑 70B。Mac mini M6 不行——它的 32 GB 上限太小;64 GB 的 Mac mini M5 Pro 能较紧张地装下 70B Q4。
本地 LLM 上 Mac 比 NVIDIA GPU 快吗?
不,在小模型的原始速度上并不快——桌面 RTX 显卡在 7B-13B 模型上每秒生成更多 token。Mac 的优势在于容量和能效:一台 128 GB 的 Mac 能装下 24-32 GB RTX 显卡装不下的 70B 模型,Mac Studio M5 Ultra 最高可达 512 GB,而且都以 60-100 W 安静地完成,RTX 则需要 300-450 W。买 Mac 是为了容量、安静和低运行成本,而不是为了原始速度。
我以后能升级 Mac 的内存吗?
不能。Apple Silicon 的统一内存焊接在芯片封装上,购买后无法更改。你买到的内存就是机器整个生命周期的永久配置。按你预计未来两到三年要运行的最大模型来配置容量,而不是只看今天。
把 Mac 当 AI 服务器运行要花多少钱?
很少。Mac mini M5 Pro 在 LLM 负载下功耗 25-55 W,空闲时约 8 W。让它 7×24 小时运行整整一年,按美国电价约花 $26-39——比一个月典型的云端 AI 订阅还便宜。这种低运行成本正是 Mac mini 成为常开服务器性价比之选的核心原因。
