想在桌面上本地跑几百亿参数的大模型,三台 128G 统一内存的小机器是绕不开的选择:AMD 锐龙 AI Max+ 395、NVIDIA DGX Spark、Apple Mac Studio M5 Max。它们共用同一块 128GB 内存池,能装下 100B 级模型,但价格从 1.9 万到 4.5 万差出一倍多,跑同一个模型的输出速度更是从 13 到 27 tps 拉开档次。这篇把三台的定位、参数、实测速度、价格一次排开,数据全部来自官方口径与第三方评测汇总(2026.9 采集)。
一句话定位:AMD 395 = 性价比之王(Windows 全能);DGX Spark = 纯 AI 研究工具(CUDA 生态);Mac Studio M5 Max = 创意工作站(输出最顺)。
为什么这种小主机能跑大模型:统一内存
关键在统一内存。普通电脑内存归 CPU、显存归显卡,各管各的,跑大模型必须整个塞进显存,塞不下就跑不了;而统一内存是 CPU 和 GPU 共用一块内存池,128GB 全部共享。三台的「128GB」都是这个含义——内存即显存,模型想占多少占多少。
核心参数总表(128GB 版)
| 项目 | AMD AI Max+ 395 | NVIDIA DGX Spark | Mac Studio M5 Max |
|---|---|---|---|
| CPU 架构 | Zen 5 (x86) | Grace Blackwell (ARM) | Apple M5 (ARM) |
| CPU | 16 核 32 线程 | 20 核 (10×X925 + 10×A725) | 18 核 (6 超核 + 12 性能核) |
| GPU | Radeon 8060S (RDNA3.5, 40CU) | Blackwell + 第5代 Tensor Core | 最高 40 核 (每核含神经加速) |
| AI 算力 | 约 126 TOPS | 1000 TOPS FP4 / 500T FP8 | 约 110 TOPS FP16 |
| 内存带宽 | 约 256 GB/s | 约 273 GB/s | 614 GB/s |
| 可分配显存 | 最高 96GB | 统一 (全量) | 统一 (全量) |
| 存储 | 2TB+ 可扩展 | 4TB 板载 NVMe | 1-8TB SSD |
| 满载功耗 | 约 120-140W | 约 240W | 约 200-270W |
| 系统 | Windows / Linux | DGX OS (仅 Linux) | macOS |
| 参考价 (128GB) | 约 1.9-2.3 万 | 约 3.5 万 | 约 4.2-4.5 万 |
同一基准跑 Qwen3.5-27B:差距全在带宽
用同一个 Qwen3.5-27B(IQ4 量化)做统一基准,输出速度(decode)一测见真章。M5 Max 带宽是 AMD 395 的 2.4 倍、DGX Spark 的 2.25 倍,输出速度直接拉开一档:
27 tps 接近正常阅读速度、基本流畅;13-15 tps 能出字但明显「结巴」,长时间读长内容会难受。注意 DGX Spark 有反杀:它 prefill(预填充/理解问题)特别快,提示吞吐能到 1957 tok/s(AMD 395 约 956),差不多是 Mac 的 3 倍——DGX 脑子转得快但说话结巴,Mac 说话最顺。
价格速览(2026.9 京东实拍)
| 产品 | 配置 | 到手价 |
|---|---|---|
| AMD 阿迈奇 MIA PRO+ | 128G+0T | ¥19,402 |
| AMD E人E本 G95 | 128G 无盘 | ¥19,899 |
| AMD TOPCAMD | 128G | ¥19,889 |
| AMD 极摩客 EVO-X2 | 128G+2T | ¥22,874 |
| 华硕 GX10 (DGX OEM) | 128GB+1TB | ¥34,824 |
| NVIDIA DGX Spark (FE) | 128GB+4TB | ¥38,999 |
| Mac Studio M5 Max | 128GB+1TB | ¥41,749 |
| Mac Studio M5 Max | 128GB+2TB | 约 ¥45,499 |
受内存涨价影响,这类机器 2026 年初到 9 月普遍上涨:AMD 128GB 版从 1.3-1.5 万涨到 1.9-2.3 万,DGX Spark 年后官方涨了 17.5%(+700 美元),Apple 则下架了 M3 Ultra 的大内存选项。现在买 AI 主机确实不如年初划算,不急可以再等等。
各自短板(没完美的机器)
- AMD 395:带宽 256 GB/s 输出偏慢(27B 约 15 tps);ROCm 生态不如 CUDA;板载内存不可扩展,64GB 版是「重灾区」。
- DGX Spark:只支持 Linux(DGX OS),跑不了 3A 游戏;带宽 273 GB/s 输出偏慢(27B 约 13 tps);涨价后逼近 4 万性价比受质疑;多机集群配置繁琐。
- Mac Studio M5 Max:贵(比 AMD 395 贵约 1.8 万);不支持 CUDA/vLLM,批处理与微调弱(LoRA 比 DGX 慢约 4 倍,70B 全量微调不可行);MLX 生态不如 CUDA 成熟。
到底怎么选
- 预算有限、想本地跑大模型、兼顾办公/游戏 → AMD AI Max+ 395(128GB 最便宜、Windows 全能,输出慢点能忍)
- 专业 AI 研发、微调、批处理、离不开 CUDA → NVIDIA DGX Spark(算力最强、生态最全、可扩展,但只支持 Linux)
- 创意工作者、追求流畅本地推理、macOS 生态 → Mac Studio M5 Max(带宽最高、输出最顺、全能工作站,就是贵)
- 偶尔玩玩、不是重度生产 → 其实不急着上这几万级的,先看独显整机或等降价更实在
只给一个人用 → M5 Max;团队/多 Agent 并发 → 双 DGX Spark;预算紧张又要 Windows 全能 → AMD 395。
数据说明:本文速度/跑分数据来自 AMD 官方 ROCm 数据、NVIDIA 官方宣传与知乎/什么值得买/IT之家/Notebookcheck/至顶网等第三方评测汇总(2026.9 采集),不同测试环境有差异,仅供参考;价格为 2026-09-01 京东实时到手价,会随市场波动。
