这期把能跑本地大模型的显卡整理成了一份天梯,一共 102 款,按 AI Score 综合分排。想看哪款翻到哪块,全程长图;想查具体型号的各模型速度,文末有在线查询工具。
AI Score 是什么:文本、生图、视频共 12 项模型实测吞吐的几何均值,1~100 分,分越高生成越快。标 √ 的是实测或官方数据,标「估算」的是同架构类推值。注意这说的是跑分/推理吞吐,不是游戏帧率。
前三
| # | 显卡 | AI Score |
|---|---|---|
| 1 | NVIDIA B300 | 93.8 |
| 2 | NVIDIA B200 | 78.0 |
| 3 | NVIDIA B100 | 67.0 |
数据中心卡霸榜并不意外,往下翻才是消费级的主场:4090、3090 这批 24G 卡在性价比段位上依然是本地部署的中坚。
完整天梯(102 款)
怎么用这份天梯
- 挑卡看三段位:数据中心卡(B300/B200/H100)是算力天花板;RTX 4090/3090 是性价比主力;V100/P40 这些老卡适合捡漏
- 分数差距的意义:AI Score 差 1 倍,各模型 tok/s 也大致差 1 倍量级——它就是「跑大模型有多快」的综合体检
- 别只看分数:显存决定能跑多大模型,5090 的 32G 和 A100 的 80G 是两个世界;分数只是速度维度
想按模型查具体速度(Qwen3-32B 跑多少 tok/s、70B 能不能塞下),用 显卡 AI 算力速查工具,102 款卡都收录了,每张卡都能展开看 12 项模型的逐项速度。选卡思路和实测数据则看这篇显卡跑大模型速查。