进阶 10 分钟Radeon RX 6000
在 Radeon RX 6800 XT / 6900 XT(16 GB)上应选择哪些 LLM ?
Radeon RX 6800 XT(2020 年 11 月)和 6900 XT(2020 年 12 月)均配备 16 GB GDDR6 显存,带宽为 512 GB/s,采用 RDNA 2 架构。2026 年,这两款显卡的二手价格各不相同,但都是很划算的 AMD 16 GB 显卡。不过请注意:ROCm 对 RDNA 2 的官方支持有限——Vulkan 往往是最佳后端。本指南详细介绍了可选方案及其限制。
您正在挑选电脑吗? 按预算推荐 →
推荐硬件
本指南的备选购买方案: Radeon RX 9070 XT 16 GB.
为什么选择它?我们的完整资料: Radeon RX 9070 XT 16 GB →
移动场景: 本地 AI 选哪款笔记本电脑 →
联盟链接——可能产生佣金,但您无需额外付费。作为亚马逊合作伙伴,QuelLLM 将从符合条件的购买中获利。
#RX 6800 XT / 6900 XT
- RX 6800 XT
- RDNA 2 Navi 21,4608个SP,512 GB/s,TDP 300 W。二手,价格不固定。
- RX 6900 XT
- 完整规格的 Navi 21,5 120 个流处理器,512 GB/s 带宽,TDP 为 300 W。二手价格不固定。
- 共同的显存规格
- 16 GB GDDR6 16 Gbps。
#1. ROCm 在 RDNA 2 上的运行
- 官方支持有限
- AMD 长期将重点放在 RDNA 3 上。ROCm 6.x 支持 RDNA 2,但带有部分内核限制。
- 推荐使用 Vulkan
- llama.cpp Vulkan 在 RDNA 2 上表现优异,性能可达 ROCm 的 90%。部署更为简便。
- DirectML
- 在 Windows 上,DirectML 可以运行,但速度比 Vulkan 慢 30%。
#2. 兼容模型
RX 6800 XT / 6900 XT 16 GB — Vulkan
| 模型 | Quant | Tokens/sec |
|---|---|---|
| Qwen 3.5 9B | Q5_K_M | 48-58 t/s |
| Granite 4.2 8B | Q5_K_M | 42-50 t/s |
| Gemma 4 12B | Q5_K_M | 28-34 t/s |
| gpt-oss 20B | MXFP4 | 30-38 t/s |
| Mistral Small 24B | Q4_K_M | 16-22 t/s |
#3. 性能基准测试
RX 6900 XT Qwen 3.5 9B Q4:Vulkan下56个token/秒。约比现代RX 7800 XT慢30%。
#2026 结论
- 二手商品,价格实惠
- 价格实惠的 16 GB AMD 显卡。如果 Linux + Vulkan 能正常运行,这是个不错的选择。
- 如果预算允许,优先选择 RX 7800 XT
- RDNA 3,速度提升 30%,显存仍为 16 GB
#常见问题
运行 LLM,该选 RX 6800 XT 还是 RX 6900 XT?+
速度相差约 10%,价格差距适中。预算相同的情况下,选择 6900 XT;否则,6800 XT 也是划算的选择。
ROCm在2026年是否支持RX 6800 XT?+
ROCm 6.x 官方支持这款显卡,但存在限制。实际使用中,llama.cpp 的 Vulkan 后端可达到 90% 的性能,且无需 ROCm 依赖。
在RX 6900 XT上,Qwen 3.5 9B每秒生成多少token?+
在 Vulkan 下采用 Q4_K_M 量化时为 52–58 tok/s。表现尚可,但明显落后于 RDNA 3(RX 7800 XT:68 tok/s)。
这份指南对您有帮助吗?
有反馈、发现了错误,或想补充说明?请告诉我们,让这份指南对每个人都更有帮助。
目录
分享