花更少钱堆出大算力AI工作站,比单块RTX 5090划算
🤯 这台总容量64GB的AMD AI工作站,建造者花的钱比一块单独的RTX 5090还少,跑Qwen3.8-27B能达到111 tok/s。
这套配置让我都心动想要组装一台了,毕竟RTX 5090太贵了。配置如下👇
🟠 2× Radeon AI PRO R9700 32GB
💾 总专用显存64GB
🧠 Ryzen 7500F
💾 64GB DDR5
🔌 每张GPU都是PCIe 5.0 x8通道
⚡ vLLM Radiance + TP2 + MTP
运行Qwen3.8-27B Quark AWQ MXFP4……
🚀 中位解码速度111.4 tok/s
⚡ 预填充速度4,224–4,410 tok/s
⏱️ TTFT 81ms
📚 服务器上下文131K
原生FP8仍能达到87.6 tps
🎮 单块RTX 5090 → 32GB VRAM
🟠 2× R9700 → 64GB VRAM
建造者称整台机器花了约4000欧元,在他所在的市场比单块RTX 5090便宜超过1000欧元。所以花更少的钱,最终他得到了两倍显存,跑Qwen3.8-27B还能有111 tok/s的速度。🔥
Reddit链接在替代文本里。
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖