果核Pulse
📡 X 信号

花更少钱堆出大算力AI工作站,比单块RTX 5090划算

🤯 这台总容量64GB的AMD AI工作站,建造者花的钱比一块单独的RTX 5090还少,跑Qwen3.8-27B能达到111 tok/s。

这套配置让我都心动想要组装一台了,毕竟RTX 5090太贵了。配置如下👇
🟠 2× Radeon AI PRO R9700 32GB
💾 总专用显存64GB
🧠 Ryzen 7500F
💾 64GB DDR5
🔌 每张GPU都是PCIe 5.0 x8通道
⚡ vLLM Radiance + TP2 + MTP
运行Qwen3.8-27B Quark AWQ MXFP4……
🚀 中位解码速度111.4 tok/s
⚡ 预填充速度4,224–4,410 tok/s
⏱️ TTFT 81ms
📚 服务器上下文131K
原生FP8仍能达到87.6 tps

🎮 单块RTX 5090 → 32GB VRAM
🟠 2× R9700 → 64GB VRAM

建造者称整台机器花了约4000欧元,在他所在的市场比单块RTX 5090便宜超过1000欧元。所以花更少的钱,最终他得到了两倍显存,跑Qwen3.8-27B还能有111 tok/s的速度。🔥

Reddit链接在替代文本里。

本文由 AI 翻译自英文原帖,技术名词保留英文。

查看 X 原帖

📬 订阅 果核Pulse

每日早间更新,不错过重要信号

▲ 回到顶部