第 2026-09-18 期 · 行业追踪 · 开源 · 应用

用户以不足一张RTX 6000价格搭建768GB显存本地推理机

r/LocalLLaMA用户分享用12块64GB CMP 170HX搭建共768GB显存的本地推理平台,花费低于一张RTX 6000 Pro,并通过光纤连接另一台机器以RPC扩展内存,运行GLM5.3、DeepSeek v4.1 Flash、Qwen3.8、KimiK3、MiniMaxM3等模型,使用vLLM或llama.cpp推理。

r/LocalLLaMA2 天前
查看原文 ↗