用户以不足一张RTX 6000价格搭建768GB显存本地推理机
r/LocalLLaMA用户分享用12块64GB CMP 170HX搭建共768GB显存的本地推理平台,花费低于一张RTX 6000 Pro,并通过光纤连接另一台机器以RPC扩展内存,运行GLM5.3、DeepSeek v4.1 Flash、Qwen3.8、KimiK3、MiniMaxM3等模型,使用vLLM或llama.cpp推理。
AI 日报收录的 RTX 6000 相关报道,共 1 篇,按时间倒序,每小时更新。
r/LocalLLaMA用户分享用12块64GB CMP 170HX搭建共768GB显存的本地推理平台,花费低于一张RTX 6000 Pro,并通过光纤连接另一台机器以RPC扩展内存,运行GLM5.3、DeepSeek v4.1 Flash、Qwen3.8、KimiK3、MiniMaxM3等模型,使用vLLM或llama.cpp推理。