第 2026-09-19 期 · 行业追踪 · 开源 · 应用

用户自制旧PC加矿卡服务器,Qwen3 27B约30 token/秒

一名用户在r/LocalLLaMA分享,用旧i7-4790K主机搭配两张改装矿卡(合计30GB显存、花费250美元),让Qwen3 27B模型达到约每秒30 token的推理速度。此前仅用CPU时MoE模型约10至20 token/秒,稠密模型不足3 token/秒。

r/LocalLLaMA30 小时前
查看原文 ↗