用户自制旧PC加矿卡服务器,Qwen3 27B约30 token/秒
一名用户在r/LocalLLaMA分享,用旧i7-4790K主机搭配两张改装矿卡(合计30GB显存、花费250美元),让Qwen3 27B模型达到约每秒30 token的推理速度。此前仅用CPU时MoE模型约10至20 token/秒,稠密模型不足3 token/秒。
AI 日报收录的 Qwen3 相关报道,共 1 篇,按时间倒序,每小时更新。
一名用户在r/LocalLLaMA分享,用旧i7-4790K主机搭配两张改装矿卡(合计30GB显存、花费250美元),让Qwen3 27B模型达到约每秒30 token的推理速度。此前仅用CPU时MoE模型约10至20 token/秒,稠密模型不足3 token/秒。