第 2026-10-03 期 · 行业追踪 · 开源 · 应用

小显存用户期待Qwen4 35B等新模型

r/LocalLLaMA用户调侃8GB显存加16GB内存的本地部署党每天刷版等待新模型,期待Qwen4 35B A3B等,目前仍靠Gemma 26B QAT,速度约26 token/秒。

r/LocalLLaMA3 天前
查看原文 ↗