第 2026-10-04 期 · 行业追踪 · 应用 · 开源

用户分享Strata加速本地大模型但64GB内存吃紧

一名Reddit用户反映,在R9700和RTX 5060 Ti双GPU、64GB DDR5内存配置下,通过Strata运行Qwen3.8-Flash-Next的量化版本,推理速度从约21 token/秒提升至约60 token/秒,但内存占用高达96%,无法同时运行ComfyUI图像视频任务,凸显本地大模型对系统内存的高需求。

r/LocalLLaMA3 天前
查看原文 ↗