第 2026-10-03 期 · 行业追踪 · 开源 · 应用
Strata搭配Qwen3.8 Next在慢速内存上提速
有用户报告称,采用IQ3_XXS权重的Strata方案搭配Qwen3.8 Next,在DDR4加7900XTX平台上达到约45-70 tokens/s,明显高于调优后Llama CPP的约22.5t/s,12GB与16GB显卡用户也有类似表现。
查看原文 ↗有用户报告称,采用IQ3_XXS权重的Strata方案搭配Qwen3.8 Next,在DDR4加7900XTX平台上达到约45-70 tokens/s,明显高于调优后Llama CPP的约22.5t/s,12GB与16GB显卡用户也有类似表现。
查看原文 ↗