Strata搭配Qwen3.8 Next在慢速内存上提速
有用户报告称,采用IQ3_XXS权重的Strata方案搭配Qwen3.8 Next,在DDR4加7900XTX平台上达到约45-70 tokens/s,明显高于调优后Llama CPP的约22.5t/s,12GB与16GB显卡用户也有类似表现。
AI 日报收录的 Qwen3.8 Next 相关报道,共 1 篇,按时间倒序,每小时更新。
有用户报告称,采用IQ3_XXS权重的Strata方案搭配Qwen3.8 Next,在DDR4加7900XTX平台上达到约45-70 tokens/s,明显高于调优后Llama CPP的约22.5t/s,12GB与16GB显卡用户也有类似表现。