第 2026-09-27 期 · 行业追踪 · 研究 · 开源

对Qwen模型添加logit惩罚提升数学准确率

一位用户基于Meta关于“过度思考”标记的论文,在llama.cpp中对Qwen3.5-4B多种量化版本测试了针对“wait”“maybe”“perhaps”等词的logit偏置惩罚,在50道MATH-500随机题上验证效果。原论文未覆盖llama.cpp支持的各类量化。

r/LocalLLaMA14 天前
查看原文 ↗