Swift‑Qwen3.8‑27B细调显著减少“过思考”令牌
LocalLLaMA帖子介绍UkisAI的Swift‑Qwen3.8‑27B细调版,通过惩罚触发过度推理的标记并借鉴BottleCap AI方法,实现约30–50%更少的推理令牌而保持输出质量。
AI 日报收录的 UkisAI 相关报道,共 2 篇,按时间倒序,每小时更新。
LocalLLaMA帖子介绍UkisAI的Swift‑Qwen3.8‑27B细调版,通过惩罚触发过度推理的标记并借鉴BottleCap AI方法,实现约30–50%更少的推理令牌而保持输出质量。
UkisAI 在 Qwen 3.8 27B 基础上进行后训练,识别并惩罚导致“过度思考”的 token,结合 On‑Policy Distillation 将推理令牌减少 58%、速度提升 1.95 倍、准确率损失 <1%。模型开源于 Hugging Face,并提供由 NVIDIA 资助的免费 OpenAI 兼容 API(限速 5 RPM)。