第 2026-09-25 期 · 行业追踪 · 模型发布 · 开源 · 研究

ThinkingCap与Swift微调Qwen3.8-27B基准对比

第三方Aider评测显示,ThinkingCap与Swift微调版将Qwen3.8-27B的推理token中位数从12547降至约7400,降幅近40%,与模型卡声明一致;三者在首次通过率(27.1%-30.8%)和重试通过率(75.7%-77.6%)上差异在噪声范围内,性能未明显下降。

r/LocalLLaMA46 小时前
查看原文 ↗