第 2026-09-14 期 · 行业追踪 · 研究

研究:ML 代理不会过拟合的原因与压缩性

研究:ML 代理不会过拟合的原因与压缩性

新研究指出 ML 代理学到的是可压缩的策略,而非记忆化数据。将成功策略通过信息瓶颈压缩到约 16 个 token,新的代理仍能复现表现,说明策略抓住了真实结构,压缩测试可诊断是否为过拟合。

Hacker News2 天前
查看原文 ↗