Nathan Lambert

5 篇报道

Nathan Lambert 是一位关注模型能力、风险与评估问题的AI研究者与评论者。近期他表示愿作为独立评估者参与审查并正在建立非营利组织,同时就AI实验室对科学共同体的处理、以及蒸馏(distillation)在以SFT与RL为特征的时代中的作用发表了看法。

相关话题
Nathan Lambert@natolambert
206 赞 · 7 转发 ·
迄今为止公开的最酷的规模化 RL 资源之一!太让人高兴了。 [引用 @_LuoFuli]: 将近半年的沉默。我们把它用来研究一个问题:RL 能扩展到多远。 MiMo-V2.6 目前正处于其 RL 运行的中间阶段。我们扩展的三件事:计算(~2B tokens per step, 1568 prompts × 16 rollouts, fully async)、环境与测试框架(多任务 agentic RL,在一次运行中混合多个测试框架)、以及评分器计算(agentic in-group credit assignme…
Nathan Lambert@natolambert
221 赞 · 7 转发 ·
我会考虑以独立评估者的身份提供帮助,同时也以我正在创建的非营利组织参与。这将是一个至关重要的角色,但具有实质性技术专长的独立人士并不多。我认为自己代表了在 AI 能力与风险问题上的一个重要温和派阵营。 [引用 @DarioAmodei]: 我们必须放缓前沿步伐:我写了一篇新文章,说明为什么 AI 行业应该放慢速度,并提出了一个三部分的计划来实现这一点。 Anthropic 正在单方面承诺实施这三步中的第一步。我们将为第三方评估者提供对我们系统的永久、员工级别访问权限,以便他们能够验证我们安全措施的遵守情况、报告事…
Nathan Lambert@natolambert
203 赞 · 10 转发 ·
对那些认为蒸馏主要是 SFT 的副产品,并且质疑在以 RL 为主导的时代它如何会变得越来越有影响力的人来说,这是一个重大胜利。 [引用 @xeophon]: 很高兴现在有更多关于蒸馏在哪里被使用、它意味着什么以及谁在在多大程度上做着什么的见解和透明度! 它也证实了一些人所怀疑的:一些 CN 实验室在生产环境中为 Claude 提供服务以获取数据。 https://t.co/yKHtvvyTyA
已经到底了