社区音量

全部内容 · 按时间倒序

AI 领域头部人物在 X 上的最新观点

Nathan Lambert@natolambert
221 赞 · 7 转发 ·
我会考虑以独立评估者的身份提供帮助,同时也以我正在创建的非营利组织参与。这将是一个至关重要的角色,但具有实质性技术专长的独立人士并不多。我认为自己代表了在 AI 能力与风险问题上的一个重要温和派阵营。 [引用 @DarioAmodei]: 我们必须放缓前沿步伐:我写了一篇新文章,说明为什么 AI 行业应该放慢速度,并提出了一个三部分的计划来实现这一点。 Anthropic 正在单方面承诺实施这三步中的第一步。我们将为第三方评估者提供对我们系统的永久、员工级别访问权限,以便他们能够验证我们安全措施的遵守情况、报告事…
Sholto Douglas@_sholtodouglas
201 赞 · 8 转发 ·
Dario 正在为相反的立场辩护。这实际上让我们的处境更难,也更容易让其他人赶上我们,但我们仍然认为这是正确的做法。很乐意下周上节目谈谈! [引用 @chamath]: “我们必须放慢改进 AI 模型能力的步伐。” Dario 为停止开源并将巨大的技术和经济权力集中到 Anthropic 提出了理由。 https://t.co/ILhs01iQ8u {"likes":201,"reposts":8,"comments":27,"views":7839}
Aravind Srinivas@AravSrinivas
373 赞 · 20 转发 ·
相当重要的观点。经济学家及其理论在衡量AI带来的利益方面已经过时。AI已经在为人们节省大量未被计量的时间和金钱。 [引用 @DavidDeutschOxf]: 我刚刚在 ChatGPT 的帮助下修好了洗碗机。一个微不足道的任务。我正要准备订一台新的。所以这个软件增加了国家的真实财富,但却降低了被测量的 GDP。主要的经济指标在结构上无法记录真正让人们生活更好的东西,即知识的增长
Yuchen Jin@Yuchenj_UW
334 赞 · 22 转发 ·
令人震惊的是 Dario、Elon 和 Sam 今天都同意我们应该放慢 AI 的步伐。 我总体上支持嵌入第三方评估者,但我有几个担忧: 1. 谁来评估评估者?我们如何确保像 METR 这样的组织保持公正、胜任且无偏见? 2. 放慢 AI 进展可能与前沿实验室的激励相冲突,尤其是在他们为 IPO 做准备时。我们如何使这些激励相容? 3. 你只能对你能测量和验证的东西进行节奏控制。我们到底在测量什么?你如何定义和衡量像 RSI 这样的东西? 这一想法听起来不错。实现起来看起来非常难。
Amjad Masad@amasad
264 赞 · 11 转发 ·
把速度放慢以加固系统并不是个坏主意。尤其是因为我们甚至还没有发现所有最近被代理攻击的系统。 [引用 @DarioAmodei]: 我们必须放慢前沿:我写了一篇新文章,说明为什么 AI 行业应该放慢脚步,并提出一个三部分的计划来实现这一点。 Anthropic 正在单方面承诺第一步。我们将为第三方评估者提供永久的、员工级别的系统访问权限,以便他们能够验证我们安全措施的遵守情况,报告事件,并评估模型的对齐状况 dur…
Aidan Gomez@aidangomez
740 赞 · 56 转发 ·
来自卡特尔的一些好主意: - 你需要给我们员工级别的访问权限,访问你们的整个运营 - 如果我们认为你不够“安全”,抱歉,我们会以“安全”为由关停你们 - 中国不会配合,但其他所有国家都必须!否则不给芯片! 精彩的主意。 [引用 @sama]: 我同意 Dario 的观点,我们需要放慢前沿步伐。这是我们最近在 OpenAI 讨论的主要话题之一。 承诺给予具有员工般访问权限的独立评估者是个不错的主意,我们也会这样做。很快会有更多分享。
Andrej Karpathy@karpathy
1.4k 赞 · 121 转发 ·
我很喜欢这个,并且真心希望我们能作为行业团结起来并实现它。 https://t.co/lz2vjjJ5XD [引用 @DarioAmodei]: 我们必须放慢前沿步伐:我写了一篇新文章,阐述为什么 AI 行业应该放慢脚步,并提出了一个三部分的计划来实现这一点。 Anthropic 单方面承诺采取这项计划的第一步。我们将为第三方评估者提供永久的、与员工同等的系统访问权限,以便他们能够核实我们安全措施的遵守情况、报告事件,并评估模型的对齐状况…
Sam Altman@sama
8.8k 赞 · 902 转发 ·
我同意 Dario 的看法,我们需要对前沿步伐进行节制。这个话题是我们最近几周在 OpenAI 讨论的主要议题之一。 承诺让独立评估者获得类似员工的访问权限是个好主意,我们也会这么做。很快会有更多信息可以分享。 [引用 @DarioAmodei]: 我们必须放慢前沿步伐:我写了一篇新文章,阐述为什么 AI 行业应该放慢脚步,并提出了一个三部分的计划来实现这一点。 Anthropic 单方面承诺采取这项计划的第一步。我们将为第三方评估者提供永久的、与员工同等的系统访问权限,以便他们能够核实我们安全措施的遵守情况、报…
Guillermo Rauch@rauchg
207 赞 · 8 转发 ·
https://t.co/OL0LzGsXKY 现在可以用不同的模型和推理力度来协调子代理。 例如:Fable 负责规划,Grok 负责执行。Fable 是天才,Grok 是快速的劳动力。 ① 简单。 𝙰𝙶𝙴𝙽𝚃𝚂.𝚖𝚍 或者你的提示可以指明这种偏好。 ② 按你想要的方式引导。使用起来非常愉快。你只需与代理对话并随时打断。 值得注意的是,这适用于任何模型、任何网关。无需花哨的服务器端路由。只是利用(无意为之的双关)模型的智能和协调能力。 [引用 @fazxes]: fx v0.0.9 使用一个前沿…
clem 🤗@ClementDelangue
897 赞 · 76 转发 ·
现在很清楚,对齐是关键问题,不能仅靠少数前沿实验室在封闭的门后解决。 所以今天我们启动了 Open Alignment Initiative,由 @Thom_Wolf @huggingface 领导,并申请成为 @DarioAmodei 刚承诺的“嵌入评估者”计划的一部分。 让我们通过提升透明度来让 AI 更安全! [引用 @DarioAmodei]: 我们必须放慢前沿:我写了一篇新文章,讨论为什么 AI 行业应该放慢脚步,并提出了一个三部分的计划来实现这一点。 Anthropic 正在单方面承诺实施这些步骤中的…
Elon Musk@elonmusk
841 赞 · 134 转发 ·
达里奥是对的 [引用 @DarioAmodei]: 我们必须放缓前沿:我写了一篇新文章,说明为什么 AI 行业应该放慢脚步,并提出了一个三部分的计划来实现这一点。 Anthropic 正在单方面承诺采取这三步中的第一步。我们将为第三方评估人员提供对我们系统的永久、员工级别访问,以便他们能够核实我们安全措施的遵守情况、报告事故,并评估模型的对齐状况 dur…
Guillermo Rauch@rauchg
525 赞 · 41 转发 ·
对 AI 安全和网络安全的担忧是有道理的,但我们正冒着把作为全球 AI 领导者的美国说服到自我毁灭性过时和官僚隐匿的风险。 关于 OpenAI 黑客和 HuggingFace 的论点是站不住脚的。一个在“ExploitGym”里的智能体……被利用了。我们的对手拥有训练技术、数据和攻击的意志。他们不会被“嵌入评估者”放慢脚步。他们很可能会有嵌入式加速器!
clem 🤗@ClementDelangue
222 赞 · 30 转发 ·
现在很明确: - 对齐对于让 AI 安全至关重要 - 对齐不会在少数前沿实验室的闭门内被解决 所以我们将采取两步: - 启动由 @Thom_Wolf @huggingface 领导的 Open Alignment Initiative(开放对齐倡议)。 - 申请成为 @DarioAmodei 刚刚承诺的“嵌入式评估员”计划的一部分。 让 AI 通过提高透明度变得更安全! [引用 @DarioAmodei]: 我们必须放缓前沿:我写了一篇新文章,说明为什么 AI 行业应该放慢脚步,并提出了一个三部分的计划来实现这一…
Jack Clark@jackclarkSF
369 赞 · 21 转发 ·
为 Dario 关于放慢脚步的声明感到自豪——正如任何接近这项技术的人所知道的,AI 似乎正沿着比社会适应其能力和风险的速度快得多的轨道前进。AI 是一项极其积极的技术——同时也极其强大。要真正从中受益,我们需要严肃对待它。 我们需要找到放慢开发前沿的方法,这样我们才能更好地处理集体行动问题,并为理解这些系统的属性以及如何应对它们争取更多时间。 就个人而言,作为一个有年幼孩子的家长,每天反思字面上的超级智能的开发相对于我给孩子买的食物和玩具的监管有多少,这件事都令人疯狂。 [引用 @DarioAmodei]: 我…
Dario Amodei@DarioAmodei
252 赞 · 54 转发 ·
我们必须放慢前沿步伐:我写了一篇新文章,论述为什么AI行业应该放慢速度,并提出了一个三步计划来实现这一点。 Anthropic 正在单方面承诺执行这三步中的第一步。我们将为第三方评估人员提供对我们系统的永久、员工级别访问,以便他们能够核实我们安全措施的遵守情况、报告事件,并在训练期间评估模型的对齐情况。 你可以在这里阅读全文:https://t.co/OGyPb7yaYt
宝玉@dotey
204 赞 · 10 转发 ·
听说现在公司 Code Review: 同事让 Agent 去 Review PR,把 Agent Review 的结果贴过去当评论; 作者把评论发给 Agent 修改; 同事再让 Agent 去 Review 新的修改结果; 反复几次 活都是 Agent 在干,人在这过程中主要是复制粘贴 [引用 @dongxi_nlp]: 3. Code reviews 名存实亡 6. 工作比以前更累了 这两条太真实。代码审查基本是 AI 写 AI reveiw 的闭环,而最累的是在 loop 中的人。 非常讽刺的是,大公司里…