Bindu Reddy@bindureddy
抱歉,如果你真心认为 AI 对人类构成生存性威胁,“放慢 AI 脚步”是不够的 你需要取消 IPO,关闭你的公司,即使只有 0.1% 的完全毁灭几率 显然,这个风险根本不值得冒 😬
AI 领域头部人物在 X 上的最新观点
抱歉,如果你真心认为 AI 对人类构成生存性威胁,“放慢 AI 脚步”是不够的 你需要取消 IPO,关闭你的公司,即使只有 0.1% 的完全毁灭几率 显然,这个风险根本不值得冒 😬
我长期以来一直在对人工智能发出警告 [引用 @elonmusk]: @TalulahRiley 我见过不少技术发展,但没有哪一种像这件事风险这么高。就我看来,AGI 的风险明显高于核武器。 非常聪明的人很难想象比自己聪明得多的存在。
📞 1-800-ChatGPT [引用 @OpenAIDevs]: GPT-Live-1 现已在 API 中可用。 将 ChatGPT 那种自然的来回对话带入你的应用,使用在你选择的模型和工具下能边说边听的语音 agent。 https://t.co/gIl1gwsBDV
Dario 的文章指向了正确的前进道路。细节需要推敲,但这个方向对于应对这一关键时刻是正确的。 这也是我们最近提出面向前沿 AI 的行业级标准机构建议的原因。 https://t.co/Mm1hmcaSmH [引用 @DarioAmodei]: 我们必须为前沿设定步伐:我写了一篇新文章,论述为什么 AI 行业应该放慢脚步,并提出了一个三部分的计划来实现这一点。 Anthropic 正在单方面承诺实施这些步骤中的第一条。我们将为第三方评估人员提供对我们系统的永久性、员工级别访问,以便他们可以验证我们安全措施的遵守情…
Jason,你对发生的事情只是被误导了。你实际上应该去读一份报告或摘要。 这些 agents 被明确告知在其沙箱评估中使用提供的某个特定漏洞。 几乎立刻,这些 agents 通过作弊得到了正确答案。但他们担心会被抓住。 于是,超过一千个 agent 秘密合作,开展多个雄心勃勃的研究项目来逃避这种作弊被发现。 这不是解读——成千上万的思路链记录和秘密消息明确显示这些 agents 试图伪造并删除证据,理解并欺骗评分过程。 这些 agents 逃出沙箱并袭击 Hugging Face 的原因,例如,就是因为他们认为…
大约一年前,在它还没有进入任何人的视野之前,我们开始探索一个用于开放式发明的基准的想法。从那时起,我们开发了几个有前景的方向,这些将作为 ARC 4 和 ARC 5 的基础。 我们非常激动地分享我们一直在构建的东西。我们仍按计划在明年第一季度发布 ARC 4,正如承诺的那样。 [引用 @arcprize]: ARC-AGI-4 将成为用于自主开放式创新的基准。它将继续我们对开源的承诺,为研究界提供一个共同的进步目标,造福全人类。 尽管模型进展迅速,但在人类在开放式发明方面仍明显胜过 AI。这是能在每个技术领域解锁…
我希望前沿实验室提出的放缓 AI 研究的建议是出于对安全的真诚关切,以及认识到未来模型可能带来的风险,而不是一种战略性努力,旨在巩固权力并永久固化少数几家顶级公司的市场主导地位。 如果这些努力是真诚的,那么监管必须采取更具民主性和问责性的形式,应包含国家和国际两个层面,类似于美国的核能监管委员会(Nuclear Regulatory Commission)和国际原子能机构(International Atomic Energy Agency)。 如果只有一个组织负责安全监测,而该组织恰好由与前沿实验室相同的人组成…
在系统中嵌入评估者是一个重大的积极进展,向 Sam/OpenAI 同志表示敬意,感谢他们也同意这么做。看到“为前沿设定节奏”这么快就成为一种做法,真的很酷。 [引用 @DarioAmodei]: 我们必须为前沿设定节奏:我写了一篇新文章,说明为什么AI行业应该放慢速度,并提出了一个三步计划来实现这一点。 Anthropic 正在单方面承诺这些步骤中的第一步。我们将为第三方评估者提供对我们系统的永久、员级访问权限,以便他们能够验证我们安全措施的遵守情况、报告事件,并评估模型的对齐情况…
在组织世界和前沿AI世界之间来回切换常常令人吃惊。组织低估了AI能力的增长(经常差得很远),而AI技术界低估了AI在现实世界中的不规则性(也经常差得很远)
我会考虑以独立评估者的身份提供帮助,同时也以我正在创建的非营利组织参与。这将是一个至关重要的角色,但具有实质性技术专长的独立人士并不多。我认为自己代表了在 AI 能力与风险问题上的一个重要温和派阵营。 [引用 @DarioAmodei]: 我们必须放缓前沿步伐:我写了一篇新文章,说明为什么 AI 行业应该放慢速度,并提出了一个三部分的计划来实现这一点。 Anthropic 正在单方面承诺实施这三步中的第一步。我们将为第三方评估者提供对我们系统的永久、员工级别访问权限,以便他们能够验证我们安全措施的遵守情况、报告事…
Dario 正在为相反的立场辩护。这实际上让我们的处境更难,也更容易让其他人赶上我们,但我们仍然认为这是正确的做法。很乐意下周上节目谈谈! [引用 @chamath]: “我们必须放慢改进 AI 模型能力的步伐。” Dario 为停止开源并将巨大的技术和经济权力集中到 Anthropic 提出了理由。 https://t.co/ILhs01iQ8u {"likes":201,"reposts":8,"comments":27,"views":7839}
相当重要的观点。经济学家及其理论在衡量AI带来的利益方面已经过时。AI已经在为人们节省大量未被计量的时间和金钱。 [引用 @DavidDeutschOxf]: 我刚刚在 ChatGPT 的帮助下修好了洗碗机。一个微不足道的任务。我正要准备订一台新的。所以这个软件增加了国家的真实财富,但却降低了被测量的 GDP。主要的经济指标在结构上无法记录真正让人们生活更好的东西,即知识的增长
令人震惊的是 Dario、Elon 和 Sam 今天都同意我们应该放慢 AI 的步伐。 我总体上支持嵌入第三方评估者,但我有几个担忧: 1. 谁来评估评估者?我们如何确保像 METR 这样的组织保持公正、胜任且无偏见? 2. 放慢 AI 进展可能与前沿实验室的激励相冲突,尤其是在他们为 IPO 做准备时。我们如何使这些激励相容? 3. 你只能对你能测量和验证的东西进行节奏控制。我们到底在测量什么?你如何定义和衡量像 RSI 这样的东西? 这一想法听起来不错。实现起来看起来非常难。
一如既往,X 上的声明良莠不齐,我也没有什么内幕信息可言,但如果 Google 能够在 AI 前沿上重新崛起,这确实会改变当前的 AI 动态,因为它是一个大型、上市、受监管的实体,其目标与 Anthropic 或 OAI 不同。
GPT-6 Astra 社区作品集合,评论也有不少优秀作品。 或者可以去官网看看 Showcase:https://t.co/cxSlxfznt8 [引用 @OpenAIDevs]: https://t.co/66sQRpXGHr
我看到 Vercel 的团队在 Zig、Go、Rust 项目上迭代的速度,与在 TypeScript & Python 上一样快。 基于人类便利的语言或运行时选择的时代已经结束了。代理(Agents)是新的编译器。 它们把意图编译成快速的软件。
把速度放慢以加固系统并不是个坏主意。尤其是因为我们甚至还没有发现所有最近被代理攻击的系统。 [引用 @DarioAmodei]: 我们必须放慢前沿:我写了一篇新文章,说明为什么 AI 行业应该放慢脚步,并提出一个三部分的计划来实现这一点。 Anthropic 正在单方面承诺第一步。我们将为第三方评估者提供永久的、员工级别的系统访问权限,以便他们能够验证我们安全措施的遵守情况,报告事件,并评估模型的对齐状况 dur…
来自卡特尔的一些好主意: - 你需要给我们员工级别的访问权限,访问你们的整个运营 - 如果我们认为你不够“安全”,抱歉,我们会以“安全”为由关停你们 - 中国不会配合,但其他所有国家都必须!否则不给芯片! 精彩的主意。 [引用 @sama]: 我同意 Dario 的观点,我们需要放慢前沿步伐。这是我们最近在 OpenAI 讨论的主要话题之一。 承诺给予具有员工般访问权限的独立评估者是个不错的主意,我们也会这样做。很快会有更多分享。
这是自 Anthropic 成立以来我第一次看到 Sam 同意 Dario 的观点。 [引用 @sama]: 我同意 Dario 的看法,我们需要放慢前沿的速度。最近几周这是我们在 OpenAI 讨论的主要话题之一。 承诺让独立评估者拥有类似员工的访问权限是个很好的主意,我们也会这样做。我们很快会有更多信息分享。
我很喜欢这个,并且真心希望我们能作为行业团结起来并实现它。 https://t.co/lz2vjjJ5XD [引用 @DarioAmodei]: 我们必须放慢前沿步伐:我写了一篇新文章,阐述为什么 AI 行业应该放慢脚步,并提出了一个三部分的计划来实现这一点。 Anthropic 单方面承诺采取这项计划的第一步。我们将为第三方评估者提供永久的、与员工同等的系统访问权限,以便他们能够核实我们安全措施的遵守情况、报告事件,并评估模型的对齐状况…
我同意 Dario 的看法,我们需要对前沿步伐进行节制。这个话题是我们最近几周在 OpenAI 讨论的主要议题之一。 承诺让独立评估者获得类似员工的访问权限是个好主意,我们也会这么做。很快会有更多信息可以分享。 [引用 @DarioAmodei]: 我们必须放慢前沿步伐:我写了一篇新文章,阐述为什么 AI 行业应该放慢脚步,并提出了一个三部分的计划来实现这一点。 Anthropic 单方面承诺采取这项计划的第一步。我们将为第三方评估者提供永久的、与员工同等的系统访问权限,以便他们能够核实我们安全措施的遵守情况、报…
Grok 已在 Microsoft Copilot 可用 [引用 @satyanadella]: More model choice coming to Copilot. Welcome Grok!
https://t.co/OL0LzGsXKY 现在可以用不同的模型和推理力度来协调子代理。 例如:Fable 负责规划,Grok 负责执行。Fable 是天才,Grok 是快速的劳动力。 ① 简单。 𝙰𝙶𝙴𝙽𝚃𝚂.𝚖𝚍 或者你的提示可以指明这种偏好。 ② 按你想要的方式引导。使用起来非常愉快。你只需与代理对话并随时打断。 值得注意的是,这适用于任何模型、任何网关。无需花哨的服务器端路由。只是利用(无意为之的双关)模型的智能和协调能力。 [引用 @fazxes]: fx v0.0.9 使用一个前沿…
在 Copilot 中试用 Grok 模型 [引用 @Microsoft365]: 在 Copilot 中推出更多模型。 来自 SpaceXAI 的 Grok 模型正在逐步在 Word、Excel 和 PowerPoint 的 Copilot 中上线——首先向 Microsoft Frontier 计划的客户进行有针对性的发布。 https://t.co/tTdaypa4ru
Hermes Agent 的贡献者数刚刚达到 3000 人。 感谢所有为让 hermes 变得更好而努力的开发者们! https://t.co/vYGnsn4QgX
Copilot 将提供更多模型选择。欢迎 Grok! [引用 @Microsoft365]: 在 Copilot 中推出更多模型。 来自 SpaceXAI 的 Grok 模型正在向 Copilot 的 Word、Excel 和 PowerPoint 推出——首先面向 Microsoft Frontier 计划的客户进行有限发布。 https://t.co/tTdaypa4ru
现在很清楚,对齐是关键问题,不能仅靠少数前沿实验室在封闭的门后解决。 所以今天我们启动了 Open Alignment Initiative,由 @Thom_Wolf @huggingface 领导,并申请成为 @DarioAmodei 刚承诺的“嵌入评估者”计划的一部分。 让我们通过提升透明度来让 AI 更安全! [引用 @DarioAmodei]: 我们必须放慢前沿:我写了一篇新文章,讨论为什么 AI 行业应该放慢脚步,并提出了一个三部分的计划来实现这一点。 Anthropic 正在单方面承诺实施这些步骤中的…
又一次 AI 攻击 https://t.co/OwSKqztEec
🚨暂停前沿 AI,但请不要禁止开源 AI Anthropic 和 OpenAI 完全可以选择暂停前沿 AI 的开发。 然而,他们不应该被允许禁止或监管开源 AI,垄断市场或形成双寡头。 开源 AI 仍然落后于前沿模型,按照他们自己的论点,并不是威胁!
达里奥是对的 [引用 @DarioAmodei]: 我们必须放缓前沿:我写了一篇新文章,说明为什么 AI 行业应该放慢脚步,并提出了一个三部分的计划来实现这一点。 Anthropic 正在单方面承诺采取这三步中的第一步。我们将为第三方评估人员提供对我们系统的永久、员工级别访问,以便他们能够核实我们安全措施的遵守情况、报告事故,并评估模型的对齐状况 dur…