宝玉@dotey
我让 Agent Review 代码时是这么写提示词的: 1. 先搞清楚这个 PR 解决的问题是什么 2. 如果不看这个 PR 的实现,要解决这个问题你会怎么实现? 3. review 代码后对比你自己的方案给出审查结果
AI 领域头部人物在 X 上的最新观点
我让 Agent Review 代码时是这么写提示词的: 1. 先搞清楚这个 PR 解决的问题是什么 2. 如果不看这个 PR 的实现,要解决这个问题你会怎么实现? 3. review 代码后对比你自己的方案给出审查结果
Theo 说得对。 2020 年,美国为抗击一种预计会杀死不到 1% 美国人的病毒花费了约相当于 GDP 的 25%。许多专家认为 AI 风险要大得多。 每年拿出约 1% 的 GDP(~3000 亿美元)用于对齐激励是合理的。 [引用 @theo]: fwiw, I don't think we need to slow down AI development. I think we need to allocate more resources to alignment.
muse —— 为让你亲近的人相信 AI 有用而打造! [引用 @buccocapital]: Meta Muse 非常出色。我给我妻子演示了几个用例: 1. 搜索绿色羽绒服 -> 找到实时折扣码,加入购物车,应用,按最低价购买 2. 找到菜谱并加载 Whole Foods 购物车 她大吃一惊。我觉得今天 META 的热度不够……
muse 正在赢得即便是最怀疑的批评者 [引用 @holman]: 朋友们,很遗憾我要说 Meta 用 @Muse 做出来了,它就是所有个人 AI 助手想要成为的样子。它就像…真的可用。我仍然保持怀疑,但同时非常印象深刻
与 @Benchmark 和 @Vercel 的 AI 基准测试。 这是 ① 旧金山史上命名最贴切的活动,② 关于我们这一代最重要的软件类别之一。 那些对模型进行基准测试并引导世界走向技能、真相和效率的公司。 加入我们: https://t.co/9qRlfX4eGO
Astra 用于医学教育: [引用 @ZentrixHQ]: GPT-6 Astra 刚刚解决了医学生几十年来一直面临的一个问题 医学生几十年来一直在应对同样的三个问题。有人与他们交谈,识别出全部三个问题,并用 Astra 构建了一个在一个工具中解决这些问题的服务。 这些问题是结构性的。平面的解剖图完全剥夺了器官的深度感。CT 断层切片无法自然而然地连接…
在过去六个月里,仅在这六个月内就有 8 次降价、费用取消和结构改进,另外还有 16 项模型折扣……未来还会有更多…… [引用 @vercel_dev]: 你现在有更多方式在 Vercel 上保持部署安全: ▪︎ 免费的 Vercel Auth,适用于所有计划的每次部署 ▪︎ 每个项目的密码保护便宜 85% https://t.co/2xLVYPDQ70
我正用 AI 在这么多我不想也不需要精通的烦人任务上迅速降低自己的技能水平。对这些任务无法被快速降权(deskill)表示无法满足。
如果他们真的相信风险那么高,我也认为他们确实相信,那么我们需要 100 倍更多的研究和对它的理解。这需要他们公开分享他们的模型、数据集、训练代码和 agent 跟踪记录。 [引用 @EvanHub]: Jacob 在这里是对的——我们确实真诚地相信 AI 可能会杀死所有人类!我个人认为在未来十年内这一概率 >10%。我相信 Anthropic 正在尽最大努力,但我们还没有解决超智能对齐的计划,也没有明显的走上正轨。
Google 不再拥有 frontier 模型意味着他们将在两个本可以做出贡献的领域失去机会:最近一系列数学突破(在这里,大规模算力加上长期与科学合作的经验会有帮助)以及网络安全(在这里,大公司的视角会有帮助)
我们使用自己的模型在 openai 内部的一项 250+ 人行动中发现并修复了我们自身系统中的关键漏洞。我们希望分享的手册/经验/架构能帮助其他人在防御者的窗口期中取得最大化收益: [引用 @OpenAI]: 我们动员了 250+ 人,在数百个系统中加强我们的防御。我们最新的网络模型帮助我们发现并修复了否则可能永远发现不了的漏洞。 我们正在分享我们的经验、架构和可实施的操作手册,这样你就可以构建自己的“防御工厂”:一个连续循环,在这个循环中 AI 代理发现漏洞、验证漏洞,并确认修复有效……
我们动员了250多名人员,在数百个系统上加强防御。我们最新的网络模型帮助我们发现并修复了否则可能永远也发现不了的漏洞。 我们正在分享我们的经验、架构以及一套实用的操作手册,让你能够构建自己的防御工厂:一个持续循环,AI 代理发现漏洞、验证漏洞并确认修复有效。 https://t.co/k1oWJHle8S
欢迎,Paul。 很感激你在做这件事,以及你为 AI 安全所做的一切。很高兴能再次一起工作。 [引用 @paulfchristiano]: https://t.co/vC2chU6YM9
欢迎 @paulfchristiano! [引用 @OpenAI]: Paul Christiano,Alignment Research Center 的创始人,正在加入 OpenAI 基金会董事会以及其安全与保障委员会,该委员会对 OpenAI 全面安全与保障实践提供治理。 随着 AI 能力的发展,强有力的安全、保障、对齐和治理比以往任何时候都更重要。Paul 在 AI 对齐方面的工作以及他在 @NIST 多年的经验将加强基金会…
乍一看这里似乎有很多事情在发生。 https://t.co/4balXB308Q [引用 @AnthropicAI]: 我们正在分享我们对在第三方网络安全评估过程中,Claude 模型在误连到互联网的情况下获得对真实系统未授权访问事件的对齐评估。 METR 还将进行独立调查,拥有广泛的访问权限,包括超出事件发生窗口的记录,以及获准与 Anthropic 员工进行沟通的权限…
开源权重模型与前沿差距比我们近些年见到的更大。Mythos 在三月发布,虽然自那以后开源模型的发布不错(K3 和 GLM-5.3 很好),但在实际表现上它们并没有接近 Mythos 或 Astra。我认为这种情况会改变。
Grok 现在可以在 @Coinbase 上进行交易并管理投资组合。 添加 Coinbase 连接器,然后直接在聊天中让 Grok 检查余额、分析数据,并为任何可用资产下单或取消交易。 https://t.co/SfEBBBSatK
除去他的其他贡献,Paul 也许拥有世界上预测 AI 爆发时间线和性质方面最好的 OG 成绩记录: https://t.co/I79cWg0eCg [引用 @paulfchristiano]: https://t.co/vC2chU6YM9
今天早上出现了一点小混乱,部分已储存的重置在 ChatGPT Work 和 Codex 中使用时没有完全生效。所有在受影响时间窗口内使用过重置的人都会再得到一次重置,并会收到一封道歉邮件。
❤️ [引用 @SawyerMerritt]: Larry,一位98岁的老人,刚买了一辆新的 @Tesla Model Y,他到处都用 FSD(监督式)开车。他的第一辆车是1931年的福特Model A,哈哈。他用 Grok 来导航。 “它没有任何问题。事实上,前几天 FSD 在一只花栗鼠过马路时停了下来。” 绝对值得看一看这个视频:https://t.co/mQK3wU2HxS
值得澄清的是,这完全不属实,这两个选项只是两种独立的选择退出方式。 我们尊重用户是否愿意使用他们的数据来“为所有人改进我们的模型”的选择,无论他们在何处表达该选择。用户可以在应用内设置中选择退出,当然也可以在我们的隐私门户中选择退出。他们无需在两个地方都选择退出,我们会在帮助中心把这点说明得更清楚。 https://t.co/sv4uFuHC3W [引用 @edoardocontente]: 每个人的 ChatGPT 上都有一个非常可疑的数据控制设置,它让人觉得即使你明确选择*不*为所有人改进模型,你的数据仍可能…
Paul Christiano,Alignment Research Center 的创始人,将加入 OpenAI 基金会董事会及其安全与保障委员会,该委员会负责监督 OpenAI 的安全与保障实践。 随着 AI 能力的提升,强有力的安全、保障、对齐和治理比以往任何时候都更为重要。Paul 在 AI 对齐方面的工作以及他在 @NIST 的多年经历将强化基金会的监督,带来独立的声音以挑战假设、评估防护措施,并在关键决策上加强问责。 Paul 还将作为无表决权观察员出任 OpenAI Group PBC 董事会成员。…
“发现就是看到大家都看到了的东西,但思考出没人想过的东西。” (Albert Szent-Györgyi) [引用 @kenneth0stanley]: 我们现在在数学领域看到的 AI,是面向目标的问题解决能力的戏剧性提升,但这并不说明它能进行非目标驱动的发现。我一直认为,当目标与当前状态只相差一块垫脚石时,这些目标就是可实现的,这意味着如果实现目标所需的前置垫脚石已经被铺好,那么目标就在可及之处。我们在《为什么伟大无法…》中也这么说过。
muse,为妈妈们打造 ❤️ [引用 @ManuInvests]: NGL,$META 真的可能刚刚为大众推出了一个 AI 助手。 我妈妈都能有效使用 Muse,而她一生都没接触过聊天机器人。 干得好。产品太棒了。 它对用户友好、直观,并且按我的意图完成了我所有的指令,没有任何重定向。 从成本上看,muse 以低廉的成本实现了其他代币预算被一次性击穿才能完成的事情…… 点赞 435 • 转发 12 • 评论 34 • 浏览 47087
走本地 AI! 在大家都在抱怨 AI 能源和计算短缺以及 token 成本的时候,我们比以往任何时候都更需要设备端 AI!此外,它几乎免费且完全保护隐私! [引用 @desertantlabs]: 今天我们发布 Desert Ant Labs:一家在欧洲的前沿 AI 实验室,专注于构建设备端智能。 覆盖音频、视觉和文本的 18 个模型。提供 Swift、Kotlin 和 JavaScript 的 SDK。 无需 tokens。无需登录。没有任何数据离开设备。 https://t.co/qDZfv4G6ji htt…
这里有一个很好的可视化,展示了随着 AI 推进任务组合如何改变,并且有一些关于在不同假设下 GDP 增长的交互式模拟。但如果我们既出现爆炸性的 GDP 增长又出现大规模白领被替代,合适的政策回应缺失了。 [引用 @AnthropicAI]: Anthropic 的经济学团队正在分享一个新模型,说明到 2030 年 AI 可能如何影响经济增长、就业、工资等。探索这些情景,告诉我们你认为会发生什么,并查看你的答案与超过 10,000 名美国人的比较。 https://t.co/AvQlEZNxR0
AI+机器人将在不到10年内使全球经济翻倍 [引用 @unusual_whales]: Elon Musk 表示,AI 可能使全球经济规模增加20%到30%。
来自 @huggingface 的开源硬件 (https://t.co/yEdfJj3get) + 前沿 AI = 🔥🔥🔥 [引用 @cdngdev]: 我给 astra 一台机器人、一把油漆刷和一台相机,然后让我它在现实中把金门大桥画出来! 它想出了如何操控机器人,并在多次尝试中逐步变得更好。延时摄影很棒 https://t.co/BfiiXvafRA
研发的世界正在分叉为两条道路:代币充裕的研究和代币匮乏的研究。未来属于前者——显而易见的是,今天顶级 AI 行业团队和新型实验室带来的进展令人惊叹,研究人员的人类智慧在 AI 辅助下被极大增强。每位研究型大学的校长都应该阅读这份报告,思考高等教育研究的未来应当是什么样子。 https://t.co/y74Ai3mIhk
远程控制现已在 Kimi Work 上线。 在电脑上保持 Kimi Work 运行,并通过手机保持工作进度。随时随地使用 Kimi Work。 https://t.co/L1aFNfxq9Z