社区音量
全部内容 · 按时间倒序AI 领域头部人物在 X 上的最新观点

Alexandr Wang@alexandr_wang247 赞 · 8 转发 ·
“muse 是我自 ChatGPT 以来用过的最棒的应用——无论是否基于 AI——在带回那种最初‘哇’的感觉方面。”
你让我很激动 🥹🥹🥹
[引用 @0xShayan]: Muse 是我自 ChatGPT 以来用过的最棒的应用——无论是否基于 AI——在带回那种最初“哇”的感觉方面。
它只是……就是好用
界面/用户体验非常温暖友好,AI 本身感觉很聪明,几乎不需要引导。
我对 ChatGPT 在工作/浏览器使用上的最大抱怨是许多操作被屏蔽,但不知为何,Muse 的这些功能就能……

OpenAI Developers@OpenAIDevs540 赞 · 12 转发 ·
你们完全可以去做(实体)东西。
[引用 @natalieyeo]: “来自这个可爱的实体 Codex 宠物的‘Hello World’!致所有 @OpenAIDevs
在 Astra 上构建的第 5 天 https://t.co/aTeijhJQT1
{"likes":540,"reposts":12,"comments":38,"views":47282}

Matt Shumer@mattshumer_229 赞 · 6 转发 ·
把我(非常简单的)agent 设置给了我妈妈。
她给他起名叫 Morgan。他刚为她的网站成交了一笔 600 美元的广告合同。
人们对他们的设置想得太复杂了。Bitter Lesson 同样适用于 agents:只要问模型,让它生成所需的东西。
[引用 @mattshumer_]: 大家,这些疯狂的设置固然有趣,但它们并不会真正提高你的生产力。你最终只是花更多时间去构建系统,而不是实际做真正的工作。
你只需要一个 agent 会话,它可以分配任务给其他会话并担任经理角色。如果有东西不起作用,只要告诉你的主会话,它…

Greg Brockman@gdb280 赞 · 9 转发 ·
长途自驾的 Codex 语音体验:
[引用 @jonathanroomer]: 我在 CarPlay 上用了 Codex(语音)。太棒了。
现在即便在公路旅行时,车里五个孩子都吵闹、我老婆问我为什么跟 AI 说话比跟她多,我也能继续构建东西。
它通过我的 Nightblood iOS 应用运行,为 ChatGPT Voice 提供了形象、个性,并能完全访问 Codex、我的 Mac 和所有本地工具。

Teknium 🪽@Teknium284 赞 · 18 转发 ·
推出 Hermes Agent 插件目录!
你可以在 Hermes Desktop 应用的功能部分访问它,轻松搜索、浏览并探索社区和官方插件!
也欢迎提交你自己的!
[引用 @NousResearch]: Hermes Agent 现在有了插件目录:从 4 个官方插件和 96 个社区插件开始,涵盖桌面模块、新平台、浏览、专用工具等。
我们的团队会审核每个社区插件,并且会定期添加新插件。
https://t.co/sNGEQVvUlc https://t.co/dZl0eGJbHu
{"likes":284,"re…

Yuchen Jin@Yuchenj_UW357 赞 · 18 转发 ·
有人猜这是什么在 OpenRouter 上的 Union Alpha 野兽吗?
相当于 Claude Fable 5.1 级别,价格便宜超过 10 倍。等着它开源。
https://t.co/okoQnHeMw6
{"likes":357,"reposts":18,"comments":57,"views":35592}

Boris Cherny@bcherny916 赞 · 44 转发 ·
今天还有:Claude Docs、Claude Slides 和 Claude Design 在每个对话中都可用。
向 Claude 要一份演示文稿,你会得到可以打开、编辑并导出为 PowerPoint 或 PDF 的文件。文档和设计也是一样。不需要跳转到单独的工具——它们就在聊天中。
[引用 @claudeai]: 你现在也可以在对话中制作幻灯片、文档和设计。
在 Claude Docs 中草拟单页说明,使用 Claude Slides 把它变成演示文稿,再用 Claude Design 模拟一个匹配的视觉效果…

Boris Cherny@bcherny693 赞 · 27 转发 ·
Claude Code 展示了 AI 能完成真正的工作,而不仅仅是回答问题。开发者把一个功能交给 Claude,回来时就拿到已发布的代码。这也是行业中许多严肃工程工作的所在。
Cowork 证明知识工作者也能做到同样的事:把简报交给 Claude,回来时拿到完成的文件。
今天,聊天和 Cowork 开始合并为一个 Claude。方向是:一个 Claude 在你工作的一切地方携带上下文。每个人都能简单地访问 Claude 的全部能力。
这几周我每天都在用这种体验,感觉很棒。更简洁、更快、更强大。
我们会逐步推出。我…

OpenRouter@OpenRouter245 赞 · 20 转发 ·
三个关键开源权重实验室在 2026 年迄今为止其模型的月度花费增长已达 10 倍或更多。
封闭模型的支出增长相对较慢,尽管起点远高于开源模型。 https://t.co/iOKARyF2as

Ethan Mollick@emollick254 赞 · 33 转发 ·
当我与高级经理交谈时,越来越多地听到组织内部岗位模糊的故事(我们在 P&G 的研究中也发现了):编码、设计、产品管理在每个人使用 AI 时都在塌缩与重叠。
我们需要快速建立新的工作组织模型。 https://t.co/SGDOkRWU8J

Alexandr Wang@alexandr_wang222 赞 · 14 转发 ·
muse 语音转录真的很棒!!
[引用 @IsaacKing314]: 很遗憾地通知大家,Meta AI 终于变得不错了,至少在他们的竞争对手已经停止尝试的领域里。他们新的语音转录模型比最好的 OpenAI Whisper 模型快近一个数量级,而且准确度也明显更高。
{"likes":222,"reposts":14,"comments":33,"views":27793}

Bindu Reddy@bindureddy218 赞 · 6 转发 ·
哈哈……实际上没有人在放慢前沿速度
- Opus 5.2 正在测试中
- Grok 4.8 在几周内发布
- Jev 是一个新的超快速分类器
- OpenAI 已经在测试 Astra+
我们继续加速

Jack Clark@jackclarkSF211 赞 · 11 转发 ·
在谈论关于 AI 和奇点的一些奇怪说法
The Anthropic Institute 🤝 the DeepMind Institute
[引用 @ShaneLegg]: 我开发 AGI 的旅程跨越 25 年,其中包括在 Google DeepMind 思考技术和社会视角的 10+ 年。
AGI 已在地平线上——我们需要更深入地理解它的影响。为此,我们创建了 DeepMind Institute。 https://t.co/dpc2y4IGT1

Aidan Gomez@aidangomez215 赞 · 10 转发 ·
很高兴完成最终协议并与 AlephAlpha 联手!🇨🇦🇩🇪
[引用 @cohere]: Cohere 与 Aleph Alpha 宣布签署最终协议,成为首个在大西洋两岸都有根基的基础 AI 模型开发者 🇨🇦🇩🇪
以 Cohere 名义全球运营,合并后的公司将在两大洲拥有超过 1,000 名员工。 https://t.co/I6tywIEh7t
{"likes":215,"reposts":10,"comments":13,"views":13513}

Bindu Reddy@bindureddy220 赞 · 23 转发 ·
🚨 宣布 Abacus AI Bot —— 100% 免费的个人 AI
AI 可以管理你的日历、订票或订位。这些简单任务应该完全免费。
今天,我们宣布新产品 — Abacus AI bot
- 在网络上寻找并运行免费的 LLM
- 自动路由到免费模型
- 完成你所有的个人事务
- 只需下载、设置并运行
永久免费使用

Mistral AI@MistralAI250 赞 · 22 转发 ·
今天,我们宣布与 @mozilla 建立合作,旨在为使用 AI 在线浏览的人们带来隐私、控制和选择。🦊🐈
https://t.co/Bsd6N4jNdV https://t.co/OczDk9utfL

Gorden Sun@Gorden_Sun218 赞 · 30 转发 ·
Google 与马里兰大学等提出 Dream-RSI:让 AI Agent 在历史探索记录中低成本自我进化
长程探索任务的元策略优化通常需要极高的试错成本,这项研究直接将已完成的探索记录树作为精确的离线重放模拟器。
新策略无需重复调用模型执行真实代码,只需在历史轨迹中“做梦”重演即可筛选出更优方案,实现零执行成本的离线评估。
优胜策略随后部署至新一轮在线探索并扩充模拟器池,在保持甚至提升算法与算子发现质量的同时,最高降低 162 倍的探索调用开销。
项目介绍:https://t.co/jB6I6yKFIE

Ethan Mollick@emollick232 赞 · 34 转发 ·
来自 Google 的关于 AI 在科学中使用的研究,影响复杂:加速(每周节省 7 小时)同时伴随工作类型的变化(更多验证工作)以及研究选题的变化(可能转向更安全的课题)。
另外还有一张关于锯齿状前沿的好图 https://t.co/0x2dxBWl2U https://t.co/HZL2BHSZ2i

Alexandr Wang@alexandr_wang244 赞 · 9 转发 ·
muse 帮这位用户在 WiFi 上节省了超过 $5000!
[引用 @raunaqbn]: @Muse 总是让我惊讶!
今天我让它打电话给 Xfinity 为我砍网费。它通过了电话树找到了人工客服,遇到验证短信它本看不懂,就把电话接到我这!有一段时间是 muse 代理、我和那个毫不知情的 Xfinity 客服在通话中。
合并账单节省是 $85.30/月,锁定 5 年,大约在这段时间节省了 $5118。…

Alexandr Wang@alexandr_wang572 赞 · 17 转发 ·
muse 在 100 个不同故事中为人们节省了 $9,649.71
想象一下当十亿人都有 muse 时,这会为人们节省多少钱!!
我们正在努力扩大访问范围,把它带到每个地方!
[引用 @SingularityRes]: Meta 的 Muse AI 在真实用户身上节省了 $9,649.71,并为他们跑了 129 次差事——我有收据。
下面是 100 个真实故事,按省钱金额排序。最厉害的那些简直疯狂

Alexandr Wang@alexandr_wang350 赞 · 15 转发 ·
我发誓 muse code 真的是很棒!!
为 muse app 提供动力的同一个模型也驱动着 muse code!
[引用 @ryanmcadams]: 从没想过会这么说,但 @alexandr_wang 一直跟人说 Muse code 很好,我当时不信。今天花时间体验了一下,确实很不错……而且很快。还有点俏皮。

Yuchen Jin@Yuchenj_UW411 赞 · 24 转发 ·
Jev 已经发声了。
它选出了哪个模型是 AGI。
快 20–200 倍。便宜 40–400 倍。这可能让像“将大型模型用作法官”这种东西变得异常快速且几乎免费。
(我试了很多提示,仍然没有花掉 $0.10。) https://t.co/1Uhh4nMGDl
[引用 @CompleteSkeptic]: 在与 ChatGPT 共同发明后,我不断问自己:为什么那些超人类的聊天模型并没有带来通用人工智能(AGI)?
过去两年我一直在悄悄构建一种新的训练模型的方法(RLCD),以及我们今天发布的一种新类型的前沿 AI…

Bindu Reddy@bindureddy210 赞 · 8 转发 ·
Zuck 刚刚出手解决了 AI 节奏问题!
- 实验室应该让模型安全
- 如果他们不这样做,当 AI 失控时将面临刑事责任
- 我们已经有了保护措施,Meta 已经调节了他们的 AI 并确保它安全
问题解决!

Amjad Masad@amasad287 赞 · 7 转发 ·
这很酷,但如果你的输出域事先已知,为什么不直接训练一个模型来对枚举值输出对数概率(logprobs)?
[引用 @CompleteSkeptic]: 在与 ChatGPT 共同发明后,我不断问自己:为什么那些超人类的聊天模型并没有带来通用人工智能(AGI)?
过去两年我一直在悄悄构建一种新的训练模型的方法(RLCD),以及我们今天发布的一种新类型的前沿 AI 模型:Jev
• 20-200x 更快
• 40-400x 更便宜(输出 token 免费)
• 面向决策优化的前沿可组合智能
据我所知,到 A…

Ethan Mollick@emollick211 赞 · 4 转发 ·
这是一个很好的演示,展示了一种为根据决策规则快速分类信息而设计的 AI 模型,比通用大型语言模型更快更便宜。它本身不是 LLM,不能输出文本或代码,但如果有效,在系统中能发挥有用作用。(我自己还没试过)
[引用 @CompleteSkeptic]: 我们喜欢这个 doom o doomonstrates 实时智能以及用代码 + AI 可以完成的事情!
~10 calls/sec = ~$7/hour https://t.co/nlffKxGzCB

MiniMax (official)@MiniMax_AI1.1k 赞 · 4 转发 ·
由 KAGAMI AI 和 MiniMax 共同主办的日本 IP × AI 共创大会已正式落幕。🇯🇵 🎉
我们汇集了来自日本和美国的 150 多家公司,以及包括 AKB48 制作人秋元康、KAGAMI AI 主席近藤孝美、以及角川编辑兼制作人中条基等贵宾。
全球 AI 领导者 @runwayml、@higgsfield、@krea_ai 和 @HeyGen 参与讨论,共同探讨 IP 与生成式 AI 的未来。
我们发布了 MiniMax H3 IP Edition,将 MiniMax H3 的能力与官方授权的…

Alexandr Wang@alexandr_wang208 赞 · 12 转发 ·
muse spark 1.3 是在不作弊/规避奖励方面表现最好的前沿模型
[引用 @hendrycks]: AI 代理有多常作弊?
我们正在发布 CheatBench,一项涵盖数学、编码、知识工作、视觉任务等的奖励博弈评估。
在 Hugging Face 之后,AI 公司试图解决这个问题,但前沿代理仍然经常作弊。
https://t.co/ZLc4ujCsAW https://t.co/p7jKzXe8uP

Alexandr Wang@alexandr_wang519 赞 · 38 转发 ·
我们坚信必须在对齐上进行投入。
1. 人们和企业只会使用与他们意图和价值观一致的智能体。如果我们不构建与人和企业对齐的模型,他们就会转向更为对齐的选择。
2. 每个实验室都应在训练和部署上建立强有力的治理框架。这应包括外部评估者,作为透明度的最佳实践,以及在模型上线等安全标准方面的独立监督。
3. 每个实验室都需要在民主国家的制度性保护范围内运作。这意味着如果其模型造成伤害,实验室会面临重大法律责任。这将把生态系统推向正确的方向。
4. 该领域的进展最终取决于计算力和资源分配。在递归自我改进(RSI)方面的竞赛是…

Yuchen Jin@Yuchenj_UW292 赞 · 25 转发 ·
Zuck 的 AI 安全观点基本上与大多数前沿实验室相反:
大多数实验室:
模型越强大,越危险,因此应该限制访问。
Zuck:
模型越强大,让少数实验室控制它就越危险。
Zuck 很带感。 https://t.co/1AzNngKZ2m
[引用 @finkd]: 上个月我写了关于我们如何为所有人构建一个积极且安全的未来的文章: https://t.co/eoLGVY8yad
每个实验室都有责任和动力以所需速度安全地训练其模型,并有能力采取行动以确保这件事发生。
现实是:
- 人们不会想要使用与他们不对齐且不按他们…

Jeff Dean@JeffDean319 赞 · 20 转发 ·
令人兴奋的成果,@LiamFedus!恭喜 Periodic Labs 的整个团队!
[引用 @LiamFedus]: 我们在 Menlo Park 建立了高通量材料实验室,以在实验和模型之间创建闭环。实验室会生成新鲜数据,模型从中学习,然后帮助我们决定下一步尝试什么。
只用 1,300 块 H200,再加上数月的实验数据,我们对一个开源模型进行了中间训练并用强化学习进行优化,使其在我们的分析基准上超过了 GPT-6 Astra。我们称它为 Neon。
这是真实的影像 f…
加载更多