社区音量

全部内容 · 按时间倒序

AI 领域头部人物在 X 上的最新观点

hardmaru@hardmaru
205 赞 · 24 转发 ·
推出 Fugu Max 和 Fugu Ultra v2:编排帕累托前沿 过去十年,AI 行业一直在沿着单一轴优化:打造更大、更昂贵的模型。但智能从不是单一体。它是一个集体、分布式的系统。人类本身就是一种集体智能。 我们基于这一信念构建了 Sakana Fugu:最强大的 AI 系统不会是孤立的巨人,而是学会协同的生态系统。进化在约束下创新,未来属于那些不仅知道如何解决问题,还知道应部署哪些机制以实现最低成本的系统。 今天我们发布 Fugu Max 和 Fugu Ultra v2。 Fugu Max 将帕累托前沿向…
Alexandr Wang@alexandr_wang
231 赞 · 13 转发 ·
我们的 Muse 安全架构在何时让代理请求人工介入审批方面提供了大量控制。 更多请看大神 @bigT_sheesh 的说明: [引用 @bigT_sheesh]: 在我本周早些时候发布的关于 @Muse 安全架构的博文和视频(https://t.co/RPCWb6YsU7)中,我们提到了 Sentinel 和 Human-in-the-loop。 这不仅扩展到常规的网页请求和协议(HTTP/HTTPS),你实际上可以使用大量基于 TCP/UDP 的协议。 在这个页面查看它们(网页 https://t.co/kOY…
Elon Musk@elonmusk
1.5k 赞 · 283 转发 ·
Grok @Bot 对 SpaceX CFO 讲话的摘要 [引用 @cb_doge]: Grok Bot 对 SpaceX 财务总监 Bret Johnsen 在 Goldman Sachs Communacopia 今天的摘要。 垂直整合 垂直整合是公司的核心运营模式,不是一个旁支策略。 - 火箭:拥有金属 → 发动机 → 航电 → 软件 - Starlink:拥有发射、卫星和最终客户 - AI:自行建造设施和电力,运行自己的模型,向消费者和企业销售,并且 s…
宝玉@dotey
208 赞 · 26 转发 ·
Shopify 宣布:从 React Native 全面回归原生开发 Shopify 曾经是 React Native 铁杆支持者,2020 年,Shopify 选择“All-in”全面拥抱 React Native,实现了功能的“一次编写,多端运行”,而现在 Shopify 正在将旗下所有的移动端应用,从 React Native 彻底迁移回 Swift 和 Kotlin。 这个决定主要是由于 AI 在 Coding 能力的增强,现在的 Coding Agent 可以直接拿着 iOS 版本的代码写出对应的 An…
Greg Brockman@gdb
318 赞 · 21 转发 ·
Astra 用于抗体可开发性预测: [引用 @andrewaiginin]: GPT-6 Astra 在我们的基准测试中现在是预测抗体可开发性表现最好的前沿模型。🧬 找到能结合的抗体只是开始。它会聚集吗?它会保持稳定吗?它真的能像药物那样发挥作用吗? GPT-6 Astra 比我们测试的其他前沿模型更好地预测这些可开发性属性。🤯 是的,那个显示……的交互式可视化也在……
Tibo@thsottiaux
471 赞 · 21 转发 ·
你是发音为 data 还是 data?这就是每个人在 OpenAI 制作仪表板并了解业务的方式。离不开它。 [引用 @ChatGPT]: 现在每个人都可以让数据发挥作用。 我们在 ChatGPT Work 中引入了新的 Data agent,所以你只需提问就能把公司数据变成答案、交互式仪表板和行动。 只需在 ChatGPT Work 中添加 Data Plugin,连接你已经使用的数据源和上下文,然后开始对话。 https://t.co/EG1nQFZfEU
Nathan Lambert@natolambert
203 赞 · 10 转发 ·
对那些认为蒸馏主要是 SFT 的副产品,并且质疑在以 RL 为主导的时代它如何会变得越来越有影响力的人来说,这是一个重大胜利。 [引用 @xeophon]: 很高兴现在有更多关于蒸馏在哪里被使用、它意味着什么以及谁在在多大程度上做着什么的见解和透明度! 它也证实了一些人所怀疑的:一些 CN 实验室在生产环境中为 Claude 提供服务以获取数据。 https://t.co/yKHtvvyTyA
Sebastian Raschka@rasbt
407 赞 · 40 转发 ·
DeepSeek V4.1 大改,用了 encoder-decoder 结构。 老实说他们本该叫它 DeepSeek V5! 真是太酷、很有新意! https://t.co/r00s3Cl29m [引用 @deepseek_ai]: 🚀 介绍 DeepSeek-V4.1-Flash:更聪明、更快、更高效。 🔹 在我们新架构家族中引入了最小的模型,具有原生视觉理解能力。 🔹 设计用于更强的能力、更快的推理、更高的吞吐量,并可扩展到更大的模型。 1/6
Tibo@thsottiaux
1.2k 赞 · 46 转发 ·
你现在可以构建在我们向 10 亿用户发布到 ChatGPT 的同一语音系统之上。 完整双工系统配合可靠的工具调用,有很多有趣的应用。使用过后再回到仅文本体验,比我预期的要难。 [引用 @OpenAIDevs]: GPT-Live-1 现在可通过 API 使用。 把 ChatGPT 的自然往返对话带到你的应用中,使用能在说话时同时监听并配合你选择的模型和 harness 的语音代理。 https://t.co/gIl1gwsBDV
Anthropic@AnthropicAI
1.8k 赞 · 256 转发 ·
我们正在发布迄今为止最详尽的威胁情报报告。 报告涵盖了人们如何试图滥用 Claude——用于网络攻击、影响行动、监视、生物学以及制造武器——以及我们如何发现并阻止这些行为。 我们中断了报告中描述的每一次行动,并将从这些事件中得到的教训用来加强我们的防护措施。在合适的情况下,我们也将发现共享给了执法机构和其他 AI 公司。 这些案例并不典型:我们重点展示的是一些我们见过的最复杂的滥用实例。但它们尤其重要,因为它们向我们展示了 AI 滥用的发展方向、我们防护有效的地方以及需要改进的地方。 我们发布这份报告,是希望其他…
John Schulman@johnschulman2
329 赞 · 19 转发 ·
作为补充,极不可能对前沿模型在像数学这样的领域的提升有大量贡献的是基于用户数据的训练——这些提升来自于扩大规模的预训练和 RLVR。用户数据更可能用于发现失效模式或用雇佣的注释员难以重现的情形。 话虽如此,各模型公司在多大程度上用用户数据训练存在差异(上传代码库并非假设)。我希望能有更强的规范,要求披露公司如何用用户数据训练——用什么方法,以及为提升什么能力。 [引用 @johnschulman2]: 这并不是今天新闻中最显著的方面,但关于用户数据问题,存在不同种类的“用用户数据训练”,它们在隐私/知识产权方面的…