Tibo@thsottiaux
你是发音为 data 还是 data?这就是每个人在 OpenAI 制作仪表板并了解业务的方式。离不开它。 [引用 @ChatGPT]: 现在每个人都可以让数据发挥作用。 我们在 ChatGPT Work 中引入了新的 Data agent,所以你只需提问就能把公司数据变成答案、交互式仪表板和行动。 只需在 ChatGPT Work 中添加 Data Plugin,连接你已经使用的数据源和上下文,然后开始对话。 https://t.co/EG1nQFZfEU
AI 领域头部人物在 X 上的最新观点
你是发音为 data 还是 data?这就是每个人在 OpenAI 制作仪表板并了解业务的方式。离不开它。 [引用 @ChatGPT]: 现在每个人都可以让数据发挥作用。 我们在 ChatGPT Work 中引入了新的 Data agent,所以你只需提问就能把公司数据变成答案、交互式仪表板和行动。 只需在 ChatGPT Work 中添加 Data Plugin,连接你已经使用的数据源和上下文,然后开始对话。 https://t.co/EG1nQFZfEU
草莓那件事确实很有趣,但可能让人对 AI 在数学方面的发展方向产生了错误印象。 https://t.co/1euzSU8WRp [引用 @EpochAIResearch]: Every FrontierMath Tier 4 problem has now been solved by AI, with GPT-6 Astra solving the last problem standing. Mathematicians often commented that AI found unintended sho…
对那些认为蒸馏主要是 SFT 的副产品,并且质疑在以 RL 为主导的时代它如何会变得越来越有影响力的人来说,这是一个重大胜利。 [引用 @xeophon]: 很高兴现在有更多关于蒸馏在哪里被使用、它意味着什么以及谁在在多大程度上做着什么的见解和透明度! 它也证实了一些人所怀疑的:一些 CN 实验室在生产环境中为 Claude 提供服务以获取数据。 https://t.co/yKHtvvyTyA
在 API 中提供 GPT-Live,帮助开发者创建新型应用: [引用 @OpenAIDevs]: GPT-Live-1 现在在 API 中可用。 将 ChatGPT 自然的来回对话体验带入你的应用,使用在说话时也能听的语音代理,并与您选择的模型和工具协同工作。 https://t.co/gIl1gwsBDV
GPT-6 Astra Pro 面向临床医师: [引用 @thekaransinghal]: 经认证的美国临床医生今天可以通过 ChatGPT for Clinicians 免费获取 GPT-6 Astra (Pro) 访问权限。 注册: https://t.co/idNX1SK3Oh https://t.co/U38CdelgY9
补贴代币的时代正在结束。 请做好相应准备。 [引用 @thsottiaux]: 为了确保我们当前用户有卓越体验并能持续访问 Astra,我们将暂停订阅我们的 200 美元 Pro 计划。这些订阅对我们的系统造成最大压力,我们想采取对维持最广泛访问可能性的最小举措。其他所有计划和 api 仍然可用。 对现有账户没有影响,我们正在工…
在应用商店看到 muse 的评论让我很开心 💌 看到大家如何使用 muse 真是太棒了——我们的目标是让 AI 改善人们的生活! https://t.co/XGgSjpGrdN
DeepSeek V4.1 大改,用了 encoder-decoder 结构。 老实说他们本该叫它 DeepSeek V5! 真是太酷、很有新意! https://t.co/r00s3Cl29m [引用 @deepseek_ai]: 🚀 介绍 DeepSeek-V4.1-Flash:更聪明、更快、更高效。 🔹 在我们新架构家族中引入了最小的模型,具有原生视觉理解能力。 🔹 设计用于更强的能力、更快的推理、更高的吞吐量,并可扩展到更大的模型。 1/6
🦀🦀🦀 [引用 @perplexitydevs]: Perplexity 已加入 Rust Foundation。 我们相信支持构建可靠开源软件的人很重要。通过加入 Rust Foundation,我们的目标是改善人们和代理使用 Rust 构建的方式。 https://t.co/9ZDID7Q7gc
很好的示例,表明有趣的 LLM 工作可以在单个 GPU 上完成! [引用 @gpjt]: 我把 @rasbt 的 "Build a Large Language Model (from Scratch)" 中的 GPT-2 风格代码扩展成一个 6-expert(2 active)的专家混合模型,并从头训练了 8 天。效果很好!完整的数学和代码说明见 https://t.co/7YsQifjWDk
GPT‑Live‑1 在对生产语音代理最重要的基准测试上表现如何? 我们关注任务完成、来回对话与轮次控制、模型响应速度,以及工具使用。 结果在这里: https://t.co/OqBRTJHgHM
现已推出:ChatGPT for Financial Services。 这是一个定制的 ChatGPT Work 体验,将内置的金融数据与 GPT-6 Astra 的推理能力相结合。 团队可以开展研究、构建金融模型并创建定制的客户材料。 https://t.co/6WP5OJdnE8 https://t.co/AundGG3jtc
官宣了,暂停 200美元的 ChatGPT Pro 订阅…… [引用 @thsottiaux]: 为了确保我们当前用户有出色的体验并能持续访问 Astra,我们要暂停对我们 $200 Pro 计划的订阅。这些对我们的系统施加了最大的压力,我们希望采取最小的措施以便继续提供尽可能广泛的访问。所有其他计划和 api 仍然可用。 对现有账户没有影响,我们正在…
你现在可以构建在我们向 10 亿用户发布到 ChatGPT 的同一语音系统之上。 完整双工系统配合可靠的工具调用,有很多有趣的应用。使用过后再回到仅文本体验,比我预期的要难。 [引用 @OpenAIDevs]: GPT-Live-1 现在可通过 API 使用。 把 ChatGPT 的自然往返对话带到你的应用中,使用能在说话时同时监听并配合你选择的模型和 harness 的语音代理。 https://t.co/gIl1gwsBDV
最大化的 AGI 是能做所有人类能做之事的类人机器人。 [引用 @Biti8888]: 这是类人机器人很快变得有趣的部分。 @Figure_robot 已经让多台机器人在其圣何塞总部四处移动,而不是有人坐在那儿每一步都控制。 目标不仅仅是让机器人做演示。目标是让机器人能够在现实世界中独立操作。
我们正在发布迄今为止最详尽的威胁情报报告。 报告涵盖了人们如何试图滥用 Claude——用于网络攻击、影响行动、监视、生物学以及制造武器——以及我们如何发现并阻止这些行为。 我们中断了报告中描述的每一次行动,并将从这些事件中得到的教训用来加强我们的防护措施。在合适的情况下,我们也将发现共享给了执法机构和其他 AI 公司。 这些案例并不典型:我们重点展示的是一些我们见过的最复杂的滥用实例。但它们尤其重要,因为它们向我们展示了 AI 滥用的发展方向、我们防护有效的地方以及需要改进的地方。 我们发布这份报告,是希望其他…
作为补充,极不可能对前沿模型在像数学这样的领域的提升有大量贡献的是基于用户数据的训练——这些提升来自于扩大规模的预训练和 RLVR。用户数据更可能用于发现失效模式或用雇佣的注释员难以重现的情形。 话虽如此,各模型公司在多大程度上用用户数据训练存在差异(上传代码库并非假设)。我希望能有更强的规范,要求披露公司如何用用户数据训练——用什么方法,以及为提升什么能力。 [引用 @johnschulman2]: 这并不是今天新闻中最显著的方面,但关于用户数据问题,存在不同种类的“用用户数据训练”,它们在隐私/知识产权方面的…
简直太疯狂了! DeepSeek V4.1 Flash 的基准测试数据惊人 它为我们的个人代理提供动力,而且几乎是免费的 😲 让 AI 写邮件、研究主题,几乎替你完成所有工作,而无需付款
Deepseek Flash V4.1 已通过 Nous Portal 等在 Hermes Agent 中上线! https://t.co/Ur6YwsbhjD
很高兴在 @GoogleAIStudio 分享我们为人类和代理人打造的完全整合文档体验!! 我想要这个已经有2.5年了,抱歉花了这么久,但这是迈向更彻底重新构想体验的第一步。@timeyoutakeit 和团队干得很棒 https://t.co/fOGebHpdYG
你现在在数学中看到的,是不平滑前沿的结果,也是其他职业将出现情况的前兆。是的,数学家会做数学,但他们也有其他被视为重要的任务(指导学生、维护学术社区、保障领域的未来、培养对数学的热爱),这些是 AI 做不到的。 数学家似乎至少有一种担忧:通过专注于数学家所做工作中最耀眼、最明显的要素(做证明),AI 公司正在损害那些 AI 无法胜任的其他任务。AI 可以发现超越人类的证明,但这并不是数学职业的全部,而且实际上可能削弱并减少对数学家其他重要工作的关注。如果最具可见性的部分被取走,要向外界捍卫数学家所做的许多其它任务…
DeepSeek V4.1 Flash 在编码和代理基准上击败了 GPT-5.6 Sol,同时成本约低 ~97%。 每 token 的 KV 缓存大小又减少了 4×,这非常令人印象深刻。现在是开源 AI 的时代。 Databricks 很快会把它带给我们的客户! https://t.co/LDDNyrq6Kh
本月我们的重点是 QoL、错误修复、架构健壮性和打磨 [引用 @tonysimons_]: 🤣 Hermes Agent 刚刚让 Telegram 的设置变得几乎愚蠢地简单。 Hermes Desktop 现在内置了二维码快速设置。 打开 Messaging → Telegram。 扫描二维码。 Hermes 处理机器人配对,检测你的 Telegram 账号,填写允许列表,应用配置并重启网关。 就是这样。 又一个理由去直接用 HERMES! 🪽
对 Hermes Agent 中子代理可观测性和管理的重大升级 :) [引用 @NousResearch]: Hermes Agent 现在实时显示所有子代理活动的详细信息,你可以从 CLI 和桌面应用程序手动引导并停止它们。 https://t.co/GMAIML26Bu
几乎没有严肃的关于 AI 存在性风险的研究。为什么?也许这可以是第一步? [引用 @DFintelligence]: 我刚花了 2 小时审视关于 AI 导致人类灭绝风险的学术文献。除了几乎没有相关研究之外,几乎所有内容都指向书籍和小说,或是“回形针”式的捷径,这些主要是思维游戏,在现实生活中没有实际应用。 而且我读到的几乎没有一个情景是可信的……
True 😂 [引用 @yunta_tsai]: 如果你想解决 AI 对齐问题,就训练一个模型在没有踏板或方向盘的情况下把你从家带到办公室再带回去。你会非常快地解决它。
Grok @Bot [引用 @bot]: 最近对 Grok Bot 做了一些提升使用体验的改进。 你可以让你的 Bot 在内联起草消息,供你在发送前批准。 https://t.co/ws9CAMsEu5
我们需要在人工智能上增加 100 倍的透明度!!!
他们说 - GPT 3.0 不安全 - Kimi K3 根本不应该发布 - 开源 AI 应该被取消 - Fable 应该被禁止 - Astra 应该被禁止 AI 还没有杀过任何人,尚未入侵任何政府系统或发电厂,什么都没有发生! 这种末日宣传绝对荒谬
最近分享的 5 门来自 Stanford、CMU 和 MIT 三所大学的 AI 课程,我再整合分享一次,视频内容很多,可以先收藏慢慢学习 🔖 1. 斯坦福大学 CS329A Self-Improving AI Agents 人定义意图、Agent 执行的新软件工程 https://t.co/qkXLsdlDmT 2. 斯坦福大学 CS 329Z: Engineering AI Agents 从模型到系统:流水线 → 复合 AI → 自主 Agent https://t.co/q7whzZSWub 3. 斯坦福…