Aravind Srinivas@AravSrinivas
🦀🦀🦀 [引用 @perplexitydevs]: Perplexity 已加入 Rust Foundation。 我们相信支持构建可靠开源软件的人很重要。通过加入 Rust Foundation,我们的目标是改善人们和代理使用 Rust 构建的方式。 https://t.co/9ZDID7Q7gc
AI 领域头部人物在 X 上的最新观点
🦀🦀🦀 [引用 @perplexitydevs]: Perplexity 已加入 Rust Foundation。 我们相信支持构建可靠开源软件的人很重要。通过加入 Rust Foundation,我们的目标是改善人们和代理使用 Rust 构建的方式。 https://t.co/9ZDID7Q7gc
很好的示例,表明有趣的 LLM 工作可以在单个 GPU 上完成! [引用 @gpjt]: 我把 @rasbt 的 "Build a Large Language Model (from Scratch)" 中的 GPT-2 风格代码扩展成一个 6-expert(2 active)的专家混合模型,并从头训练了 8 天。效果很好!完整的数学和代码说明见 https://t.co/7YsQifjWDk
GPT‑Live‑1 在对生产语音代理最重要的基准测试上表现如何? 我们关注任务完成、来回对话与轮次控制、模型响应速度,以及工具使用。 结果在这里: https://t.co/OqBRTJHgHM
现已推出:ChatGPT for Financial Services。 这是一个定制的 ChatGPT Work 体验,将内置的金融数据与 GPT-6 Astra 的推理能力相结合。 团队可以开展研究、构建金融模型并创建定制的客户材料。 https://t.co/6WP5OJdnE8 https://t.co/AundGG3jtc
官宣了,暂停 200美元的 ChatGPT Pro 订阅…… [引用 @thsottiaux]: 为了确保我们当前用户有出色的体验并能持续访问 Astra,我们要暂停对我们 $200 Pro 计划的订阅。这些对我们的系统施加了最大的压力,我们希望采取最小的措施以便继续提供尽可能广泛的访问。所有其他计划和 api 仍然可用。 对现有账户没有影响,我们正在…
你现在可以构建在我们向 10 亿用户发布到 ChatGPT 的同一语音系统之上。 完整双工系统配合可靠的工具调用,有很多有趣的应用。使用过后再回到仅文本体验,比我预期的要难。 [引用 @OpenAIDevs]: GPT-Live-1 现在可通过 API 使用。 把 ChatGPT 的自然往返对话带到你的应用中,使用能在说话时同时监听并配合你选择的模型和 harness 的语音代理。 https://t.co/gIl1gwsBDV
最大化的 AGI 是能做所有人类能做之事的类人机器人。 [引用 @Biti8888]: 这是类人机器人很快变得有趣的部分。 @Figure_robot 已经让多台机器人在其圣何塞总部四处移动,而不是有人坐在那儿每一步都控制。 目标不仅仅是让机器人做演示。目标是让机器人能够在现实世界中独立操作。
我们正在发布迄今为止最详尽的威胁情报报告。 报告涵盖了人们如何试图滥用 Claude——用于网络攻击、影响行动、监视、生物学以及制造武器——以及我们如何发现并阻止这些行为。 我们中断了报告中描述的每一次行动,并将从这些事件中得到的教训用来加强我们的防护措施。在合适的情况下,我们也将发现共享给了执法机构和其他 AI 公司。 这些案例并不典型:我们重点展示的是一些我们见过的最复杂的滥用实例。但它们尤其重要,因为它们向我们展示了 AI 滥用的发展方向、我们防护有效的地方以及需要改进的地方。 我们发布这份报告,是希望其他…
作为补充,极不可能对前沿模型在像数学这样的领域的提升有大量贡献的是基于用户数据的训练——这些提升来自于扩大规模的预训练和 RLVR。用户数据更可能用于发现失效模式或用雇佣的注释员难以重现的情形。 话虽如此,各模型公司在多大程度上用用户数据训练存在差异(上传代码库并非假设)。我希望能有更强的规范,要求披露公司如何用用户数据训练——用什么方法,以及为提升什么能力。 [引用 @johnschulman2]: 这并不是今天新闻中最显著的方面,但关于用户数据问题,存在不同种类的“用用户数据训练”,它们在隐私/知识产权方面的…
简直太疯狂了! DeepSeek V4.1 Flash 的基准测试数据惊人 它为我们的个人代理提供动力,而且几乎是免费的 😲 让 AI 写邮件、研究主题,几乎替你完成所有工作,而无需付款
Deepseek Flash V4.1 已通过 Nous Portal 等在 Hermes Agent 中上线! https://t.co/Ur6YwsbhjD
很高兴在 @GoogleAIStudio 分享我们为人类和代理人打造的完全整合文档体验!! 我想要这个已经有2.5年了,抱歉花了这么久,但这是迈向更彻底重新构想体验的第一步。@timeyoutakeit 和团队干得很棒 https://t.co/fOGebHpdYG
你现在在数学中看到的,是不平滑前沿的结果,也是其他职业将出现情况的前兆。是的,数学家会做数学,但他们也有其他被视为重要的任务(指导学生、维护学术社区、保障领域的未来、培养对数学的热爱),这些是 AI 做不到的。 数学家似乎至少有一种担忧:通过专注于数学家所做工作中最耀眼、最明显的要素(做证明),AI 公司正在损害那些 AI 无法胜任的其他任务。AI 可以发现超越人类的证明,但这并不是数学职业的全部,而且实际上可能削弱并减少对数学家其他重要工作的关注。如果最具可见性的部分被取走,要向外界捍卫数学家所做的许多其它任务…
DeepSeek V4.1 Flash 在编码和代理基准上击败了 GPT-5.6 Sol,同时成本约低 ~97%。 每 token 的 KV 缓存大小又减少了 4×,这非常令人印象深刻。现在是开源 AI 的时代。 Databricks 很快会把它带给我们的客户! https://t.co/LDDNyrq6Kh
本月我们的重点是 QoL、错误修复、架构健壮性和打磨 [引用 @tonysimons_]: 🤣 Hermes Agent 刚刚让 Telegram 的设置变得几乎愚蠢地简单。 Hermes Desktop 现在内置了二维码快速设置。 打开 Messaging → Telegram。 扫描二维码。 Hermes 处理机器人配对,检测你的 Telegram 账号,填写允许列表,应用配置并重启网关。 就是这样。 又一个理由去直接用 HERMES! 🪽
对 Hermes Agent 中子代理可观测性和管理的重大升级 :) [引用 @NousResearch]: Hermes Agent 现在实时显示所有子代理活动的详细信息,你可以从 CLI 和桌面应用程序手动引导并停止它们。 https://t.co/GMAIML26Bu
几乎没有严肃的关于 AI 存在性风险的研究。为什么?也许这可以是第一步? [引用 @DFintelligence]: 我刚花了 2 小时审视关于 AI 导致人类灭绝风险的学术文献。除了几乎没有相关研究之外,几乎所有内容都指向书籍和小说,或是“回形针”式的捷径,这些主要是思维游戏,在现实生活中没有实际应用。 而且我读到的几乎没有一个情景是可信的……
True 😂 [引用 @yunta_tsai]: 如果你想解决 AI 对齐问题,就训练一个模型在没有踏板或方向盘的情况下把你从家带到办公室再带回去。你会非常快地解决它。
Grok @Bot [引用 @bot]: 最近对 Grok Bot 做了一些提升使用体验的改进。 你可以让你的 Bot 在内联起草消息,供你在发送前批准。 https://t.co/ws9CAMsEu5
我们需要在人工智能上增加 100 倍的透明度!!!
他们说 - GPT 3.0 不安全 - Kimi K3 根本不应该发布 - 开源 AI 应该被取消 - Fable 应该被禁止 - Astra 应该被禁止 AI 还没有杀过任何人,尚未入侵任何政府系统或发电厂,什么都没有发生! 这种末日宣传绝对荒谬
最近分享的 5 门来自 Stanford、CMU 和 MIT 三所大学的 AI 课程,我再整合分享一次,视频内容很多,可以先收藏慢慢学习 🔖 1. 斯坦福大学 CS329A Self-Improving AI Agents 人定义意图、Agent 执行的新软件工程 https://t.co/qkXLsdlDmT 2. 斯坦福大学 CS 329Z: Engineering AI Agents 从模型到系统:流水线 → 复合 AI → 自主 Agent https://t.co/q7whzZSWub 3. 斯坦福…
关于 AI 的所有危言耸听已经进入主流了 普通人现在把大型语言模型当成某种黑魔法 😲 它们不可能摧毁整个文明,而且如果发生什么不好的事,你实际上可以拔掉电源
🚀 AuK 正式推出。音频领域的 Nano banana🍌 一个用于统一语音生成与编辑的开源基础模型。 自然语言指令 + 参考音频。一个接口。 零样本 TTS。指令控制生成。内容编辑。Whisper-conversion。去口音。音色/风格/情感编辑。速度/音高控制。增强、去噪、多说话人和音乐分离。 同时发布 AuK-Flash:4 步推理。在匹配条件下约快 ~4.5×。 代码、权重和演示已上线。试用并分享你的反馈。 🤗 Paper & upvote: https://t.co/zEveUsuJRF ⭐ G…
你现在可以从私有仓库在 Hermes Agent 中安装插件了! 它现在会使用你存储的 GitHub 凭证。 https://t.co/S4CxeeejZr
Moonshot 这家公司总是会给国内其他的那些做题家老头乐大模型公司时不时地来一点人文震撼 [引用 @Zachary_haha]: 说实话,看到Kimi这个项目里的描述,我真的想哭。真得自发宣传一下🥹🥹 连续创业,公司关停,屡败屡战 不擅言辞,不喜社交,靠作品说话 长期在海外漂泊,一直有稀奇古怪的想法 我仿佛看到了我自己。 https://t.co/6jJ37pxs5K
哇! [引用 @deepseek_ai]: 🚀 推出 DeepSeek-V4.1-Flash:更智能、更快速、更高效。 🔹 推出我们新架构家族中最小的模型,具有原生视觉理解能力。 🔹 旨在提高能力、更快的推理、更高的吞吐量,并能扩展到更大的模型。 1/6
真的很离谱,这个人之前在 OpenAI,后来去 Anthropic 上班,上了三个星期还是六个星期就离职了。 然后输出了一堆 AI 末日论的信息,全是观点,没有事实。 1.3 亿的曝光,很难想象大家为什么都很相信这个东西 [引用 @hilbertspaess]: 我今天从 Anthropic 辞职了。过去三年我在 OpenAI 和 Anthropic 从事预训练研究。两家公司都没有负责任地行事。他们正直奔着自我改进的超级智能狂奔,并拿我们的生命做赌博。以下是更多想法。
希望你喜欢! [引用 @natfriedman]: 本周开始在 Meta 工作。我的工作是打造让数十亿人喜爱使用的出色 AI 产品。 这不会一夜之间发生,但工作几天后,我对前方会有伟大事物感到很有信心。
我们刚刚重置了每个人的 muse 令牌使用量。 尽情享用!!! https://t.co/Kgfr9sCVvn