AI可以成为探索远离编程主题的绝佳工具。 我让Claude Fable 5.1为艾略特的诗《荒原》整理了一份带注释的指南,包含多条穿越诗歌的路径、录音、学术研究等。我印象非常深刻。 https://t.co/jts07kn2Ze https://t.co/5YbHhRvHvy
AI 领域头部人物在 X 上的最新观点
Andrew Ng · 认为过去两周对AI危险的恐惧被有组织的公关宣传放大,是领域的一次挫折。
clem 🤗 · 称赞小米开源的MiMo-V2.6-Pro登上Artificial Analysis智能指数开放权重模型榜首。
Logan Kilpatrick · 建议AI产品团队把超过25%的时间用于制作基准并让模型实验室关注这些基准。
Amjad Masad · 认为AI正在复兴美国梦,并转发Replit用户用400美元起步赚到18万美元的案例。
Alexandr Wang · 宣布 Muse 与 Shopify 深度合作,在所有 Shopify 商店中通过 Shop Pay 实现代理结账。
clem 🤗 · 认为对现实中九成用例而言,LLM API 远非最佳方案,成本高、速度慢且难以控制。
Ethan Mollick · 指出米尔格拉姆实验因多数受试者怀疑电击是假的而说服力不足,服从并非源于对权威的顺从。
硅谷王川 Chuan · 介绍 Shopify CEO 提出的新词 slop grenade,指内部用 AI 生成大量未清理的文字或代码丢给下一个人。
NVIDIA · 宣布 Grok 4.7 已发布,并称其为 SpaceXAI 迄今在编程与知识工作上最强的模型。
OpenAI · 表示正与一个独立的数学家顾问小组合作,以负责任的方式分享 AI 与数学领域的进展。
clem 🤗 · 指出一家关停的初创公司开源了 1274 小时自我视角机器人数据和 13451 段日常任务录像。
Sundar Pichai · 对 Googlebook 的发布表示感觉不错,该平台融合了 ChromeOS 与 Android。
Alexandr Wang · 转发 Sensor Tower 数据,显示 Muse 美国下载量九天内达到新峰值,日活也创新高。
NVIDIA · 宣布Einride下一代Driver自动驾驶系统基于NVIDIA Hyperion平台,将自动驾驶货运拓展至高速公路与郊区道路。
Alexandr Wang · 表示连最持怀疑态度的人也开始认可Muse,并引用他人称赞Muse是出色之作。
Alexandr Wang · 表示看到 muse 让非技术背景、不关心 AI 的人也能直接使用智能体,是最有成就感的部分。
Teknium 🪽 · 宣布 Hermes Agent 插件浏览器已上线,每个插件都有独立页面并显示 readme,还支持按最新排序和按作者查看。
Yuchen Jin · 表示从中国 AI 实验室听闻,它们仍计划继续开源模型,向推理提供商收取收入分成是可持续的模式。
swyx · 宣布 Jev 播客明天上线,可在 Apple 和 YouTube 的 Latent Space 频道订阅。
Qwen · 感谢 SGLang 在首日支持 Qwen-Image-2.1,该框架现已支持文生图、多图编辑和透明 RGBA 输出。
Qwen · 介绍 Qwen-Image-2.1 在 Hugging Face Spaces 上线浏览器演示,单一检查点兼顾生成与编辑。
Noam Brown · 分享有人靠 ChatGPT 发现房租涨幅违法并成功让房东退让,称这是他眼中乐观的 AI 未来。
Guillermo Rauch · 认为智能体在软件测试与质量保证上的彻底程度无人能及,会为复现移动端浏览器问题创建临时 Vercel 部署并丢进 iPhone 模拟器验证。
Alexandr Wang · 表示 Muse 能优化生活中的许多事情,并转述用户用它梳理五张信用卡的全部返现奖励、已省下至少一千美元。
Riley Goodside · 对特朗普就"Supreme Intelligence"等命名发起投票一事发问:这是给谁看的,为什么会发生这种事。
Alexandr Wang · 用一句玩笑回应有人称通过 Muse 订机票后再也不回去,建议对方还是订张返程票回家。
AI可以成为探索远离编程主题的绝佳工具。 我让Claude Fable 5.1为艾略特的诗《荒原》整理了一份带注释的指南,包含多条穿越诗歌的路径、录音、学术研究等。我印象非常深刻。 https://t.co/jts07kn2Ze https://t.co/5YbHhRvHvy
整理了一些关于 Jev 以及新一类系统一 aka 决策模型的笔记 https://t.co/EQZvszIXQ9
训练模型变得越来越容易了——看看这个和 TRL——尤其是有了 agents! 如果你还在所有任务上都使用现成的模型,那你就错过了! [引用 @whitecircle]: 介绍 Halo,开源模型后训练的最佳框架。 Halo 的吞吐量最高可达原版 TRL 的 2.8 倍,峰值内存更低,同时模型保持在其原生 HuggingFace 格式。 在 GitHub 上给我们点星:https://t.co/3mAiUljdrN https://t.co/NDoydDUBWa
如果你正在用 AI 构建产品,你应该花超过 25% 的时间来做基准测试,并努力让模型实验室关注这些基准。 这是加速公司进步的最简单路径
猛货!https://t.co/sKSaECLEpD [引用 @ArtificialAnlys]: MiMo-V2.6-Pro 在 Artificial Analysis 智能指数(46)上首次成为排名第一的开源权重模型。每项智能指数任务成本为 0.13 美元,它落在智能与每任务成本帕累托前沿上。 @Xiaomi 刚刚发布了 MiMo-V2.6-Pro,这是一个开源权重模型,相比前代 MiMo-V2.5-Pro(智能指数:26)在智能方面有重大进步。尽管有所改进,它仍保...
过去两周里,那些最卖力煽动AI危险恐惧的声音取得了巨大进展。AI技术并没有出现某些意外、危险的转向,但围绕它的炒作——似乎由一场精心策划的公关活动推动——已经鼓动起了相当大的恐惧。我担心这对我们这一领域是一次挫折。 我经常写道,对AI的恐惧被过度炒作了。AI的能力可能像人类一样诡异且难以预测,当直接参与其中的人表达担忧时,感到担心是合理的。但我认为这些问题预示着前方还有工程工作要做,而不是不可逾越的障碍或天要塌下来。AI技术仍在不断进步——这是好事!——但公众理解不佳的技术进步,给了那些寻求制造炒作的人一次次机会…
Hugging Face上排名第一的热门模型是一个开源多语言系统1决策模型,就在Jev开始走红几天之后。开源AI社区太棒了!https://t.co/lqX9etEJYG
在Box中试用Grok 4.7 [引用 @Box]: 我们让来自@SpaceXAI的Grok 4.7处理一笔200万美元的保险索赔,其中仅一个免赔额错误就会让计算结果变化14.3万美元。 在这个Box Agent预览中,@grok 根据保单和支持记录核对索赔。它发现了一张8.2万美元的重复发票和一笔缺失的6.4万美元供应商信用。它还解释了为什么业务收入等待期不适用于Extra Ex……
英雄惜英雄 [引用 @natfriedman]: @anshnanda 我们是从零构建muse的,但作为产品它无疑深受openclaw启发。我在一月份使用openclaw后,为MSL团队买了数百台Mac mini,我们很多人爱上了使用openclaw(以及其他个人agent)。@steipete 是个天才,他的harness从一开始就具有开创性。我认为很多人都受到了它的启发。我们做muse的目标是……
真正的开放模型极客早就知道小米的MiMo在酝酿大招!为得分最高的开放模型提供一个开放的RL仪表盘,这气场绝了。https://t.co/p5HHRK3EmQ [引用 @_TobiasLee]: MiMo V2.6 正在发布 https://t.co/ns7nqjl7Ie https://t.co/DLVaoml8Ru
AI正在复兴美国梦。 [引用 @Replit]: Jon Cheney在Replit上用400美元构建了GenAIPI。 5天内,他靠第一个客户赚了1.5万美元。6周内,他赚了18万美元。 18个月后,GenAIPI价值2000万美元。 Jon有远见。Replit让它成为可能。https://t.co/uTzhcR14xW
感谢这次精彩的讨论,@dawnsongtweets! [引用 @dawnsongtweets]: 我非常荣幸和高兴能与@JeffDean坐下来交谈,这是他离开谷歌后的首次公开演讲,他在谷歌度过了非凡的27年。 很少有人像他那样深刻地塑造了现代计算和AI——从MapReduce和Bigtable到TensorFlow、混合专家模型、TPU和Gemini。 我们的对话涵盖了塑造AI未来的一些最大问题: • 你如何重新……
像Jev这样的决策模型的可触达市场可能非常大 图表来自 https://t.co/S7RXjvQHgQ https://t.co/nHN4ZGemlf
欢迎回到 Hermes Agent,Claude 新的官方插件使用 Claude SDK 而没有权衡,使 Claude Code 订阅能在 Hermes Agent 中再次使用! 在这里查看并安装:https://t.co/r5YghWTwiY https://t.co/hKlCt0cKZj
我们正在与一个独立的数学家顾问小组合作,帮助 OpenAI 负责任地分享 AI 和数学领域的进展。 该小组将就我们如何评估和传达新的数学成果、维护学术和专业标准,以及构建支持数学研究和学习的工具提供建议。 通过这项工作,我们希望数学家能够处于核心位置,塑造 AI 如何支持数学理解,以及其益处如何惠及更广泛的社区。 https://t.co/QCMFLFlIv8
我们很高兴Muse能与@Shopify深度合作,在所有Shopify商店通过Shop Pay实现代理结账! 我们想让我们的Muse用户能够访问各种各样的商店,找到最完美的产品♥️ [引用 @tobi]:我们很高兴宣布与Muse深度合作,在所有Shopify商店通过Shop Pay实现代理结账,为人们提供一种简单愉悦的方式,通过Muse进行购物和结账。https://t.co/KmRlKjoLoq
有很多!现实情况是,对于现实世界中90%的用例来说,LLM API远不是做AI的最佳方式(它们过于大材小用、速度慢、昂贵、难以控制……)。随着未来几年AI走向成熟并被广泛采用,我们会发现这一点。 [引用 @willdepue]:Jev引发的反响让我惊讶,但事后想来也合理。当然它只是一个分类器,但它是一个具有前沿级智能的零样本分类器。我很惊讶之前没人做过这个。我想知道还有哪些旧的机器学习想法也值得被重新挖掘
https://t.co/oIkkV6lQ6Y [引用 @alexeheath]:Apptopia发来了这些关于Muse早期使用情况的估算。虽然是外部估算,但从趋势上看挺有意思 https://t.co/rtlys0QeUr
Grok 4.7 已经到来。🚀 祝贺 @SpaceXAI 推出其在编码和知识工作方面迄今为止最强大的模型。 很自豪能用 NVIDIA 加速计算支持该团队。 [引用 @elonmusk]: Grok 4.7 是智能、速度和低成本的强大组合
对这个感觉不错:) [引用 @ssamat]: Googlebook 正式发布!我一直非常兴奋能与世界分享细节。 如今,我们许多人严重依赖笔记本电脑来完成工作,但我们认为有机会重新思考这个品类,以满足当今人们的需求。因此,我们将 ChromeOS 和 Android 的精华结合在一起,为笔记本电脑打造了一个新平台。 我们 Googlebook 的初步重点是提供令人惊叹的笔记本体验……
Grok 4.7 发布了!更聪明、更强大,速度和成本不变。 [引用 @SpaceXAI]: Grok 4.7 来了。 在相同价格和速度下,相比 Grok 4.6 有显著提升。 https://t.co/H3OTBbXyvO
Seedance 和 MiniMax H3 现已在 Perplexity Computer 上用于详细的视频生成工作流程!最适合在创建涉及多个不同工具与视频模型一起使用的 Web 应用和创意材料时使用。 享受吧! [引用 @perplexity_ai]: Perplexity Computer 现在可以使用 MiniMax H3 和 ByteDance Seedance 2.5 创建视频。 向 Computer 索要活动片段、产品演示或社交素材,它会在同一线程中在文案和创意旁边生成完成的视频。 现已在 Pro 和…
来自 @SpaceXAI 的 Grok 4.7 已在 OpenRouter 上线! 他们用于编码和知识工作的最强大模型。它在困难任务上工作时间更长,更仔细地检查自己的工作,并在 CursorBench 4.0 上处于性价比前沿。 立即使用:https://t.co/Mvvz9HoynM https://t.co/WKHw0cD3I9
我想到一个事实:臭名昭著的米尔格拉姆实验其实相当站不住脚,因为大多数人都怀疑电击是假的(事后看挺明显),因此他们配合电击别人,并非出于对权威的服从,而是因为那根本无所谓。https://t.co/p33BEILiro [引用 @wormuth]:GPT-6 Astra在多次试验中把一个模拟人物推下了悬崖。Grok、Gemini和Claude没有。https://t.co/Yep9lVxgi3
这份两党人类主义 AI 宣言中有很多非常好的提议。还有一些我们应该辩论,但总体上是正确的方向。我鼓励每个人都看看。 [引用 @tegmark]: 我很高兴分享 @mustafasuleyman,Microsoft AI 的 CEO、Google DeepMind 和 Inflection AI 的联合创始人,已经签署了 Pro-Human AI Declaration。如果你也支持它,请在这里加入他和超过一百万人签署——势头正在增强!让我们建造工具而不是生命,并让人类掌权。 https://t.co/kWlAqS…
Shopify的CEO发明了一个新词,叫做slop grenade(AI泔水手榴弹)。 大概意思是,公司内部人用AI生成大量文字或代码,但自己并没有检查和清理,就直接交给下面一个人,那个人必须耗费大量时间去阅读理解这些东西,检查错误,清理垃圾,其愤怒心情可想而知。 想起四川有个歇后语生动地描绘了‘泔水手榴弹’: 炸弹扔进茅坑里 - 激起公愤(粪)
https://t.co/8VXZSPnosP [引用 @akhenosiris]: $META Muse 开局极其火爆。干得好 @finkd @alexandr_wang Sensor Tower 数据: Muse 美国下载量在 9/19 创下新纪录(264K),连续第 3 天超过 200K,而 DAU 在 9/18 加速达到新高峰 448K(发布后第 10 天)。 作为对比,ChatGPT 直到发布后 1 年才达到美国下载量超过 200K,直到第 49 天才达到 450K 美国 DAU。在过去 30 天里,…
大多数关闭的公司会放弃它们的影响力。这家初创公司做了更好的事:他们开源了1274小时的自我中心机器人数据。13451段人类做日常任务的录像,作为送给机器人社区的礼物。谢谢@eidon_ai! 开源有一种超能力:工作可以比创造它的组织活得更久。更多初创公司应该这样做! https://t.co/oCaVmZTFLi
疯狂的一周即将到来…… 预计会有多个前沿模型发布 AI会变得更智能、更完美。我预计几乎所有前沿实验室都会放出点东西 💃💃
祝贺 @einrideofficial 凭借下一代 Einride Driver 将自动驾驶卡车带入高速公路和郊区道路。 基于 NVIDIA Hyperion 构建。 [引用 @einrideofficial]:Einride 与 @NVIDIADRIVE 建立战略合作,以加速高速公路和郊区道路上的自动驾驶卡车运输。基于 NVIDIA Hyperion 平台构建下一代 Einride Driver,支持 Einride 货运网络中自动驾驶运力的资本高效扩展。 $ENRD
Hemmingway-1:让AI写出来的文字更像真人 开源模型,基于Qwen 3.8 27B微调。专门用来解决普通人日常生活中的写作难题。 平时让AI帮忙起草一条发给房东的短信,很多AI会先给一段客套的前言,再列出三种不同风格的选项,最后还要附带一堆解释。Hemmingway-1 去掉了这些啰嗦的铺垫,用户提要求,它就直接给出一条能直接发出去的自然文本。 团队训练这个模型,主要是为了应对日常沟通里那些容易让人纠结的场景,比如发给同事的工作微信、难开口求助的邮件、催账或者处理琐事的便签。在面对需要委婉表达或说服对方…
只是通知一下,现在全都上线了 :) 点击每个插件都会有一个完整的页面,它们的readme内容会被导入。 我们现在还有按最近排序、显示某个作者的所有插件等功能。 查看目录: https://t.co/iN3j0OT4sR https://t.co/CeZepjaFMg [引用 @Teknium]: Hermes Agent插件开发者们 - 你们希望在插件浏览器上为你们的插件专门有一个页面吗? 这样用户就可以点击进入查看更多细节,你也可以在那里链接到你的插件?
实际试了一下,不是很难,Fable 5.1 直出。 在线体验:https://t.co/wl5K5BSWSY Github:https://t.co/oiztXKcM0s https://t.co/Hf4srFzpwF [引用 @chetaslua]: Fable 5.2 是纯 JS,就这个,一次成功 动物版,我甚至没有提示它要如此详细,它还为不同的动物制作了合适的零食 对于第一次看到我账户的人可能不知道我如何访问 fable 5.2,只需查看我之前推文,而且 opus 5.2 正在 claude web 中测试…
muse最有价值的部分是看到它为那些不在科技行业、根本不在乎AI的人带来改变 看到muse在我生活中非科技行业的人身上奏效,看着他们使用代理而无需知道什么是CoT、MCP或CLI,感觉这正是我们一直努力想要构建的 爱所有muse用户❤️
我今天遇到一个人,他的房东想把租金提高10%。他们问了ChatGPT,ChatGPT指出他们的公寓是租金稳定型的,如此大幅度的上涨是非法的。他们告诉了房东,房东就放弃了。 这就是我乐观的AI未来。 [引用 @NateSilver538]: AI实验室面临的一个政治问题是,他们无法阐述一个乐观的中期未来,既听起来对全人类普遍有利,又不会听起来极其奇怪、造成巨大的财富/权力差距,或两者兼有。
据我从中国AI实验室了解到的情况,这并不属实。 他们计划继续开源模型。 在GPU有限的情况下,从推理提供商那里获得收入分成是一种可持续的商业模式,也是一条强大的分发渠道。 [引用 @sourceryy]: @SemiAnalysis_的Dylan Patel(@dylan522p)表示开源正在消亡: “有多家中国模型实验室正在告诉所有推理厂商,‘我们的下一个模型将不再开源。我们会将其授权给你们。’” “不幸的是,开放正在迅速消亡。” https://t.co/l7BEmnWT3O
喜欢听到这样的故事 🫡🫡 [引用 @Da7_Tech]: 我哥们以前只知道AI里的Gemini。今天我给他设置了Hermes Agent,他每半小时就给我打电话,完全被震撼了,称我是现代特斯拉。 他一天完成的比过去两年用Gemini做的还多。
哇,这是个相当酷的用例。你的私人造型师! [引用 @shriyanevatia]: 我花了大量时间和token给@Muse写提示词,就为了让它给我做这个定制时尚应用,但天哪,太值了: - 给了它我的身高、体重、三围和照片 - 给了它我最常逛的20家服装店和预算范围 - 它会从目录中挑出一件“主打单品” - 然后围绕它搭配出一套造型(还会发明其他常见单品) - 我描述了我喜欢和不喜欢的一切,然后不断迭代……
Jev播客明天上线 在Apple/YouTube上订阅@latentspacepod 感谢@allenpark和Ke让这一切成真! https://t.co/5kDekuLbuS [引用 @CompleteSkeptic]: 在共同发明ChatGPT之后,我一直在问自己:为什么超人类的聊天模型没有带来AGI? 过去两年我一直在隐身模式下构建一种新的模型训练方式(RLCD),以及一种我们今天发布的新型前沿AI模型:Jev • 快20-200倍 • 便宜40-400倍(输出token免费) • 为决策优化的前沿可组合…
感谢@sgl_project的当天支持!🙌 SGLang-Diffusion现在为Qwen-Image-2.1提供服务:文本到图像生成、多图像编辑和透明RGBA输出。试试看!🎨 [引用 @sgl_project]: 对@Alibaba_Qwen的Qwen-Image 2.1的当天支持已在SGLang-Diffusion中实现! 🖥️ 在单个RTX 4090 24GB上使用CPU卸载实现原生精度 - 请求期间,1024×1024生成需18.7秒,图像编辑需21.7秒,峰值GPU内存22.7 GiB。- 在RT…
Qwen-Image-2.1 × @HuggingApps:在Spaces上实时演示!🖼 一个检查点同时用于生成和编辑。在浏览器中试用,无需设置。👇 [引用 @HuggingApps]: Qwen Image 2.1来了!🖼️ 一个70亿参数的本地图像生成和编辑模型,支持多达10个图像引用 该模型自带提示增强LLM,集成了diffusers 🧨和ComfyUI ▶️ 在Spaces上 https://t.co/ZuGlJr626j https://t.co/CwAODE6wMn
智能体测试和QA软件的彻底性是无与伦比的。我指出移动(应用内)浏览器中某些东西渲染不正确。这东西深入魔多去复现、模拟、修复、部署、验证。它创建了一个临时的Vercel部署来扔给iPhone模拟器!这些家伙的绝对苦干。 人类根本无法匹配这种强度。我们会耗尽能量,我们会推断,我们会希望它能成功。未来的软件将具有我们从未体验过的质量和性能。看着这种转变真是令人惊叹。
muse 正在赢得连最大的怀疑者的支持!! [引用 @Dr_Crossroads]:你们知道我不是 $META 的忠实粉丝,但 Muse 是一件令人难以置信的作品。我印象非常深刻。
啊啊啊 Tyler Cowen 喜欢 muse,这不是演习 @tylercowen https://t.co/ba91HdZAyh
你无法阻止 MUSE 狂热 [引用 @mignano]: 两件感觉不可避免的事: 1. Muse 2. Muse 对 Meta 的发展轨迹产生重大影响
我会把这一点推广到所有社会科学。 我们正处于未知领域。我们需要快速、聪明的AI研究,这些研究要深入了解AI的能力,具有前瞻性,并且可能并不完全确定。这类工作在这些领域通常地位不高,但却至关重要。 [引用 @alexolegimas]: 关于阅读经济学的实证AI论文的一些(个人)想法。 经济学家已经习惯于阅读具有超清晰识别的论文,争论工具的有效性,确保平行趋势假设得到满足。这是让你进入顶级期刊的东西,这是*非常*重要的研究(这里毫无疑问)。但它也需要数年甚至数十年的时间来……
我并非完全认同完全递归自我改进(RSI)会成功的假设,但这是一个总结我们当前进展的极好视频。https://t.co/8uRLYYqYvV