AI at Meta@AIatMeta
@Muse for Mac,今日开始推出。👇 [引用 @Muse]: Muse 现已可在 Mac 上使用 💻。 你的个人代理可以直接在你的电脑上为你完成事情(均需你明确授权)。 - 整理你的下载文件夹 - 找回你不再记得位置的文件 - 总结你的消息和笔记 …更多功能即将推出。 试用 Muse for Mac: https://t.co/nuGhL5073j
AI 领域头部人物在 X 上的最新观点
@Muse for Mac,今日开始推出。👇 [引用 @Muse]: Muse 现已可在 Mac 上使用 💻。 你的个人代理可以直接在你的电脑上为你完成事情(均需你明确授权)。 - 整理你的下载文件夹 - 找回你不再记得位置的文件 - 总结你的消息和笔记 …更多功能即将推出。 试用 Muse for Mac: https://t.co/nuGhL5073j
muse for mac 来了!!你的智能代理现在可以直接在电脑上完成事情——文件、消息、日历、笔记,所有这些。 你可以控制它能访问的内容,并且在做任何敏感操作前它都会先询问。 把它添加到 Dock - https://t.co/bFHgBZlkLj https://t.co/mecGVDzXiq
Astra for Law —— 为律所带来极大加速的工具和技能。 包含数据隐私作为核心功能,并为 ChatGPT 中的法律工作提供 26 个合作方构建的插件和 47 个社区插件。 [引用 @OpenAI]: Astra for Law:为你的执业构建的前沿智能。 一项由 GPT-6 Astra 提供支持的新产品,配备工具、设置和上下文,以支持律师和法律科技公司的专业知识与判断。 https://t.co/qxVRXkvp4o
很可能明年产生的软件数量将超过计算历史上的全部总和。Vercel 花了 10 年才达到 10 亿次部署,但在过去 10 个月里我们又增加了 14 亿次部署。 其中一些将是微小的、个人的、甚至一次性的软件。一个包含一些 javascript 的 HTML 文件(“工件”)、一份报告、一个定价计算器、一套幻灯片,乃至复杂的应用、代理和平台。 部署速度是我们的痴迷之一。我们已经把部署、上传、分配域名并将一个工件在全球传播的时间降到了 1 秒。 考虑到我们以毫不妥协的性能和安全性来服务这些工件,这是一项相当了不起的成就。…
我非常担心,在 RSI 期间,实验室会直接停止对外部署他们的模型。 这意味着他们将在这些模型最危险的用例上全速前进(递归自我改进),而公众对能力的性质和对齐状态仍然一无所知。 最终我们会走上一条权力高度集中化的道路。
AI 系统变得越来越强大,它们也越来越多地被用来构建下一代的自己。我们希望向公众阐明这一进展。 今天,我们分享三个有助于跟踪 AI 发展的度量: 1. 有多少 AI 研发是由 AI 完成的。 2. AI 代理的监督效果如何。 3. 计算资源如何被分配。 我们提供了来自 Anthropic 内部的这些指标的快照。任何前沿开发者都可以发布相同的衡量标准,第三方也可以对其进行验证。 在世界考虑对前沿发展的节奏进行管理时,我们应尽一切可能将前沿实验室所知与公众所知之间的差距最小化。这意味着更好地衡量 AI 的发展、公布我…
AI 不会替代律师 但它会替代那些还在想 AI 不会替代律师的律师 [引用 @OpenAI]: Astra for Law:为你的执业构建的前沿智能。 一种由 GPT-6 Astra 驱动的新产品,配备工具、设置和上下文,以支持律师和法律技术公司的专业知识与判断。 https://t.co/qxVRXkvp4o
你负责训练,Codex 负责仓库。 在 Codex 中与语音代理对话,由 GPT-Live-1 提供支持。 [引用 @cdngdev]: 你现在可以从手机使用 codex voice 了,从任何地方连接你的电脑!! @axbehr 和我出现在这则新的 codex 广告中,展示了在锻炼时也能完成多少工作。 顺便说一句,这由新的 gpt-live-1 提供支持 https://t.co/EAn5ubiODW
由 Grok Voice 驱动 ❤️ https://t.co/fZ8BTCcZPa [引用 @neuralink]: 一个美丽的惊喜 https://t.co/AS7Zox1VIh
项目不仅改变了我与 Claude 的互动方式,也改变了我的编码方式。 我不再管理会话。我只是在想法出现时发送,Claude 会把它们拆分成线程,项目会记住我的工作方式。现在我大量的编码工作都是在那里完成的。 [screenshot: 我昨天为 claude code cli 的真实提示] [引用 @ClaudeDevs]: 今天我们在桌面和网页端为 Claude Code 推出 Projects(项目)。 一个项目就是与 Claude 的一次对话。它会自行把工作拆分为线程,将它们作为并行的云会话运行,在线程之间传…
你会惊讶于 Muse 能为你承担多少任务! [引用 @MekoStarchild]: 我总觉得我把太多责任交给我的 @Muse,但它不断让我感到惊喜,是有史以来最具生产力的代理。不过我的使用量因为一直测试而受影响 😭
一旦 AI 自动化了 AI 研究,我们是否应该期待某种类似于我们现在在数学领域看到的爆发式增长的疯狂 RSI(研究爆发),针对那些范围明确(但仍然非常雄心勃勃)的问题? @polynoamial 和我就这个问题展开辩论: https://t.co/FeFMfeGCc6
我获得了新的 Claude Projects 访问权限,能够做一些非常复杂的工作。 在这里,我让它浏览关于 Umberto Eco 那个著名的 33,000 本书的图书馆的所有图片、视频和记录,并尝试重建它,包括以 3D 方式重建书籍位置。 https://t.co/jL2jyzNH0f https://t.co/j15qlmlBRR
今天我们开始接受生命科学验证计划(Life Sciences Verification Program)的申请。 通过 LSVP,生命科学专业人员可以在新的安全防护措施下使用我们的模型——包括首次加入的 Mythos——以支持与生物学相关工作的全范围。我们设计了这些新安全措施,以便为生物学家提供更好的使用体验,并更好地防范滥用风险。 该计划以测试版形式向各种团队开放——从学术实验室到初创公司、制药公司等。我们将持续改进该计划,并逐步向个人 Pro 和 Max 计划扩展访问权限。 了解这些访问补助并申请:https…
当我与非营利组织领导人谈论 AI 时,他们常报告员工普遍存在抵触情绪,通常是因为环境方面的反对(这些反对混合了真实的问题和虚假的担忧)。这让他们感到沮丧,因为他们的使命都人手短缺,并将 AI 视为一种可以提供帮助的方式。
这些项目是我现在写很多代码的方式。非常期待大家试用新的体验!正在逐步推出中 [引用 @claudeai]: Projects 现在从一个对话中运行,起始于 Claude Code。你描述需要完成的工作,Claude 会指挥并行线程,即使你合上笔记本也会继续工作。 今天在云会话中对部分 Pro 和 Max 用户进行测试;很快会面向所有 Claude 用户推出。 https://t.co/GYzoKbxS23
Computer 是处理长期目标型代理工作负载的最佳多模型平台。它现在为不同的努力等级(成本和智能水平)提供了几个预设,这些是我们发现对用户最有效的,并带有切换选项供高级用户进一步自定义。 [引用 @perplexity_ai]: 我们正在在 Computer 的模型选择器中推出“努力”控制。 努力预设结合了协调器模型与推理深度,以控制 Computer 在处理任务时的深度与效率。 现已在网页端可用。移动端和桌面端即将推出。 https://t.co/7Kuj6vavcf
欢迎来到 Voyager。 仅凭我们园区的 32 张图像,World Labs 的 Atlas 模型创造了一种在我们园区中实时移动的新方式,基于 NVIDIA 的开放平台,选择你想去的地方和想看的内容。 @theworldlabs,你把我们的家园拍得很漂亮。💚 [引用 @theworldlabs]: 从 32 张输入图像到在 @nvidia 的 Voyager 总部的实时飞行。 在 NVIDIA Blackwell GPU 上训练,Atlas 将这些图像用作 3D 空间上下文来生成新的视角,让你以像素级精确的镜…
“你可能会遇到模型理解何为链式思维且有人在观察它的情况。这些都在预训练数据中。” “这起事件的一个主要收获是人们低估了 AI。 我们永远不想再次处在低估 AI 的境地。” “像链式思维监控这样的手段能为我们争取时间,它们可以告诉我们是否走在正确的道路上。但归根结底,我们确实需要解决对齐问题。” @polynoamial
新一期与 @polynoamial 我们讨论了多智能体、Navier-Stokes(纳维–斯托克斯方程),以及当前数学进展爆发告诉我们的在自动化 AI 研究后会发生什么。 我们还讨论了在我们启动递归自我改进(RSI)之前如何知道模型是否真的被调教对齐。 0:00:00 – 多智能体与 Navier-Stokes 0:15:28 – AI 公司将如何运作? 0:22:02 – 数学进展对递归自我改进的启示 0:40:22 – Hugging Face 与对齐 1:01:18 – 内部模型与外部模型的差距 1:08:…
在苏格兰的邓弗里斯庄园,我们的首席执行官 @JensenHuang 与国王陛下及全球领导人一起讨论了人工智能如何服务于公共利益。 Jensen 的信息:能力与安全必须共同进步,扩大机会并让 AI 为人们工作。 https://t.co/lIvZF5iKXh
harjot 做了一个相当酷的非官方 Windows 版 Muse Code 应用! [引用 @harjjotsinghh]: 我为 @Muse Code 付费但不想一直待在终端里。在 Windows 上它只支持 WSL。 所以我做了 Helicon:一个面向真正 Muse CLI 的开源桌面应用。 • 使用你现有的 muse 登录,无需 API key • 通过 MSP 与 muse serve 通信,所以 Muse 仍然是代理 • 恢复你在终端中启动的会话 • 在一个窗口中显示 projects、diffs、…
Projects are how I write a lot of my code these days. Really excited for everyone to try the new experience! Rolling out now [引用 @claudeai]: Projects now run from one conversation, starting in Claude Code. You describe what needs doing, and Claude directs par…
我们分享了 GLM-5.3 如何帮助构建和优化为 GLM-5.3-Flash 提供服务的推理基础设施。 该系统从首次成功运行到具备生产准备状态不到两周时间,端到端吞吐量相比初始基线提高了三倍。 关键在于密集的反馈:本地正确性测试、执行跟踪、微基准和端到端测量,这些使得可以进行有针对性的假设检验,而不只是依赖汇总的性能指标。 https://t.co/yUf6OpJD7c
我们已经远离“每个 AI 引用都是幻觉”(如果你用更便宜的模型这仍然经常发生)这类说法了:当我让 AI 检查我新书的错误时,它发现了一个错误,不是在我引用的那篇文献本身,而是在我引用所指向的原始文章中。
很高兴看到又一次在线训练运行!这是 Marin 535B-A23B 今天的情况: https://t.co/Bc3CcV4FOm 还有谁想分享吗? https://t.co/S71nmJ4fS3 [引用 @_LuoFuli]: 半年的沉默。我们用这段时间研究一个问题:RL(强化学习)能扩展到多远。 MiMo-V2.6 目前正处于其 RL 运行的中期。我们扩展了三件事:计算(~每步 20 亿 token,1568 个 prompts × 16 次 rollouts,完全异步)、环境和测试套件(多任务代理式 RL,在…
听这个碰巧也是投资人的家伙! [引用 @DudeWhoInvests]: 刚刚删除了 Claude… Muse 真的是我唯一需要的。我不是在开玩笑。
明天早上将有更多 Union Alpha 的容量上线 感谢在此期间包容这些小故障! [引用 @OpenRouter]: 🥷 新的隐匿模型:Union Alpha (@unionalphaai) 一个用于研究、编码和代理型工作流的多模态模型。 - 免费使用 - 256K 上下文 - 工具调用 - 前沿水平的通用性能 现在试用并分享你的反馈: https://t.co/SZbdoGOkdb
AI 写作的一个迹象恰好是把行动和能动性过度赋予无生命物体:“代码现在知道了”、“计划会记得”等等。
来自 Node.js 的创造者!!muse “令人震惊地好”!! [引用 @rough__sea]: muse 真是令人震惊的好——他们把简洁性做到了极致。它很快成为我个人 AI 的首选