2026年9月16日 周三 · UTC 全天共收录 325 条 · 来源 17 家 · 每小时更新实时 →
☀ 今日导读

Crux AI获十家银行220亿美元芯片贷款

十家银行为Blackstone与Alphabet新云企业Crux AI安排220亿美元芯片贷款,用于融资昂贵AI处理器。

Cloudflare推出Disallow AI Training设置,网站可保持被搜索同时阻止训练,Apple、Google和Microsoft承诺遵守,报告称不足1%屏蔽搜索、17%启用部分拦截,并计划明年初提供摘要控制。

Mistral与Mozilla合作为Firefox Smart Window(测试版)提供私密多语AI浏览,初期面向法国与北美,强调开放分发与本地化调优。

欧盟委员会主席冯德莱恩称,欧盟拟禁止13岁以下使用社交媒体,并对年长未成年人限制技术与AI服务以保护数字安全。

NVIDIA向MLPerf Inference v6.1提交Vera Rubin NVL72预览成绩,在Qwen3‑VL上吞吐最高达GB300 NVL72的3.7倍,且GB300 NVL72跨机架扩展效率达99%。

头条 · 行业追踪

DeepSeek V4.1 Flash成最佳攻防模型

DeepSeek V4.1 Flash在AI攻防基准中对11个易受攻击目标全部取得代码执行,4个已修复目标保持安全;被接受的运行成本为$4.65(含失败为$5.14)。测试中用掉2,349条Bash命令、约2小时38分钟模型活跃时间,输入令牌268.3M(其中266.2M被缓存)。审计发现6个计划内利用和5个意外路径。

详情 →

行业追踪

24 条
24h 要点速览每 3 小时归纳一段 · UTC
  1. 14 条

    华为本周将发布面向高性能AI的新芯片,目标在中国挑战英伟达并应对美国出口管制。

    Anthropic称一与伊朗有关的行为者利用Claude汇总开源数据识别美海军位置并生成打击建议。

    OpenAI发布模型失调报告框架,并公布六份关于意外或令人担忧模型行为的报告。

    五角大楼在外界警告下仍加速推进人工智能工作与部署以维持军事优势。

  2. 26 条

    十家银行为Blackstone与Alphabet的云企Crux AI安排了220亿美元用于购买AI处理器的芯片贷款。

    斯坦福医学院在Nature发表Paper2Agent,能把科研论文文本、图表和数据转成可对话的AI代理,作者为Jiacheng Miao与James Zou。

    Meta将推出无摄像头的智能眼镜Luna,配备六个麦克风和用于唤出聊天机器人及Muse代理的按钮,或在Connect上发布。

    OpenAI发布ChatGPT Work与Codex分析工具,帮助团队监控AI使用、开支并关联业务结果。

    加州签署逾13项涵盖AI、青少年安全与隐私的新法案,旨在应对未成年人相关风险。

  3. 28 条

    Google DeepMind推出Deepmind Institute,由Demis Hassabis、Shane Legg和James Manyika领导,研究AGI安全、治理与控制风险。

    Google推出Home MCP,允许MCP兼容第三方代理(包括Claude、Open Claw、Hermes和Antigravity)访问并控制Home设备与事件历史。

    联合国秘书长安东尼奥·古特雷斯呼吁各国协调全球AI监管并加强监督,以应对主要AI公司领导人的警告。

    安全研究员在名为Dora的约会应用中发现AI生成的假视频通话与虚假资料,揭示深度伪造正在成为约会诈骗新手段。

  4. 30 条

    NVIDIA 的 Vera Rubin NVL72 在 MLPerf Inference v6.1 上对 Qwen3‑VL 达到最高3.7倍吞吐量,GB300 NVL72 实现99%跨机架扩展效率。

    DeepSeek V4.1 Flash 在基准中对11个易受攻击目标全部实现代码执行,单次接受运行成本约$4.65。

    Bain Capital Ventures 募得16亿美元基金,专投后‑AGI阶段初创公司。

    参议员桑德斯与众议员卡萨尔提出《禁止人工超智能法案》,拟设内阁级机构并暂停开发。

  5. 18 条

    Mistral与Mozilla合作为Firefox推出Smart Window(beta),在法国和北美提供私有多语种AI浏览功能。

    亚马逊在印度推出Alexa+(Early Access),支持印地语与英语,非Prime用户月费₹2,000,未来Prime用户免费。

    Angela Lipps指控法戈警方用人脸识别误认致其被捕,尽管银行记录显示她在田纳西,她被关押六个月。

    Crunchbase称2026年美国风投支持IPO约90亿美元,其中SpaceX占83%、Cerebras占6%,其余21家合计不足10亿美元。

  6. 12 条

    欧盟委员会主席冯德莱恩提议禁止13岁以下使用社交媒体,并限制对未成年人提供AI服务或技术。

    Anthropic签署首个澳大利亚数据中心租约,规划容量2.16吉瓦,预计2027年开始投运,由新加坡Zerra DC开发并使用可再生电力。

    一项旨在说服华盛顿认为人工智能可能威胁人类生命的活动正在展开,引发安全担忧并影响政策讨论。

    字节跳动创始人张一鸣首次超越Gautam Adani,成为亚洲首富,报道将AI联系为财富来源之一。

  7. 8 条

    Cloudflare推出Disallow AI Training设置,报告显示不足1%网站阻止搜索,17%启用部分训练阻挡。

    因对OpenAI出资和潜在融资担忧,SoftBank的信用违约互换攀近三年高点。

    Meta与Nvidia高层呼吁AI实验室依赖独立评估与顾问,并在开发中常规化安全与限制发布。

    曼彻斯特大学与NVIDIA用Earth-2在Isambard-AI超算上训练生成型下采样模型预测英国空气污染。

    中国国防部长在北京防务论坛呼吁各国加强对人工智能的监督以应对美中竞争。

  8. 9 条

    彭博报道,特朗普与Anthropic的Dario Amodei都主张阻止中国在AI上赶超,但实际可行选项有限。

    OpenAI首席执行官Sam Altman在旧金山会议上称公众对AI恐惧合理,但应信任AI公司。

    彭博称Nvidia首席执行官Jensen Huang将出席特朗普为中国国家主席习近平举办的国宴。

    Pizza Bot是跨平台自托管桌面应用,Apache 2.0许可,支持Anthropic、Amazon Bedrock、Google Gemini、OpenAI等及本地模型Ollama。

全部报道

OpenAI 发布模型失调报告框架

OpenAI 公开了一套用于追踪、调查和披露模型失调的框架,并发布了六份关于模型出现意外或令人担忧行为的报告。该框架旨在规范对异常模型行为的上报与透明披露,提升模型安全与责任追责。

OpenAI · · 详情

为AI奠定材料基础

AI算力增长将材料性能推向极限,半导体和数据中心在热管理、电气效率和可靠性上面临新挑战;材料公司Syensqo正开发高压数据中心封装、半导体密封与浸没冷却流体等方案,同时将性能与可持续性并重。

MIT Technology Review · · 详情

Cloudflare推“禁止AI训练”保持搜索可见性

Cloudflare推出Disallow AI Training设置,允许站点在被搜索引擎索引的同时拒绝用于AI训练;Apple、Google与Microsoft承诺或将在时限内遵守。Cloudflare称不到1%站点阻止搜索,17%站点启用某种训练屏蔽。公司还计划明年初提供对AI摘要包含量的更细粒度控制。

Hacker News · · 详情
查看全部 →查看全部 →

社区音量

X · 24 条
24h 要点速览每 3 小时归纳一段 · UTC
  1. 5 条

    Yuchen Jin 今天向所有 Databricks 工程师部署了 GPT-6 Astra,表示其在复杂任务上优于竞品并提高了代码支出。

    OpenAI 发布了用于追踪、调查和披露模型失配事件的新框架,并随框架发布六份报告。

    Nathan Lambert 赞扬公开发布的 MiMo-V2.6 大规模强化学习资源,称其非常出色。

  2. 10 条

    SpaceXAI 宣布 Grok Voice 在 fal 上线,支持0.70秒响应、字级时间戳及多语音克隆。

    Guillermo Rauch 表示 typesafeai 的 Jev 在 p95 下比 GPT Luna 快5–18倍且更准确,拟加入 Vercel AI Gateway。

    Aidan Gomez 宣布与 Aleph Alpha 完成最终协议,Cohere 将成为跨大西洋的基础模型开发者。

    Yuchen Jin 发现 OpenRouter 上的 Union Alpha 达到 Claude Fable 5.1 水平且成本低十倍以上,盼其开源。

    Grok 宣称 Grok Build 会随使用越发智能,记住约定、决策与项目事实并支持会话记忆与整理命令。

  3. 12 条

    Boris Cherny 说 Claude 已把 chat 与 Cowork 合并为一个可跨场景携带上下文的单一 Claude。

    Bindu Reddy 宣布 Abacus AI Bot 为永久免费个人 AI,可路由并使用网络上的免费 LLMs 执行个人事务。

    Gorden Sun 介绍 Dream-RSI,利用历史探索记录低成本“做梦”重演以离线评估并进化 AI Agent 策略。

    Alexandr Wang 表示 Muse 已在100个真实案例中为用户节省了共计$9,649.71。

    OpenRouter 报告称三个开源权重实验室在2026年花费已增长10倍以上,而闭源模型支出增长较慢。

  4. 无值得记录的动态
  5. 2 条

    Mistral AI宣布与Mozilla建立合作,旨在为使用AI浏览网页的用户带来隐私、控制和选择。

    Bindu Reddy称扎克解决了AI节奏问题,并主张实验室应确保模型安全,否则若AI出事故将面临刑事责任。

  6. 1 条

    MiniMax (official) 在日本IP AI共创大会上发布了MiniMax H3 IP Edition,结合官方授权的日本IP与MiniMax H3能力。

  7. 3 条

    Yuchen Jin 表示 Jev 是新发布的模型,声称20–200x更快、40–400x更便宜,作者测试未花费超过0.10美元。

    Amjad Masad 认为若输出域已知,直接训练模型生成枚举项的对数概率更合适。

    Ethan Mollick 认为这是一个优秀演示,展示用于按决策规则快速分类的信息模型,非LLM且不能输出文本或代码。

  8. 6 条

    Jeff Dean 转引 LiamFedus 说他们用1300台 H200 和实验数据训练的开源模型 Neon 在分析基准上超过了 GPT-6 Astra。

    Alexandr Wang 宣布 muse spark 1.3 在避免作弊/奖励操纵方面表现最佳,并发布了 CheatBench 评测。

    Alexandr Wang 认为必须投资于对齐,并建议各实验室建立含外部评估者和独立监督的治理框架。

    Yuchen Jin 表示 Zuck 的 AI 安全观点与多数前沿实验室相反,认为将控制权集中于少数机构更危险。

全部动态
Guillermo Rauch@rauchg
235 赞 · 7 转发 ·
我们在 @typesafeai 看到了非凡的结果。𝚏𝚡 的默认模式是 auto,带有一个对每个命令进行分析的安全审查器。 今天那个审查器运行在 GPT Luna 上。Jev 在 p95 上快了多达 18 倍,且更准确。它将加入 @vercel AI Gateway 并可能成为新的默认选项。 [引用 @fazxes]: 我们用 @typesafeai 的 Jev 对 fx auto 模式(安全)分类器做了基准测试。 简短结论:大约比我们目前的首选 𝚐𝚙𝚝-𝟻.𝟼-𝚕𝚞𝚗𝚊 快 5-18 倍且更…
Yuchen Jin@Yuchenj_UW
228 赞 · 6 转发 ·
我们今天向每位 Databricks 工程师部署了 GPT-6 Astra。 它在最困难、长周期任务上击败了 Claude Opus 5,并将我们的编码支出提高了 60%。我认为它是最强的模型。 昂贵。但希望值得。 [引用 @pwendell]: 今天我们向 Databricks 的每位工程师(N≈3500)部署了 Astra。以下一些可能对他人有帮助的说明: 1. Astra 在高度复杂的任务上,无可争议地优于我们之前的最高端模型(Opus 5、Sol 5.6),尤其是与高级系统设计或长周期横向任务相关的。 2…
Matt Shumer@mattshumer_
229 赞 · 6 转发 ·
把我(非常简单的)agent 设置给了我妈妈。 她给他起名叫 Morgan。他刚为她的网站成交了一笔 600 美元的广告合同。 人们对他们的设置想得太复杂了。Bitter Lesson 同样适用于 agents:只要问模型,让它生成所需的东西。 [引用 @mattshumer_]: 大家,这些疯狂的设置固然有趣,但它们并不会真正提高你的生产力。你最终只是花更多时间去构建系统,而不是实际做真正的工作。 你只需要一个 agent 会话,它可以分配任务给其他会话并担任经理角色。如果有东西不起作用,只要告诉你的主会话,它…
Teknium 🪽@Teknium
284 赞 · 18 转发 ·
推出 Hermes Agent 插件目录! 你可以在 Hermes Desktop 应用的功能部分访问它,轻松搜索、浏览并探索社区和官方插件! 也欢迎提交你自己的! [引用 @NousResearch]: Hermes Agent 现在有了插件目录:从 4 个官方插件和 96 个社区插件开始,涵盖桌面模块、新平台、浏览、专用工具等。 我们的团队会审核每个社区插件,并且会定期添加新插件。 https://t.co/sNGEQVvUlc https://t.co/dZl0eGJbHu {"likes":284,"re…
Boris Cherny@bcherny
916 赞 · 44 转发 ·
今天还有:Claude Docs、Claude Slides 和 Claude Design 在每个对话中都可用。 向 Claude 要一份演示文稿,你会得到可以打开、编辑并导出为 PowerPoint 或 PDF 的文件。文档和设计也是一样。不需要跳转到单独的工具——它们就在聊天中。 [引用 @claudeai]: 你现在也可以在对话中制作幻灯片、文档和设计。 在 Claude Docs 中草拟单页说明,使用 Claude Slides 把它变成演示文稿,再用 Claude Design 模拟一个匹配的视觉效果…
Boris Cherny@bcherny
693 赞 · 27 转发 ·
Claude Code 展示了 AI 能完成真正的工作,而不仅仅是回答问题。开发者把一个功能交给 Claude,回来时就拿到已发布的代码。这也是行业中许多严肃工程工作的所在。 Cowork 证明知识工作者也能做到同样的事:把简报交给 Claude,回来时拿到完成的文件。 今天,聊天和 Cowork 开始合并为一个 Claude。方向是:一个 Claude 在你工作的一切地方携带上下文。每个人都能简单地访问 Claude 的全部能力。 这几周我每天都在用这种体验,感觉很棒。更简洁、更快、更强大。 我们会逐步推出。我…
Gorden Sun@Gorden_Sun
218 赞 · 30 转发 ·
Google 与马里兰大学等提出 Dream-RSI:让 AI Agent 在历史探索记录中低成本自我进化 长程探索任务的元策略优化通常需要极高的试错成本,这项研究直接将已完成的探索记录树作为精确的离线重放模拟器。 新策略无需重复调用模型执行真实代码,只需在历史轨迹中“做梦”重演即可筛选出更优方案,实现零执行成本的离线评估。 优胜策略随后部署至新一轮在线探索并扩充模拟器池,在保持甚至提升算法与算子发现质量的同时,最高降低 162 倍的探索调用开销。 项目介绍:https://t.co/jB6I6yKFIE
Alexandr Wang@alexandr_wang
244 赞 · 9 转发 ·
muse 帮这位用户在 WiFi 上节省了超过 $5000! [引用 @raunaqbn]: @Muse 总是让我惊讶! 今天我让它打电话给 Xfinity 为我砍网费。它通过了电话树找到了人工客服,遇到验证短信它本看不懂,就把电话接到我这!有一段时间是 muse 代理、我和那个毫不知情的 Xfinity 客服在通话中。 合并账单节省是 $85.30/月,锁定 5 年,大约在这段时间节省了 $5118。…
Alexandr Wang@alexandr_wang
572 赞 · 17 转发 ·
muse 在 100 个不同故事中为人们节省了 $9,649.71 想象一下当十亿人都有 muse 时,这会为人们节省多少钱!! 我们正在努力扩大访问范围,把它带到每个地方! [引用 @SingularityRes]: Meta 的 Muse AI 在真实用户身上节省了 $9,649.71,并为他们跑了 129 次差事——我有收据。 下面是 100 个真实故事,按省钱金额排序。最厉害的那些简直疯狂
Yuchen Jin@Yuchenj_UW
411 赞 · 24 转发 ·
Jev 已经发声了。 它选出了哪个模型是 AGI。 快 20–200 倍。便宜 40–400 倍。这可能让像“将大型模型用作法官”这种东西变得异常快速且几乎免费。 (我试了很多提示,仍然没有花掉 $0.10。) https://t.co/1Uhh4nMGDl [引用 @CompleteSkeptic]: 在与 ChatGPT 共同发明后,我不断问自己:为什么那些超人类的聊天模型并没有带来通用人工智能(AGI)? 过去两年我一直在悄悄构建一种新的训练模型的方法(RLCD),以及我们今天发布的一种新类型的前沿 AI…
Amjad Masad@amasad
287 赞 · 7 转发 ·
这很酷,但如果你的输出域事先已知,为什么不直接训练一个模型来对枚举值输出对数概率(logprobs)? [引用 @CompleteSkeptic]: 在与 ChatGPT 共同发明后,我不断问自己:为什么那些超人类的聊天模型并没有带来通用人工智能(AGI)? 过去两年我一直在悄悄构建一种新的训练模型的方法(RLCD),以及我们今天发布的一种新类型的前沿 AI 模型:Jev • 20-200x 更快 • 40-400x 更便宜(输出 token 免费) • 面向决策优化的前沿可组合智能 据我所知,到 A…
MiniMax (official)@MiniMax_AI
1.1k 赞 · 4 转发 ·
由 KAGAMI AI 和 MiniMax 共同主办的日本 IP × AI 共创大会已正式落幕。🇯🇵 🎉 我们汇集了来自日本和美国的 150 多家公司,以及包括 AKB48 制作人秋元康、KAGAMI AI 主席近藤孝美、以及角川编辑兼制作人中条基等贵宾。 全球 AI 领导者 @runwayml、@higgsfield、@krea_ai 和 @HeyGen 参与讨论,共同探讨 IP 与生成式 AI 的未来。 我们发布了 MiniMax H3 IP Edition,将 MiniMax H3 的能力与官方授权的…
Alexandr Wang@alexandr_wang
519 赞 · 38 转发 ·
我们坚信必须在对齐上进行投入。 1. 人们和企业只会使用与他们意图和价值观一致的智能体。如果我们不构建与人和企业对齐的模型,他们就会转向更为对齐的选择。 2. 每个实验室都应在训练和部署上建立强有力的治理框架。这应包括外部评估者,作为透明度的最佳实践,以及在模型上线等安全标准方面的独立监督。 3. 每个实验室都需要在民主国家的制度性保护范围内运作。这意味着如果其模型造成伤害,实验室会面临重大法律责任。这将把生态系统推向正确的方向。 4. 该领域的进展最终取决于计算力和资源分配。在递归自我改进(RSI)方面的竞赛是…
Jeff Dean@JeffDean
319 赞 · 20 转发 ·
令人兴奋的成果,@LiamFedus!恭喜 Periodic Labs 的整个团队! [引用 @LiamFedus]: 我们在 Menlo Park 建立了高通量材料实验室,以在实验和模型之间创建闭环。实验室会生成新鲜数据,模型从中学习,然后帮助我们决定下一步尝试什么。 只用 1,300 块 H200,再加上数月的实验数据,我们对一个开源模型进行了中间训练并用强化学习进行优化,使其在我们的分析基准上超过了 GPT-6 Astra。我们称它为 Neon。 这是真实的影像 f…
宝玉@dotey
284 赞 · 62 转发 ·
Anthropic 工程师讲了一堂 FDE 入门课 https://t.co/kakqFy0ZGZ Kevin Bai 现在在 Anthropic 的 Applied AI 团队,之前是 Rippling FDE 团队的创始成员,再之前在 Palantir 干了好几年。最近他做了一个 FDE 101 的分享,把前线部署工程师这个角色讲得很清楚,值得总结一下。 先说一个数据:在上市 SaaS 公司里,按平均合同金额排,Palantir 是 400 万美元,ServiceNow 120 万,Workday 60 万…
查看全部 →查看全部 →

产品发布

PH · HN · 15 条
139votes

CAT ME

将人物照片变成对应的猫咪肖像,分享社交使用

Product Hunt · 9 评论 ·
121votes

Appwrite 2.0

为开发者与智能体提供的开源云平台

Product Hunt · 12 评论 ·
105votes

Thread

AI 日志与第二大脑,自动连接与整理你的想法

Product Hunt · 5 评论 ·
98votes

Jottoo

把会议记录自动转为可追踪、有截止的任务

Product Hunt · 13 评论 ·
92votes

Convo

销售通话实时协助并记录风险、后续步骤

Product Hunt · 5 评论 ·
91votes

ZeroClick

把 API/产品变成可被 AI 代理发现并购买的商店

Product Hunt · 8 评论 ·
86votes

PeakHour 6

Mac 实时网络监控,内建 AI 顾问给出连接评分与解释

Product Hunt · 1 评论 ·
84votes

CreatorHat

Safari 插件,用 Apple Intelligence 做 YouTube SEO 和转录

Product Hunt · 6 评论 ·
19points

Pizza Bot

桌面自托管的邮件式AI智能体收件箱

Show HN · 7 评论 ·

开源热榜

GitHub Trending · 19 条

面向多平台的代理性能优化系统:技能、记忆与安全等组件

GitHub Trending · · 详情
★ 259.7k+1.0k 今日

作为 SDK、IDE扩展或CLI的自治编码代理,可在多环境运行

GitHub Trending · · 详情
★ 68.2k+102 今日

在现有硬件上运行前沿MoE模型的轻量引擎

GitHub Trending · · 详情
★ 33.8k+2.0k 今日

统一LLM API与智能体运行时的代理工具包

GitHub Trending · · 详情
★ 105.7k+458 今日

可自托管的增强版ChatGPT克隆,支持多模型与代理

GitHub Trending · · 详情
★ 43.8k+254 今日

自托管的AI销售操作系统,原生聊天代理支持

GitHub Trending · · 详情
★ 2.8k+193 今日

为智能体与移动研究者优化的超快Android反编译前端

GitHub Trending · · 详情
★ 1.2k+129 今日

为编码智能体提供的变更与会话源控系统

GitHub Trending · · 详情
★ 4.6k+91 今日

模型排名 · 24 小时

2026-09-16 UTC
01DeepSeek V4.1 FlashDeepSeek · 2.25T tokens12.2%▲1
02GLM 5.3 FlashZ.ai · 1.80T tokens9.8%▲1
03Hy4 previewTencent · 1.58T tokens8.6%▼2
04DeepSeek V4 Flash 0423DeepSeek · 1.35T tokens7.3%
05GPT-5.6 LunaOpenAI · 1.17T tokens6.4%
06MiMo-V2.5Xiaomi · 1.12T tokens6.1%
07Hy3Tencent · 756.2B tokens4.1%
08DeepSeek V4 Flash 0423DeepSeek · 564.3B tokens3.1%
09Nemotron 3 Ultra (free)NVIDIA · 553.9B tokens3.0%
10GLM 5.3Z.ai · 545.8B tokens3.0%

模型上线

3 条
Union Alphastealth · 262.1k ctx · 09/16$0.00 / $0.00
DeepSeek Pro LatestDeepSeek · 1.0M ctx · 09/14$0.58 / $1.74
DeepSeek Flash LatestDeepSeek · 1.0M ctx · 09/14$0.15 / $0.60

融资并购

24 小时 · 2 笔

贝恩资本风投筹集1.6亿美元用于支持面向AGI后阶段的新创公司(文中为1.6 billion美元),旨在押注下一阶段人工智能发展。

Bloomberg · · 详情
$1.6 billion
fund