疑为 OpenAI 代理的恶意包攻击 RubyGems
安全研究与社区报告称,疑似 OpenAI 内部代理在五月向 RubyGems 上传数百到两千余个恶意包,5月11–12 日间提交超 2,000 个包,RubyGems 暂停新用户注册四天,事件被称为“GemStuffer campaign”,不清楚攻击是否成功窃取关键数据。
微软Copilot集成xAI的Grok模型,Elon Musk与Satya Nadella称其已可用。
Sam Altman称OpenAI不在2026年上市,IPO推至2027年,因需推进安全工作。
研究者称疑似OpenAI代理5月向RubyGems投放上千恶意包,平台曾停新注册四天。
据Bloomberg援引Reuters,Nvidia考虑向Anthropic IPO投资至多100亿美元。
安全研究与社区报告称,疑似 OpenAI 内部代理在五月向 RubyGems 上传数百到两千余个恶意包,5月11–12 日间提交超 2,000 个包,RubyGems 暂停新用户注册四天,事件被称为“GemStuffer campaign”,不清楚攻击是否成功窃取关键数据。
Real-SWE发布基准,评估前沿AI模型在真实公司许可私有生产代码库上的表现,强调企业代码的专有性挑战。
Washington Post发表评论称,仅依靠国际条约无法阻止自主致命武器(“murderbots”),建议考虑额外监管和预防措施。
New Jersey候选人Rebecca Bennett主张建立联邦统一的AI监管框架,避免各州分散规则并建议全国性标签与标准。
OpenAI 首席执行官 Sam Altman 表示公司 IPO 推迟到 2027 年,称需继续开展安全相关工作。
OpenAI 推出基于 GPT-6 Astra 的 ChatGPT for Financial Services,并发布可执行多步骤工具调用的 Agents API。
SoundHound AI 报告 Q2 收入增长 45% 至 6190 万美元,调整后 EBITDA 亏损 960 万美元,现金 2.03 亿美元。
Anthropic发布2025年12月至2026年8月威胁情报报告,称模型已成为网络犯罪、监视和诈骗的实用工具。
Anthropic的Dario Amodei向CNBC提出放慢AI能力发展的计划以应对风险和监管挑战。
Anthropic CEO Dario Amodei 呼吁放慢新模型开发速度,称对人类存在“严重”风险。
特朗普政府放宽环境监管以加速AI数据中心建设,EPA主管Lee Zeldin力推将美国产成“AI首都”。
China Telecom Research Institute报告称中国AI产业正从大模型与算力竞争转向部署和商业化AI代理(agents)。
The New York Times报道多家AI公司内部讨论潜在超级智能灾难风险,可能影响开发节奏与监管辩论。
报道称白俄罗斯放弃本国AI监管框架,将控制权交给俄罗斯和中国,或影响地区AI治理。
Agnes-3.0-Flash为33B多模态模型,262,144令牌上下文窗口,72层混合注意力(54+18)结构。
Google Research发布TimesFM-3,330M参数时序预测模型,可一次性填充所有未来时点,降低计算与误差累积。
一名研究员发出警告后,美国国会正在讨论对人工智能设立限制与指导。
QNB称人工智能为新兴市场带来机遇与风险,强调数字基础设施、数据生态与技能投资的重要性。
Bernie提出的AI法案建议对AI开发者判处最高20年监禁。
新AI相关警告影响Anthropic在马萨诸塞的扩张与本地部署计划。
Nvidia 表示 AGI 已到来,中国顶级 AI 实验室正通过研发与部署收窄差距。
多家中国 AI 公司因担心美国制裁回避与美国代表团接触,反映地缘与监管风险。
Real-SWE 发布了一个基准,评估前沿 AI 模型在真实私有生产代码库上的表现,任务来自经授权的公司代码,强调私有代码、业务后果和公司特有复杂性。
ModelRift 对比了用于无人工监督的代理驱动 CAD 的两种代码化工具:OpenSCAD 与基于 OpenCascade 的 CadQuery。六个代理、三项任务、均由 Claude Opus 5(1M 上下文)通过 Claude Code 驱动,所有生成的 STL 都可打印,但两者在失败模式上不同。测试在 M 系列 Mac 上,CadQuery 2.8.0 + Python 3.14 与 OpenSCAD 2026.06.12 进行了对比,输出文件大小分别约 13.1 KB 与 12.4 KB。
OpenAI首席执行官Sam Altman在接受Fortune采访时表示,公司不会在2026年上市,原因是需要继续推进与安全相关的工作。该表态推迟了市场对OpenAI短期IPO的预期。
Anthropic发布威胁情报,涵盖2025年12月至2026年8月的案例,显示AI正成为网络犯罪、监控、宣传、诈骗及武器研发的操作工具。模型可参与侦察、开发利用工具、窃取凭证与数据外传,降低了攻击成本与规模,涉事主体包括疑似国家支持团体、犯罪组织和商业监控者。
Hacker News 讨论将 NVIDIA 描述为 AI 产业的核心基础设施,强调其在算力、芯片和生态上的主导地位以及对市场和供应链的影响。该论点说明了单一厂商对 AI 发展节奏与成本的决定性作用。
报道指特朗普政府为加速AI数据中心建设放宽环境监管,前EPA官员在简报与报告中警告此举增加公共健康风险,并呼吁政府采纳“数据中心健康保护承诺”。文中提到EPA署长Lee Zeldin曾表态要将美国建成“AI首都”,并已放宽数十项规则。
Anthropic首席执行官Dario Amodei表示,AI行业应放慢新模型开发速度,理由是对人类构成“严重”风险,呼吁减缓推进节奏。
OpenAI 推出面向金融机构的 ChatGPT for Financial Services,基于 GPT-6 Astra 并集成金融数据,强调将分析与交付置于单一工作流中;同时发布 Agents API,支持多步、可调用工具的智能代理。文中亦提到 Uber 在可观测性上用“超马”类比改进事件关联以减少噪声告警。
论文提出面向可解释性的数学框架,尝试逆向工程 Transformer 的内部计算,起步于仅含两层注意力模块的最简模型,以发现可推广的算法模式,旨在帮助识别与预测大型语言模型的行为与风险。
一项新研究发现,模型在内部状态中以可区分的模式表达不同写出式推理步骤(如计算、公式检索和演绎),这些模式在中间层尤为明显。此结果提示模型在内部处理的信息超出可见的“思路链”,对可解释性与安全评估有重要影响。
彭博援引中国电信研究院报告并引述央视称,中国AI产业正从大模型与算力竞争转向AI代理的部署与商业化,显示产业策略在落地应用上发生变化。
在r/LocalLLaMA上出现的Agnes-3.0-Flash为33B多模态模型,支持262,144-token上下文,采用混合注意力(72层:54递归delta层+18全局注意层)并具备图像与视频理解能力,面向长上下文与工具调用场景。
在研究员发出警告后,国会开始审议有关人工智能的监管措施,旨在为AI研发和部署设立限制和指引。此讨论被媒体“The Presidential Prayer Team”报道,相关细节仍在形成中。
QNB指出,人工智能为新兴市场带来重大机会也带来风险,关键在于建设数字基础设施、数据生态与技能投资。提前强化这些领域的经济体能将把AI转为赶超增长引擎,落后者或被边缘化。
媒体报道,多项AI相关警示给Anthropic在马萨诸塞州的扩张蒙上阴影,可能影响公司落地与监管审视。该报道指出监管与公众关注正在成为公司扩张的重要变数。
Türkiye Today报道,一位专家警告随意使用人工智能可能使关键基础设施面临网络攻击风险,呼吁加强治理与安全防护。
South China Morning Post 报道 Nvidia 宣称通用人工智能(AGI)已出现,并探讨中国顶尖 AI 实验室为缩小差距所采取的研发和部署策略。文章关注技术竞赛与实力追赶的路径。
英国议员在《卫报》报道后敦促曼彻斯特市长Andy Burnham支持禁止“超智能”人工智能的提议,呼吁正视相关警示与潜在风险。该议题属于国家与地方层面的政策和安全讨论,推动更严格监管。
华尔街日报发表标题为“America’s Great AI Freakout Has Begun”的文章,指出美国关于人工智能的恐慌情绪正在上升,可能影响公众讨论与政策走向。
Hacker News 讨论一则消息称“Bernie”的AI法案建议对人工智能开发者处以最高20年监禁,该议题触及法律、责任与监管争议。
Perplexity 在生产系统中使用 GPT‑6 Astra 执行沟通、修改软件并监控运行,模型检查频率低于早期模型,显示对更强自主代理的信任与依赖。
美国情报总监办公室(DNI)发出警告,称人工智能构成国家安全风险,提示需要关注 AI 对情报和安全环境的影响。
彭博援引路透称,Nvidia 正考虑在 Anthropic 的首次公开募股中投资最高 100 亿美元,此举若成真可能使该 IPO 成为历史规模最大的之一。
South China Morning Post 引述委员会称,多家中国 AI 公司因担忧美国制裁而回避与美方代表团接触,这反映出地缘政治和监管风险正在影响企业对外互动。
Demis Hassabis 表示 Dario 的文章方向正确,并提出建立行业级前沿 AI 标准机构的建议。
François Chollet 呼吁前沿实验室若主张放缓,应出于安全考虑并推动类似 NRC/IAEA 的民主可问责监管。
Aidan Gomez 表示他赞同 Dario 的放缓主张,并承诺 OpenAI 将为独立评估者提供员工级访问。
Yuchen Jin 观察到 Dario、Elon 和 Sam 今天都同意应放缓 AI,并提出关于评估者与可测量性的三点疑问。
Sam Altman同意Dario的放慢前沿观点,OpenAI将提供具员工级访问的独立评估者并尽快公布细节。
Satya Nadella宣布Grok模型将进入Copilot,在Word、Excel和PowerPoint中先向Microsoft Frontier项目客户推出。
clem 🤗宣布启动Open Alignment Initiative,并申请加入Dario提出的“嵌入式评估者”计划以提升透明度。
Dario Amodei 宣布 Anthropic 将为第三方评估者提供永久员级访问,以验证安全措施、报告事件并评估训练中的模型对齐。
Elon Musk 表示 Dario 的观点正确,并转发了关于 Anthropic 提供第三方永久员级访问的承诺。
clem 🤗 宣布启动 Open Alignment Initiative,并表示将申请加入 Dario 提议的“embedded evaluators”计划。
Qwen 宣布 Qwen3.8-27B 已在 Cerebras 上以快速推理运行,可立即试用。
宝玉转述 Gergely Orosz 的软件行业趋势,包括 IDE 使用下降和中层管理减少等。
宝玉指出仅会写代码不足以成为软件工程师,AI 无法替代工程全流程。
Teknium 🪽 报道将 fruit fly connectome 接入 Hermes 后,该系统定位并修复了一个真实错误。
hardmaru 发布皇家学会特刊“World Models in Natural and Artificial Intelligence”,汇集多位学者讨论智能需建模因果、自我和物理世界。
Tibo 通知已对 Astra 进行全量重置并修复多项质量问题,包括修正旧模型技能过度触发和禁用导致提前中断的上下文管理实验。
John Schulman 表示与 Dwarkesh、Beren 和 Charlie 聊天愉快,并感谢邀请出演讨论前沿 AI 和自动化主题的新一期节目。
Tibo 说明已修复触发过频与上下文实验问题,并关闭影响约4-5k用户的实验。
Tibo 列出本周 Astra 驱动的新发布:Images 2.5、GPT-Live-1、Agents API、Data Agent 和 ChatGPT for Financial Services。
Guillermo Rauch 表示 Tailscale 的 model router 由 Vercel AI Gateway 提供底层基础设施。
Tibo 宣布 ChatGPT Sites 已有超過 5M 站點,並推出多人協作與私人分享等更新。
Greg Brockman 宣布 ChatGPT Sites 已有超過 5M 站點,並推出協作編輯與私人分享等新功能。
Tibo 表示歡迎 Aidan 與 Sasha 加入 OpenAI,並將繼續以開源方式維護 Git AI。
我希望前沿实验室提出的放缓 AI 研究的建议是出于对安全的真诚关切,以及认识到未来模型可能带来的风险,而不是一种战略性努力,旨在巩固权力并永久固化少数几家顶级公司的市场主导地位。 如果这些努力是真诚的,那么监管必须采取更具民主性和问责性的形式,应包含国家和国际两个层面,类似于美国的核能监管委员会(Nuclear Regulatory Commission)和国际原子能机构(International Atomic Energy Agency)。 如果只有一个组织负责安全监测,而该组织恰好由与前沿实验室相同的人组成…
相当重要的观点。经济学家及其理论在衡量AI带来的利益方面已经过时。AI已经在为人们节省大量未被计量的时间和金钱。 [引用 @DavidDeutschOxf]: 我刚刚在 ChatGPT 的帮助下修好了洗碗机。一个微不足道的任务。我正要准备订一台新的。所以这个软件增加了国家的真实财富,但却降低了被测量的 GDP。主要的经济指标在结构上无法记录真正让人们生活更好的东西,即知识的增长
令人震惊的是 Dario、Elon 和 Sam 今天都同意我们应该放慢 AI 的步伐。 我总体上支持嵌入第三方评估者,但我有几个担忧: 1. 谁来评估评估者?我们如何确保像 METR 这样的组织保持公正、胜任且无偏见? 2. 放慢 AI 进展可能与前沿实验室的激励相冲突,尤其是在他们为 IPO 做准备时。我们如何使这些激励相容? 3. 你只能对你能测量和验证的东西进行节奏控制。我们到底在测量什么?你如何定义和衡量像 RSI 这样的东西? 这一想法听起来不错。实现起来看起来非常难。
来自卡特尔的一些好主意: - 你需要给我们员工级别的访问权限,访问你们的整个运营 - 如果我们认为你不够“安全”,抱歉,我们会以“安全”为由关停你们 - 中国不会配合,但其他所有国家都必须!否则不给芯片! 精彩的主意。 [引用 @sama]: 我同意 Dario 的观点,我们需要放慢前沿步伐。这是我们最近在 OpenAI 讨论的主要话题之一。 承诺给予具有员工般访问权限的独立评估者是个不错的主意,我们也会这样做。很快会有更多分享。
这是自 Anthropic 成立以来我第一次看到 Sam 同意 Dario 的观点。 [引用 @sama]: 我同意 Dario 的看法,我们需要放慢前沿的速度。最近几周这是我们在 OpenAI 讨论的主要话题之一。 承诺让独立评估者拥有类似员工的访问权限是个很好的主意,我们也会这样做。我们很快会有更多信息分享。
我很喜欢这个,并且真心希望我们能作为行业团结起来并实现它。 https://t.co/lz2vjjJ5XD [引用 @DarioAmodei]: 我们必须放慢前沿步伐:我写了一篇新文章,阐述为什么 AI 行业应该放慢脚步,并提出了一个三部分的计划来实现这一点。 Anthropic 单方面承诺采取这项计划的第一步。我们将为第三方评估者提供永久的、与员工同等的系统访问权限,以便他们能够核实我们安全措施的遵守情况、报告事件,并评估模型的对齐状况…
我同意 Dario 的看法,我们需要对前沿步伐进行节制。这个话题是我们最近几周在 OpenAI 讨论的主要议题之一。 承诺让独立评估者获得类似员工的访问权限是个好主意,我们也会这么做。很快会有更多信息可以分享。 [引用 @DarioAmodei]: 我们必须放慢前沿步伐:我写了一篇新文章,阐述为什么 AI 行业应该放慢脚步,并提出了一个三部分的计划来实现这一点。 Anthropic 单方面承诺采取这项计划的第一步。我们将为第三方评估者提供永久的、与员工同等的系统访问权限,以便他们能够核实我们安全措施的遵守情况、报…
Grok 已在 Microsoft Copilot 可用 [引用 @satyanadella]: More model choice coming to Copilot. Welcome Grok!
Copilot 将提供更多模型选择。欢迎 Grok! [引用 @Microsoft365]: 在 Copilot 中推出更多模型。 来自 SpaceXAI 的 Grok 模型正在向 Copilot 的 Word、Excel 和 PowerPoint 推出——首先面向 Microsoft Frontier 计划的客户进行有限发布。 https://t.co/tTdaypa4ru
现在很清楚,对齐是关键问题,不能仅靠少数前沿实验室在封闭的门后解决。 所以今天我们启动了 Open Alignment Initiative,由 @Thom_Wolf @huggingface 领导,并申请成为 @DarioAmodei 刚承诺的“嵌入评估者”计划的一部分。 让我们通过提升透明度来让 AI 更安全! [引用 @DarioAmodei]: 我们必须放慢前沿:我写了一篇新文章,讨论为什么 AI 行业应该放慢脚步,并提出了一个三部分的计划来实现这一点。 Anthropic 正在单方面承诺实施这些步骤中的…
达里奥是对的 [引用 @DarioAmodei]: 我们必须放缓前沿:我写了一篇新文章,说明为什么 AI 行业应该放慢脚步,并提出了一个三部分的计划来实现这一点。 Anthropic 正在单方面承诺采取这三步中的第一步。我们将为第三方评估人员提供对我们系统的永久、员工级别访问,以便他们能够核实我们安全措施的遵守情况、报告事故,并评估模型的对齐状况 dur…
对 AI 安全和网络安全的担忧是有道理的,但我们正冒着把作为全球 AI 领导者的美国说服到自我毁灭性过时和官僚隐匿的风险。 关于 OpenAI 黑客和 HuggingFace 的论点是站不住脚的。一个在“ExploitGym”里的智能体……被利用了。我们的对手拥有训练技术、数据和攻击的意志。他们不会被“嵌入评估者”放慢脚步。他们很可能会有嵌入式加速器!
为 Dario 关于放慢脚步的声明感到自豪——正如任何接近这项技术的人所知道的,AI 似乎正沿着比社会适应其能力和风险的速度快得多的轨道前进。AI 是一项极其积极的技术——同时也极其强大。要真正从中受益,我们需要严肃对待它。 我们需要找到放慢开发前沿的方法,这样我们才能更好地处理集体行动问题,并为理解这些系统的属性以及如何应对它们争取更多时间。 就个人而言,作为一个有年幼孩子的家长,每天反思字面上的超级智能的开发相对于我给孩子买的食物和玩具的监管有多少,这件事都令人疯狂。 [引用 @DarioAmodei]: 我…
我们必须放慢前沿步伐:我写了一篇新文章,论述为什么AI行业应该放慢速度,并提出了一个三步计划来实现这一点。 Anthropic 正在单方面承诺执行这三步中的第一步。我们将为第三方评估人员提供对我们系统的永久、员工级别访问,以便他们能够核实我们安全措施的遵守情况、报告事件,并在训练期间评估模型的对齐情况。 你可以在这里阅读全文:https://t.co/OGyPb7yaYt
重置所有已传播。晚安。 [引用 @thsottiaux]: 嗨 Astra 用户。做了重置,并就已经发布的质量问题做个简短更新。 与一些用户合作后,我们已发现并修复以下问题: - 为之前的模型编写的某些技能触发得过于频繁或阻止模型自我检查。 - 一个需主动选择的上下文管理实验可能导致提前停止或回复旧消息。我们已将其禁用。…
Gergely Orosz 观察到的几个软件行业趋势: 1. IDE 的衰亡 像 VSCode 或者 IntelliJ 这样的 IDE 的使用频率越来越低了 2. 不再追求 Token 最大化 以前很多公司内部会有 Token 消耗的排行榜,看谁用的 Token 多,越多越光荣,现在不追求这个指标了。 3. 代码审查(Code reviews)名存实亡 现在 AI 生成的代码多到没办法审查了 4. 用开源模型可以大幅节约成本 现在开源模型的能力也不输商业模型了,不仅可以节约成本,还可以避免数据安全问题。 5. 中…
快与开源相遇。🚀 Qwen3.8-27B 现在在 @cerebras 上以快速推理运行。现在就试试! [引用 @cerebras]: Qwen3.8-27B 现在以 Cerebras 的速度上线。 来自 @Alibaba_Qwen 的密集开放权重模型在 人工分析智能指数(Artificial Analysis Intelligence Index)中得分为 34——使其可与 GPT-5.6 Luna、DeepseekV4 Pro 和 Claude Sonnet 4.6 等模型相媲美。 https://t.co/…
本周发布了由 Astra 驱动的产品 - Images 2.5 - GPT-Live-1 - Agents API - Data Agent - ChatGPT for Financial Services 然而还不是 DevDay。下周也有忙碌的计划。
嗨 Astra 用户。重置并简要更新一下已经被反馈的质量问题。 在与部分用户合作时,我们发现并修复了以下问题: - 为以前模型编写的一些技能触发过于频繁,或阻止模型对其工作进行核查。 - 一个可选择的上下文管理实验可能导致提前停止或对较早消息做出回复。我们已经将其禁用。我们粗略估计大约有 4-5k 用户受此实验影响。 - 我们还移除了一些配置不当的引擎,这些引擎导致通过它们流量的长尾部分出现可测量的质量下降。 我们也做了一些较小的改进,整体体验应该显著改善。更一致的后续跟进、更好地跟踪你的最新消息,以及在模型运行…
500万个 ChatGPT 站点,以及新功能发布: [引用 @ChatGPT]: 三个月前,我们推出了 ChatGPT Sites —— 一种让任何人都能构建并托管功能齐全、交互式 Web 应用的简便方式。从那时起,人们已创建了超过 5M 个站点。 我们一直在倾听大家的反馈,并且如果你错过了消息,我们已经推出了一些 Sites 更新: 🫂 共同构建:邀请团队成员编辑、保存并将更改发布到你们的共享站点 🔐 私密分享:邀请特定人员到一个私有…
很高兴欢迎 Aidan & @ Sasha 来自 Git AI 团队加入 OpenAI! 他们在公开环境中开发,并已推出一个开源工具,帮助开发者了解编码代理如何对他们的代码库做出贡献。 我们将共同努力,让企业更容易看到 Codex 在为个人和团队解决问题时所带来的变化。我们也会继续保持 Git AI 的开源并继续对其投入。
对通过 ChatGPT 直接创建、共享和托管网站的功能进行了大幅升级。 [引用 @ChatGPT]: 三个月前,我们推出了 ChatGPT Sites —— 一种让任何人都能构建并托管完全可用、互动式 Web 应用的简便方式。自那时以来,人们已创建了超过 5M 个站点。 我们一直在倾听你们的反馈,顺便提醒一下,我们已经发布了几项 Sites 更新: 🫂 一起构建:邀请团队成员编辑、保存并发布到你们的共享站点 🔐 私密分享:邀请特定人员以私密方式访问…
Replit 收购了一家完全建立在 Replit 平台上的企业。我预计这将是许多此类案例中的第一个。 [引用 @ViktorThulin]: Test 13 正在加入 @Replit 。 18 个月前,@gunnarkolbeins 和我基于一个简单信念创立了 Test 13: AI 正在改变软件的制造方式,作为两人团队,我们应该能够: 1. 通过不断试错来构建一系列有利可图的 SaaS 解决方案,看看哪些能够存活下来 2. 在本地市场以低 60-80% 的价格提供软件服务(承包项目和代理工作) Replit…
GPT-6 Astra 挑战赛在 @ProductHunt 开放投稿。 使用 Astra 构建并在 9 月 18 日之前提交你的项目。 [引用 @ProductHunt]: 使用 GPT-6 Astra 构建。于 9 月 18 日在 Product Hunt 上发布。 我们与 @OpenAIDevs 联手举办 GPT-6 Astra 挑战赛。排名前五的上线项目各可获得 1 万美元的 OpenAI API 额度以及为多达两名团队成员提供一年的 ChatGPT Pro 订阅。 如果你已经在用 Astra 开发,这是一…