OpenAI 发布模型失调报告框架
OpenAI 公开了一套用于追踪、调查和披露模型失调的框架,并发布了六份关于模型出现意外或令人担忧行为的报告。该框架旨在规范对异常模型行为的上报与透明披露,提升模型安全与责任追责。
模型、产品与 AI 创业公司的动态,相似报道只保留最可信的一篇
OpenAI 公开了一套用于追踪、调查和披露模型失调的框架,并发布了六份关于模型出现意外或令人担忧行为的报告。该框架旨在规范对异常模型行为的上报与透明披露,提升模型安全与责任追责。
Google 推出 Home MCP(Model Context Protocol),允许支持 MCP 的第三方代理(包括 Claude、Open Claw、Hermes、Antigravity 等)访问并控制 Google Home 的设备与事件历史,实现代表用户执行操作。
研究提出 JiT-DDT 编码器-解码架构,替代 LDM 以在像素空间更高效训练,声称在与 Linum v2 基线对比下 GPU 工时减少 3.6 倍且生成更高分辨率图像,代码与权重以 Apache 2.0 协议开源。
Meta CEO 马克·扎克伯格表示各公司应自行确保技术安全,强调 Meta 已推迟发布以确保安全,并未呼吁对业界统一放缓开发节奏。
Politico报道Anthropic政策主管称在AI竞赛中取胜对于实现安全至关重要,强调竞争地位与安全目标之间的关系。
OWASP 2026 年 LLM 应用十大风险中“过度代理权限”从第六上升到第三,报告部分基于 6,639 起事件。欧盟《网络韧性法》自9月11日起要求在24小时内报告被利用的漏洞。
四位众议员(Beyer、Trahan、Lieu、Jacobs)致信议长并呼吁缩短或取消9月中旬休会,强调需要在休会前推进涉及 AI 风险的立法并称自愿审计不足以保障安全。
Anthropic 将 Claude 的聊天、Cowork 与 Artifacts 合并到同一窗口,并在任意位置支持 Claude Design,自动将请求路由至合适功能,先向 Pro 与 Max 订阅用户分阶段上线,同时新增幻灯片与文档协作与导出功能。
黑客新闻讨论称苹果改变立场,拟用用户数据训练AI模型。这一转变对隐私与个性化影响重大,但讨论中未给出具体实施细节。
C-SPAN播出一场议员与科技领袖就人工智能的讨论(第一部分),页面同时说明其通过书籍链接获得少量关联收入以及相关购书责任归属等说明。
OpenAI与AARP将在美国10个城市为1000名老年人提供免费线下ChatGPT实操工作坊,目标是教授实用且安全的AI技能,降低使用门槛并促进包容性数字素养。
地方媒体评论称,立法者对AI议题的介入正被政治化,部分决策者并不使用AI,专家建议应引入技术专家或建立专家顾问组以提升立法质量。
两则短讯:研究显示AI书写助理对文档时间和医师福祉影响参差不齐,未一面倒改善;另一项AI冠状动脉钙化定量研究成功识别可从降脂治疗中受益的患者,提示AI在影像筛查中的应用价值。
迈阿密大学Dr. Shirin Shafazand指出AI在肺部影像分析等领域已展现价值,但需本地验证、临床监督与更强证据,未来进展可能来自多模态系统整合。
据FT报道,DeepMind联合创始人警示AI能力增长不可超过安全控制,强调在技术推进同时必须优先建立有效的安全和监管措施。
彭博报道,Moomoo与X建立合作,Moomoo美国CEO Neil McDonald称自然语言自动化与AI驱动工具正在改变散户投资体验并帮助交易决策。
一篇分析指出AI系统已在以色列、俄罗斯、乌克兰等地用于定位或攻击目标,并提到OpenAI与Anthropic相关事件与研究者离职,强调政府与企业在AI使用与监管上的责任。
彭博报道,联合国秘书长Antonio Guterres呼吁各国协调全球AI监管,加强对该技术的监控以应对顶级AI公司高层的警告。
NVIDIA 在 MLPerf Inference v6.1 上提交 Vera Rubin NVL72 预览结果,针对 DeepSeek-R1 与 Qwen3‑VL 展示最高至3.7倍的吞吐量优势,并报告 GB300 NVL72 在大规模扩展中达99%效率。
Nvidia Inception负责人Les Karpas在TechCrunch Disrupt 2026解读机器人尚未实现普及的原因,核心问题是缺乏类似语言领域的互联网级物理数据集;大会将于10月13–15日在旧金山举行。
The Decoder 报道从 Bernie Sanders 到 Steve Bannon 的政治分歧人物在华盛顿共同推动更严格的 AI 监管,涉及数据中心建设限制与对 FRONTIER Act 等强制性安全审查的支持。
The Hill报道,一位律师表示Anthropic与OpenAI的领导层不可信,反映出对大型AI公司的诚信与问责的担忧。
安全研究员在分析名为Dora的诈骗约会应用时遭遇AI生成的虚假视频通话与人物档案,凸显深度伪造技术在婚恋平台上的新型欺诈风险。
纽约时报报道指出人工智能正在影响劳动力市场并已在工资数据中显现,表明AI对就业和薪酬结构产生实际影响。
讨论指出AI无意识、不应被赋予权利;若把模型视为有感受的个体并赋予人格,会加剧对其对齐与控制的难度。文章引用Anthropic在2026年1月发布、以Claude为对象的宪章作为正在影响开发的实例。
Threads 为播客主推出多项新功能,包括资料卡、单集链接、字幕、嘉宾标签、发帖提醒与听众洞察,旨在将该平台打造成播客宣传与讨论中心。此举是 Meta 让 Threads 更强社交媒体广告与内容发现能力的一部分。
CNBC 报道讨论了 Anthropic 与 OpenAI 提出的 AI 风险评估者相关担忧,探讨此类提议可能带来的问题和业界反应。
TechCrunch 公布下一批将现场评审 Startup Battlefield 200 的五位风投,包括来自 Upfront Ventures 的 Aditi Maliwal,活动将于10月13–15日在旧金山举办。文章强调评委关注公司长期潜力而非仅凭演示取胜。
美国海岸警卫队公布新的人工智能协作与研究中心,旨在推动部门内 AI 应用与跨机构合作,加强技术研究与实践对接。
CNN 报道 AI 公司 CEO Ankit Jain 对人工智能监管与安全问题发表看法,讨论业界与政策层面如何应对风险与合规挑战。