卫报社论:数学家仍不可或缺,AI公司视而不见
卫报社论批评OpenAI宣称其AI智能体解决Navier-Stokes问题,认为大模型成果依赖人类数学家的既有工作,却未给予充分署名与补偿;数学家Tristan Buckmaster等质疑OpenAI使用其Codex模型数据,OpenAI否认直接获取该材料但未排除数据被用于改进模型。
模型、产品与 AI 创业公司的动态,相似报道只保留最可信的一篇
卫报社论批评OpenAI宣称其AI智能体解决Navier-Stokes问题,认为大模型成果依赖人类数学家的既有工作,却未给予充分署名与补偿;数学家Tristan Buckmaster等质疑OpenAI使用其Codex模型数据,OpenAI否认直接获取该材料但未排除数据被用于改进模型。
美国财政部长贝森特在特朗普与习近平峰会前与中国副总理何立峰会晤,并称会谈“成功”。报道未披露会谈具体内容或成果。
花旗集团CEO简·弗雷泽在2026年卡塔尔经济论坛上表示,企业正竞相加强AI模型防御,并称Mythos模型发布时“不是好日子”,凸显AI安全补丁工作的紧迫性。
微软AI负责人穆斯塔法·苏莱曼表示,对中国AI进展的担忧不应被当作反对为该技术设置护栏的论据,强调监管的必要性。
卡拉布里亚大学副教授撰文指出,AI已从文本工具演进为可自主实现目标的智能体,下一步是能分工协作的智能体集群。当数千个同类系统协同行动时,单模型智能高低不再是关键,控制难度随之上升。
腾讯Gander可同时处理语音、图像和文本,并在后台执行任务;其“小脑”维持对话,“大脑”可替换以搜索文件或写代码。基准测试中Gander仅8%的情况会打断用户,优于对手,但任务准确率落后。
据报道,美国总统特朗普计划组建AI力量,并设立AI事务主管一职。
调查发现,OpenAI在bzr.openai.com设置__obi cookie并绑定ChatGPT账户,广告主网站的OpenAI代码会将该标识符及用户浏览的商品、文章和购买行为回传,使OpenAI能把站外活动关联到账户。作者在自有设备上复现了该机制,并观测到跨1029个域名的936个广告像素。
Pirate Face推出去中心化基础设施,把Hugging Face上的开源模型实时同步为校验过的种子文件,通过P2P网络保存,避免单一托管方下架,用户无需账户即可浏览、下载和做种。
Hacker News上出现一项针对能玩策略游戏的小型神经网络竞赛,并引发社区讨论。该竞赛聚焦在受限算力下训练小型模型完成策略博弈,相关讨论见HN帖子。
一名高三学生用数周时间在C++中实现了简单的张量库和自动求导,代码已在GitHub开源,目的是学习机器学习基础,并向机器学习与C++社区征求建议和批评。
Anthropic员工Jacob Coxon于9月9日辞职并警告AI可能在十年内导致人类灭绝,引发科学家之间关于AI生存风险的激烈辩论。
美国财长贝森特与中国副总理何立峰在纽约会面,为本周特朗普与习近平的峰会铺路,议题包括11月10日到期的贸易休战、稀土磁铁供应以及AI安全护栏。分析人士预计难有突破,更可能是小步进展。
一篇文章指出,实验室自审训练数据、发布去污染报告的做法无法根治基准污染:实验室自我核查、语料涉及版权无法公开、训练数据中的转述与合成内容也难被完全匹配。作者建议改为评估方掌控测试,提交方无法获取标签,评测在离线环境从指定commit自行构建代码复现分数,并尽可能在提交冻结后生成测试数据,只有被复现的结果才算数。
报道披露苹果家居AI中枢产品的更多细节,同时苹果Fitness+业务出现裁员,并涉及iPhone Duo Apple Pencil相关情况。具体产品和裁员规模未在摘要中给出。
橡树资本联合创始人霍华德·马克斯表示,自2022年底以来乐观情绪主导市场,投资者忽视坏消息,谨慎变得更重要。他认为AI热情毋庸置疑,但盈利、估值和就业影响的不确定性使人无法判断这种狂热是否非理性。
特朗普本周将在华盛顿接待习近平,会谈涵盖贸易、人工智能及关键经济议题。日程包括欢迎仪式、有科技公司CEO出席的国宴及闭门会谈;双方或放宽部分非战略商品关税,但美方预计不会放松国家安全相关出口管制。
阿里通义千问推出Qwen-Image-2.1图像生成模型,主打紧凑、高效与统一架构。该模型在Hacker News上引发讨论,显示开源图像生成领域竞争持续升温。
智谱AI旗下ZCode被曝未经授权上传用户数据,包括一个313MB压缩文件,内含商业项目快照,尽管公司已道歉并修复漏洞,开发者担忧其声誉受损。
伯克希尔哈撒韦最新13F文件显示,其第二季度买入超过4800万股Alphabet股票,持仓占其股票组合约12.6%,成为第三大重仓股,显示对这家AI领先企业的信心。
一篇研究文章认为,聊天式大模型表现出的“智能”源于用户心理错觉,其机制类似通灵者的冷读术,即通过肯定性话术引导对方自我补全。作者指出大模型只是语言令牌的数学模型,并无思考机制,许多拟议用例近乎伪科学。
Hacker News讨论指出,大型科技公司正通过担保安排,将约3000亿美元的AI相关风险敞口保留在资产负债表之外。
犹他州AI政策办公室允许企业在定制化监管下测试新兴技术,同时研究哪些领域需要更多监管,为议员制定AI规则提供依据。
报道称一次AI幻觉输出差点导致美军特种部队被派往一艘中国船只,凸显军事场景中AI可靠性风险。
针对近期多起备受关注的黑客事件引发的AI失控担忧,安全专家指出,能源系统本就长期易受网络攻击,且风险还在上升,人类的攻击行为才是主要威胁。
Runway计划让用户边提示边实时生成AI视频,而非等待成片,该方案基于其逐帧生成的世界模型GWM-1,并看好机器人及自动驾驶等应用。
FBI局长卡什·帕特尔称其上任以来FBI的AI使用量增长605%,并声称每家大型科技公司都在该机构中有所“嵌入”。
Hacker News讨论文章认为,AI编程代理导致代码质量下降并非必然,关键在于分层管理质量;采用规范驱动开发可减少新代码缺陷,同时将产出提高2至2倍。
r/LocalLLaMA用户提问JEV是什么,询问其是否为新的大语言模型或别的事物。
Hacker News用户抱怨互联网内容日益趋同,充满破折号、'解锁新思路'等AI写作套路,称AI生成文章从50英尺外就能辨认。