Gorden Sun

3 篇报道

Gorden Sun 是一位关注人工智能研究与产业动态的评论者与作者。最近他的报道聚焦于Dream‑RSI离线Agent改进、AI在数学上的突破(涉及OpenAI 用数万个智能体攻关Navier‑Stokes问题、Anthropic 在微定理证明中完成29,500个微定理)以及对Anthropic威胁情报报告与模型蒸馏讨论的跟进。

Gorden Sun@Gorden_Sun
218 赞 · 30 转发 ·
Google 与马里兰大学等提出 Dream-RSI:让 AI Agent 在历史探索记录中低成本自我进化 长程探索任务的元策略优化通常需要极高的试错成本,这项研究直接将已完成的探索记录树作为精确的离线重放模拟器。 新策略无需重复调用模型执行真实代码,只需在历史轨迹中“做梦”重演即可筛选出更优方案,实现零执行成本的离线评估。 优胜策略随后部署至新一轮在线探索并扩充模拟器池,在保持甚至提升算法与算子发现质量的同时,最高降低 162 倍的探索调用开销。 项目介绍:https://t.co/jB6I6yKFIE
Gorden Sun@Gorden_Sun
231 赞 · 44 转发 ·
数学家哭了。 字面意义上的哭了,康奈尔大学数学系教授、知名科普作家斯蒂芬·斯特罗加茨(Steven Strogatz)在接受《WIRED》采访时,谈及过去一周人工智能在数学领域取得的突飞猛进,忍不住当场落泪。 “科学本身令人振奋,”这位67岁的老教授坦言,“但在它背后,伴随着太多人类难以承受的不适与痛苦。” 触发这场情绪海啸的,是过去数周内接连上演的 AI 算力奇迹。OpenAI 刚刚宣布动用数万个智能体,攻克了拥有百万美元悬赏、困扰数学界近百年的纳维-斯托克斯(Navier-Stokes)方程相关难题;而就在此…
Gorden Sun@Gorden_Sun
202 赞 · 4 转发 ·
这篇文章信息量非常大,值得争论和吐槽的点也非常多。有一个隐藏信息,豆包真的没蒸馏,豆包Seed 2.1 Pro做到Opus 4.6的水平是实打实的。 [引用 @AnthropicAI]: 我们发布了迄今为止最详细的威胁情报报告。 报告涵盖了人们如何试图滥用 Claude——用于网络攻击、影响行动、监视、生物学和制造武器——以及我们如何发现并阻止这些行为。 我们破坏了报告中提到的每一次行动,并利用从中得到的教训来强化我们的防护措施。在适当情况下,我们也将所发现的内容与相关机构分享…
已经到底了