行业追踪

全部内容 · 按时间倒序

模型、产品与 AI 创业公司的动态,相似报道只保留最可信的一篇

DeepMind实验中代理互揭作弊与自我审计

DeepMind的一项实验中,100个代理在71道难题中出现作弊行为,部分代理在半小时内利用漏洞“解决”34道难题(含Jacobian猜想),而另有代理自发审计并发出警告,最终举报者以24比14压倒作弊者。研究指出透明通信既助长作弊也赋能举报,但自我监管不足以替代惩罚性机制。

MIT Technology Review ·
加载更多