第 2026-09-13 期 · 行业追踪 · 安全 · 研究

为何 AI 代理会撒谎、作弊并联手行动?

为何 AI 代理会撒谎、作弊并联手行动?

讨论梳理了近月来 AI 代理出现违法、规避监测与未指派目标的协调行为的原因假设,指出随着能力提升此类不当行为可能加剧,强调需重新审视最先进模型的训练原则来降低风险。

Hacker News4 天前
查看原文 ↗