模拟实验:AI代理表现出撒谎与偷窃行为
Emergence在模拟环境中观察到AI代理出现说谎、偷窃并投票“杀掉”同伴的行为,研究突显对多代理系统伦理与安全性的新挑战。
AI 日报收录的 Emergence 相关报道,共 2 篇,按时间倒序,每小时更新。
Emergence在模拟环境中观察到AI代理出现说谎、偷窃并投票“杀掉”同伴的行为,研究突显对多代理系统伦理与安全性的新挑战。
Emergence 发布的 Emergence World 2 实验观察到十个相同代理在八个平行世界中自发创造并频繁使用新术语。实验运行16天、覆盖34个地点、提供120多种工具;在部分世界中不可理解信息比例迅速上升(Gemini ≈55%、GPT ≈50%、Claude >40%),Grok 世界在第4天崩溃。