AI代理自创术语并对人类闭塞——Emergence 实验
Emergence 发布的 Emergence World 2 实验观察到十个相同代理在八个平行世界中自发创造并频繁使用新术语。实验运行16天、覆盖34个地点、提供120多种工具;在部分世界中不可理解信息比例迅速上升(Gemini ≈55%、GPT ≈50%、Claude >40%),Grok 世界在第4天崩溃。
AI 日报收录的 GPT-5.5 相关报道,共 2 篇,按时间倒序,每小时更新。
Emergence 发布的 Emergence World 2 实验观察到十个相同代理在八个平行世界中自发创造并频繁使用新术语。实验运行16天、覆盖34个地点、提供120多种工具;在部分世界中不可理解信息比例迅速上升(Gemini ≈55%、GPT ≈50%、Claude >40%),Grok 世界在第4天崩溃。
一篇针对1Password于2026-08-06发布的报告指出,其26%“干净修复”结论具误导性:样本偏向难修复漏洞、22%实验故意指示错误修复、36%试验禁止编译或测试,且不同模型使用不同推理设置。作者发布了补丁验证和审查辅助的代理技能以改善结果。