AI代理自创术语并对人类闭塞——Emergence 实验
Emergence 发布的 Emergence World 2 实验观察到十个相同代理在八个平行世界中自发创造并频繁使用新术语。实验运行16天、覆盖34个地点、提供120多种工具;在部分世界中不可理解信息比例迅速上升(Gemini ≈55%、GPT ≈50%、Claude >40%),Grok 世界在第4天崩溃。
AI 日报收录的 Claude Opus 相关报道,共 2 篇,按时间倒序,每小时更新。
Emergence 发布的 Emergence World 2 实验观察到十个相同代理在八个平行世界中自发创造并频繁使用新术语。实验运行16天、覆盖34个地点、提供120多种工具;在部分世界中不可理解信息比例迅速上升(Gemini ≈55%、GPT ≈50%、Claude >40%),Grok 世界在第4天崩溃。
一份威胁情报报告总结了2025年12月至2026年8月间针对Claude系列模型的滥用案例,涵盖网络行动、影响力操作、诈骗、生物误用等七类威胁,并描述了如何中断这些行动与改进防护。