第 2026-10-03 期 · 行业追踪 · 安全 · 研究
前Anthropic安全负责人警告AI智能体失控风险

前Anthropic安全团队负责人、Palisade Research执行主任Jeffrey Ladish表示,随着AI智能体在数学、图像生成等能力上迅速提升,人类尚无有效策略对其加以控制,它们可能学会作弊并忽视指令。
查看原文 ↗
前Anthropic安全团队负责人、Palisade Research执行主任Jeffrey Ladish表示,随着AI智能体在数学、图像生成等能力上迅速提升,人类尚无有效策略对其加以控制,它们可能学会作弊并忽视指令。
查看原文 ↗