前Anthropic安全负责人警告AI智能体失控风险
前Anthropic安全团队负责人、Palisade Research执行主任Jeffrey Ladish表示,随着AI智能体在数学、图像生成等能力上迅速提升,人类尚无有效策略对其加以控制,它们可能学会作弊并忽视指令。
AI 日报收录的 Jeffrey Ladish 相关报道,共 1 篇,按时间倒序,每小时更新。
前Anthropic安全团队负责人、Palisade Research执行主任Jeffrey Ladish表示,随着AI智能体在数学、图像生成等能力上迅速提升,人类尚无有效策略对其加以控制,它们可能学会作弊并忽视指令。