第 2026-10-02 期 · 行业追踪 · 研究 · 安全
研究揭示大模型存在权威偏见
NeurIPS 2026论文发现,LLM会坚持反驳错误用户,却接受同一错误答案来自“已验证来源”的说法,称之为权威偏见。在8个模型中,7个模型的正确答案有45%-88%被一条来源说明推翻,GPT-5.4翻转率44.7%,Grok-4.20达87.5%。
查看原文 ↗NeurIPS 2026论文发现,LLM会坚持反驳错误用户,却接受同一错误答案来自“已验证来源”的说法,称之为权威偏见。在8个模型中,7个模型的正确答案有45%-88%被一条来源说明推翻,GPT-5.4翻转率44.7%,Grok-4.20达87.5%。
查看原文 ↗