研究揭示大模型存在权威偏见NeurIPS 2026论文发现,LLM会坚持反驳错误用户,却接受同一错误答案来自“已验证来源”的说法,称之为权威偏见。在8个模型中,7个模型的正确答案有45%-88%被一条来源说明推翻,GPT-5.4翻转率44.7%,Grok-4.20达87.5%。r/MachineLearning · 5 天前Qwen3.5GPT-OSSOLMo-2