当LLM评审一致时,应否信任它们?讨论提出用依赖感知的Ising模型对LLM评审面板中的相关性建模,以区分独立证据与共享失误,在无人工参考下可提升9–14%准确率并建议报告经相关性校正的置信度。Hacker News · 3 天前 · 详情Ising modelLLM judges