第 2026-09-14 期 · 行业追踪 · 研究 · 开源当LLM评审一致时,应否信任它们?讨论提出用依赖感知的Ising模型对LLM评审面板中的相关性建模,以区分独立证据与共享失误,在无人工参考下可提升9–14%准确率并建议报告经相关性校正的置信度。Hacker News3 天前查看原文 ↗话题:Ising modelLLM judges