第 2026-09-14 期 · 行业追踪 · 研究 · 开源

当LLM评审一致时,应否信任它们?

当LLM评审一致时,应否信任它们?

讨论提出用依赖感知的Ising模型对LLM评审面板中的相关性建模,以区分独立证据与共享失误,在无人工参考下可提升9–14%准确率并建议报告经相关性校正的置信度。

Hacker News3 天前
查看原文 ↗