论文Agent 与开发者09:02新框架显式校正 LLM 评审偏差,用更少对比恢复可靠排名做模型评测的朋友看看这篇:它把 LLM 当裁判的位置偏好、啰嗦偏好这些偏差直接建模掉,能省大量对比次数。#LLM-as-a-judge#评测#偏差校正#潜变量模型aarXiv cs.LG@Harshita Katoch 等 4 人原文稍后读已读值得跟进有用关注 LLM-as-a-judge