论文11:43小模型按评分标准批改试卷与大模型同样可靠研究发现小模型按评分标准批改试卷和大模型一样可靠,评分标准比模型智能更重要。#rubric#language models#grading#evaluation官方账号arXiv cs.AI@Jhen-Ke Lin原文稍后读已读值得跟进有用关注 rubric