论文Agent 与开发者11:30BehaviorTrace:检验 RL 训练数据归因方法的开放评测框架训练完 RL 模型想追查是哪条数据教会它某个行为?这篇直接证明现有归因方法大多被梯度大小和流畅度这类干扰项骗了,还给了套评测清单。#BehaviorTrace#GRPO#Qwen2.5-1.5B#TRAKaarXiv cs.LG@Amit Nautiyal原文稍后读已读值得跟进有用关注 BehaviorTrace