rlhf
general · 首次出现 2026-05-22 · 最近出现 2026-09-04 · 累计提及 59
综述
相关报道
10 条在档- PreferenceEKF 实现高效主动奖励学习arXiv cs.LG
- 用 DPO 微调语言模型并审计偏好偏差marktechpost
- 斯坦福课程讲解大模型构建原理AI Will
- 自动驾驶伦理决策头:用RLHF将道德规范转化为奖励信号arXiv cs.LG
- 奖励函数设计框架:从目标到特征到人类对齐arXiv cs.LG
- MISA-T:混合RL rollout调度新策略,吞吐提升53.3%arXiv cs.LG
- Nathan Lambert 新书专讲大模型 RLHF,配套 13 讲课程免费向阳乔木
- 每个模型都在做你付费让它做的事:RLHF与后训练实例AI Engineer
- 从RLHF到RLVR:大模型写作能力为何变差向阳乔木
- Claude Opus 5基准测试虚高?Anthropic新训练方法引发对齐担忧AI Will