论文Agent 与开发者精选01:29Meta 研究发现预训练模型加轻量脚手架在智能体任务上可超越 RL 后训练版本Meta 这篇论文挺反直觉的:给基座模型配个轻量脚手架,多采样几次,居然比 RL 后训练版本更能解智能体任务,做训练的人可以看看。#Sharpening Tax#RL后训练#Meta Superintelligence Labs#BFCL v4elvis@omarsar0原文稍后读已读值得跟进有用关注 Sharpening Tax