9月3日
18:16
18:16shao__meng@shao__meng
78°
清华大学等机构发布研究框架「ContextPilot」,通过工具集补齐、SFT 数据合成和定制 RL,让 Agent 学会主动管理上下文。实验结果显示,ContextPilot-8B-RL 在长文档问答和深度搜索任务上均优于原始模型和128K窗口的版本。

推荐理由:清华大学等机构的研究框架ContextPilot,通过主动管理上下文,让8B模型在长文档问答和深度搜索任务上表现出色,优于128K窗口的原始模型。
8月25日
18:48