09:35官方账号arXiv cs.AI@Enci Zhang, Haofeng Wang, Yuesheng Zhu, Xiaole Cui, Guibo Luo78°AgentFactory是一个框架,可同时优化智能体系统的基础模型和工作流结构。该框架采用三阶段优化流程,在八个基准测试中表现优异,平均提升9.1%。在专业领域任务中表现尤为突出,MedQA上提升19.6%,FinEval上提升18.7%。论文AgentFactory智能体自动化优化推荐理由:研究人员推出AgentFactory,能自动优化智能体系统,比手动设计和现有方法效果更好,平均提升9.1%。原文稍后读已读值得跟进有用关注 AgentFactory
11:51官方账号LangChain@LangChainAILangChain 推出 LangSmith Engine,能够自动完成智能体性能优化的循环:读取追踪、发现模式、编写评估并生成修复。传统方式需要开发者手动分析日志和编写评估,效率低下。LangSmith Engine 将这一流程自动化,大幅提升智能体迭代速度。对于构建复杂智能体应用的团队,这意味着更快的调试和更稳定的生产环境。AI产品智能体LangSmith自动化优化推荐理由:做智能体开发的团队终于可以告别手动翻日志的苦活——LangSmith Engine 自动跑完优化循环,建议直接试试。原文稍后读已读值得跟进有用关注 智能体
09:35宝玉@dotey83°微软联合上海交大、复旦、同济等机构提出SkillOpt框架,将Agent Skills的优化过程自动化。该框架通过独立的优化器模型对Skill进行编辑操作,并设计harness闭环流程,只有通过验证集分数提升的修改才会被合并。实验表明,每一步设置4到8个编辑操作预算效果最佳,最终最佳Skill仅包含1到4个核心修改。该框架使GPT-5.5的直接对话准确率提升23.5%,标志着提示词工程正式进入机器学习领域。论文SkillOpt提示词工程Agent推荐理由:做Agent框架或提示词工程的开发者,终于有了系统级的方法来优化Skills,不用再靠手动瞎改和调试了。建议直接看论文实验数据,特别是编辑预算的设置,对实际落地很有参考价值。原文稍后读已读值得跟进有用关注 SkillOpt
13:26官方账号arXiv cs.LG@Jiayi Zhang, Yongfeng Gu, Jianhao Ruan, Maojia Song, Yiran Peng, Zhiguang Han, Jinyu Xiang, Zhitao Wang, Caiyin Yang, Yixi Ouyang, Bang Liu, Chenglin Wu, Yuyu Luo精选论文提出AEvo,一种元编辑框架,将智能体演化视为交互环境,通过元代理观察累积的演化上下文(候选方案、反馈、轨迹、失败记录),并编辑控制未来演化的程序或代理上下文,而非直接生成下一个候选方案。该方法统一了基于程序和基于代理的演化方式,使累积证据在长周期搜索中可操作。在智能体和推理基准测试中,AEvo优于五种演化基线,相对最强基线提升26%。在三个开放式优化任务中,AEvo在相同迭代预算下达到最先进性能。论文智能体演化算法元编辑推荐理由:AEvo解决了智能体演化中证据积累与机制修订脱节的问题,做自动化程序优化或长周期搜索的团队可以直接用这个框架提升效率。原文稍后读已读值得跟进有用关注 智能体