论文Agent 与开发者09:34ServeLearnBench 发布:评测智能体能否从服务经验中自我改进arXiv 上新出的 ServeLearnBench,用 7718 个任务测 RAG、Mem0 这些框架能不能让智能体边服务边学习,结论是多数还不太行。#ServeLearnBench#Mem0#RAG#智能体aarXiv: DeepSeek@Haizhong Zheng 等 5 人原文稍后读已读值得跟进有用关注 ServeLearnBench