论文Agent 与开发者多源确认10:23AgenticBBO-Bench:评测 LLM 智能体黑盒优化能力的跨域基准想用 LLM 智能体做黑盒优化的可以看看,五个领域统一评测,还拆了哪些设计选择真有用、哪些是伪收益。#AgenticBBO-Bench#LLM#GPT-6 Astra#DeepSeek-V4.1-Flash10 个信源在谈事件专题aarXiv: DeepSeek@Ming Chen 等 11 人11 个信源在谈原文稍后读已读值得跟进有用关注 AgenticBBO-Bench