主要来源arXiv: OpenAI
查看原文事件专题 ·官方一手
MCP 错误信息为人类开发者编写,反而最伤强智能体
研究分析了 150 个常用 MCP server 中的 3,001 条错误信息,其中 949 条指示调用者执行下一步操作,一半步骤依赖 server 无法感知的调用方环境。用五个 OpenAI 模型在 Berkeley Function Calling Leaderboard 任务上测试,发现凭证过期时错误信息里的终端命令导致任务恢复率只剩 45%,且损失从 GPT-5.5 的 18 分扩大到 GPT-6 Astra 的 69 分;GitHub 的限流提示 "Wait before retrying." 让恢复率降到 6%。补救方面,MCP 开发者在错误信息中直接指名 server 工具可将恢复率提升到 84%-88%,智能体开发者用一句提示词在模型读取前删除该步骤也能恢复到 82%。
当前结论
这篇论文实测了 MCP 报错文案怎么坑智能体:能力越强的模型损失越大,还给了两个能让恢复率翻倍的改法,做 Agent 或 MCP 开发的都该看看。
11 个信源44° AI 热度最后更新 2026/9/28 15:14:46
证据链
11 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。