主要来源elvis
查看原文事件专题 ·单一信源
Question's Gambit:检索前先走一步,GPT-5.5 涨 7 个点
这篇论文提出 Question's Gambit,在智能体开始搜索前先把问题拆成线索,将每条线索转成互补的搜索查询,汇总结果后重排序。同样的检索器和同样的智能体循环下,GPT-5.5 在 BrowseComp-Plus 上的准确率从 83.1% 升到 90.5%,校准误差约减半。GPT-5.4-mini 从 68.1% 升到 79.0%,DeepSeek-v4-pro 从 71.4% 升到 76.9%,代价是每个问题多花约 2.3 到 5.3 次工具调用。错误分析显示,GPT-5.5 剩余的 79 个错误中只有 3 个来自金标文档从未被检索到,其余 76 个都发生在智能体预览、打开或使用证据的阶段。
当前结论
智能体出发前先搜一轮,GPT-5.5 在 BrowseComp-Plus 涨 7 个点,做深度研究智能体的可以试试这招
2 个信源49° AI 热度最后更新 2026/9/21 23:00:11
证据链
2 个信源相关来源 1arXiv cs.AI
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。