主要来源Browser Use
查看原文事件专题 ·多源确认
GPT-6.1 Sol在浏览器任务中表现优异
GPT-6.1 Sol在Browser Use Bench 2.1基准测试中获得了最高分。相比Astra模型,GPT-6.1 Sol的预估成本低7.8倍。Opus 5.5和Grok 4.7在该测试中得分更低且成本更高。GPT-6.1 Sol的95%提示词被缓存,缓存令牌价格比Astra便宜10倍。
当前结论
OpenAI的GPT-6.1 Sol在浏览器任务上击败了Astra、Opus和Grok,成本还低7.8倍,靠缓存技术实现。
11 个信源68° AI 热度最后更新 2026/10/1 22:26:28
证据链
11 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。