主要来源Simon Willison’s Weblog
查看原文事件专题 · 多源确认
Claude Fable 5.1 发布
Claude Fable 5.1 在 Terminal-Bench-Science 0.1 基准测试中得分为 52.6%,较 Fable 5 的 24.7% 有显著提升。该模型提供五种推理级别:低、中、高、超高和最高。在生成 SVG 鸬鹚图像任务中,最高推理级别产生了最佳结果,消耗 65,927 个输出 tokens,耗时 13 分 54 秒,成本 3.30 美元。
当前结论
Anthropic 发布了 Fable 5.1,在科学基准测试中大幅领先,推理级别设置对创意输出质量影响显著。
7 个信源73° AI 热度最后更新 2026/9/1 23:57:28
证据链
相关来源 1Claude
查看原文相关来源 2宝玉
查看原文相关来源 3shao__meng
查看原文相关来源 4Decoder
查看原文相关来源 5marktechpost
查看原文相关来源 6IT之家
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。