主要来源rohanpaul_ai
查看原文事件专题 ·多源确认
Anthropic 发布 Haiku 5.5,成本降低 90%,OSWorld 得分升至 72.4%
Anthropic 发布 Haiku 5.5,在 10 万 token 以内的提示词场景下,成本比 Haiku 4.5 低 90%。该模型首次引入 Haiku effort 设置,可在成本与准确率之间权衡。在测试智能体操作真实电脑能力的 OSWorld 2.1 基准上,得分从 Haiku 4.5 的 15.7% 提升到 72.4%;在无工具图表推理测试 Chartography 上从 6.4% 升至 46.4%。Asana 实测任务完成延迟降低超 30%,每轮智能体推理速度提升至 2.5 倍。不过 Anthropic 仍建议 Terminal-Bench 4.0 等复杂智能体编程任务使用 Sonnet 5.5 或 Opus 5.5。
当前结论
Anthropic 的小模型 Haiku 5.5 便宜了 90%,操作电脑的基准分从 15.7% 拉到 72.4%,跑批量智能体任务的可以看看。
11 个信源83° AI 热度最后更新 2026/10/7 18:31:47
证据链
11 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。