模型多源确认88°

Anthropic 发布 Claude Haiku 5.5:价格降 90%,上下文扩到 100 万 token

精选理由

Anthropic 的新款小模型 Haiku 5.5 便宜了九成,上下文还扩到 100 万 token,跑高并发任务的成本直接打下来了,做客服、分类、子代理的团队可以看看。

Anthropic 发布 Claude Haiku 5.5,10 万 token 以下请求输入 $0.10/M、输出 $0.50/M,比上代 Haiku 4.5 便宜约 90%。上下文窗口从 20 万扩到 100 万 token,最大输出翻倍至 12.8 万。OSWorld 2.1 成绩从 15.7% 跃升至 72.4%,Terminal-Bench 4.0 从 0.0% 升到 39.2%,在所有共享基准上超过 GPT-6 Luna。它也是首个支持 effort 参数的 Haiku 级模型,可在 low/medium/high 间调节成本与智能的平衡。同步更新包括 Sonnet 5.5 cache reads 降价 50%、Max 用户每月赠送 API credits、SDK 新增 computer use 和 browser use beta 支持。

原文 · berryxia

Anthropic 又发布新模型! 昨晚发布了 Claude Haiku 5.5,直接把小模型的性价比拉到了一个新台阶:10 万 token 以下的请求,输入 $0.10/M、输出 $0.50/M,比上代 Haiku 4.5 便宜约 90%。

上下文窗口从 20 万直接拉满到 100 万 token,最大输出也从 6.4 万翻到 12.8 万。

定位很明确:高并发、低成本的重复性任务:摘要、压缩(compaction)、分类、数据库查询、实时客服,以及给 Opus 5.5 / Sonnet 5.5 当子代理跑编码任务。

速度是目前 Claude 全系最快,特别适合浏览器操控(browser use)和计算机操作这类对延迟敏感的场景。

性能上跃升幅度相当夸张:OSWorld 2.1 从 Haiku 4.5 的 15.7% 跳到 72.4%,Terminal-Bench 4.0 从 0.0% 到 39.2%,FrontierCode 1.1 拿到 46.4%。

Anthropic 给出的对比表里,Haiku 5.5 在所有共享基准上都超过了 GPT-6 Luna。 同时它也是首个支持 effort 参数的 Haiku 级模型,可以在 low / medium / high 之间调节,按需在成本和智能之间取舍。

同步还有三个更新值得注意: 一是 Sonnet 5.5 的 cache reads 降价 50%(从 $0.20 降到 $0.10/M),Agent 任务整体成本降约 20%。

二是 Max 5x 用户每月送 $100 API credits、Max 20x 送 $200、Team 送 $500,方便用户在 Claude Platform 上直接搭 Agent 和应用。

三是 Python / TypeScript SDK 新增了 computer use 和 browser use 的 beta 支持。

模型名 `claude-haiku-5-5`,Claude Platform、AWS、Google Cloud、Azure 全平台可用。

对跑高并发分类、路由、子代理、客服这类场景的团队来说,以前要么忍受 Haiku 4.5 的能力短板,要么多花钱上 Sonnet,现在基本不用纠结了。