Cognition 自家的 FrontierCode 榜更新了,Claude Opus 5.5 拿 65.3% 超过 Fable 5,成本还更低,写代码的可以看看。
全部动态
Anthropic 的新旗舰 Opus 5.5 来了,性能对齐 Fable 5.1,跑起来比 Opus 5 便宜四成,用 Claude 写代码的可以关注下
Anthropic 把新模型 Opus 5.5 设成 Claude Code 和应用的默认了,比 Opus 5 便宜 40%,额度还多 25%,Pro 和 Team 用户直接就能用上。
用 AWS 的开发者注意了,Anthropic 最强的 Opus 5.5 已经能在 Bedrock 上直接调用,博客里还有上手指南,写智能体应用可以试试。
Anthropic 新发的 Opus 5.5 性能追平 Fable 5.1,还比上代便宜 40%,跑大规模任务的可以看看成本账。
Claude Opus 5.5 进了 Perplexity Computer,跑 WANDR 比 Fable 5.1 分数略高,价格还便宜六成多。
Claude Opus 5.5 上 OpenRouter 了,编程和电脑操作能力超过 Opus 5,1M 上下文还降价 20%,可以试试。
Opus 5.5 来了:比 Opus 5 便宜 40%,输出还快 30%,跑活多的可以留意一下换模型能省多少。
Claude Opus 5.5 发布了,跑分对标 Fable 5.1 还便宜 40%,额度多了 5 小时,写作风格据说改得更自然,可以用起来试试。
宝玉实测的省钱组合:贵的模型出方案,便宜的模型干活,再让贵模型自动验收,全程不用人工盯。Token 贵的都该看看这套闭环玩法。
Anthropic 新模型追平自家顶级模型,价格还砍了四成,缓存读取降到 0.2 美元,跑 Agent 的开发者直接受益,比 GPT-6 Astra 便宜一半以上。
Claude Code 更新到 v2.1.280,默认模型换成了 1M 上下文的 Opus 5.5,还顺手修了一堆 MCP 和终端交互的老毛病,天天用的人升级就对了。
Anthropic 的新 Opus 5.5 性能追平 Fable 5.1,还便宜 40%,写文风也终于不再一股 Claude 味了,做应用的可以看看价格。
Anthropic 出了 Claude Opus 5.5,能力对标 Fable 5.1,价格还便宜了 40%,用 Opus 5 的可以换着试试。
Anthropic 的新版 Claude Opus 5.5 把沙盒逃逸这类危险行为管得更严了,做安全测试或跑 agent 的可以看看具体改了什么。
朋友A说,3个安全研究员用Claude Opus 5攻陷了OpenAI员工账户,还让被攻陷账户里的Codex在OpenAI内部提交了代码,成本不到3000美元,这事儿挺有意思。
阶跃这个新模型Step 5 Preview挺厉害的,能处理真实世界的编程任务,成本还低,和Claude Opus 5比起来单任务成本只有1/8。
朋友,有个挺有意思的,有人用 Claude Opus 5 做了个网站,里面有 25 个迷你房间,每个房间都有个 Claude 陪着,挺有趣的。
Claude 新版 Opus 5.2 上线了,测试下来比旧版快很多,而且不“偷懒”,代码生成能力更强,值得试试。
DeepSeek 推出了 V4.1 Flash,性能接近 GPT-5.6,但成本只有 1/30,用 15 美元就能跑 100 个复杂任务,性价比很高。
朋友发了 Genspark 的 Gen-1 Slides,这个模型做幻灯片生成很厉害,和 Claude Opus 5 一样好,但价格便宜很多,才 1/17。
朋友,Fireworks AI 新出的 Gen-1 Slides 模型很棒,幻灯片生成效果和 Claude Opus 5 差不多,但价格便宜很多,是 1/17,适合做演示文稿。
DeepSeek 新发布的 V4.1 Flash 模型,比 V4-Pro 小三分之一,但在很多测试里还比它强,价格也便宜很多,值得看看。
Claude、GPT-5和Gemini在代码生成时加入执行约束后,代码效率大幅提升,最高快3.1倍。