Anthropic 新模型 Opus 5.5 已经能在 Genspark 里直接用了,比 Opus 5 便宜四成还快三成,写代码和聊天都可以试试。
全部动态
一天之内 Opus 5.5、GPT-6 Sol/Luna、Grok 4.7、Mimo v2.6 全来了,Opus 5.5 还降了 40% 成本,这篇帮你梳理各家提升方向和 benchmark。
Vercel 又更新 Next.js 评测了,GPT-6 Sol 首秀就并列第一,Grok 4.7 便宜一半到七倍,选模型前可以看看这份榜单。
OpenAI 把 Astra 的能力做成大中小三档,Sol 跑分超 Claude Opus 5 但成本只有 9%,跑长任务智能体的开发者账单能省不少。
Claude Opus 5.5 进 Agent Arena 了,你的 toughest prompt 能直接给模型出难题投票,还能看到它在 WebDev、Vision 等赛道的对战成绩。
Anthropic 的新 Opus 5.5 又快又便宜,修 20 万行代码库从 20 小时缩到 3 小时,Agent 用户可以直接换上试试。
Anthropic 发了 Opus 5.5,能力跟 Fable 5.1 差不多但便宜四成,用 AI SDK 的可以直接接上试。
Anthropic 刚发了 Opus 5.5,编码和写作都很强,性能对标 Fable 5.1 但比 Opus 5 便宜 40%,可以上手试试。
Anthropic 出了 Opus 5.5,能力追平 Fable 5.1,价格还便宜四成,用 Opus 的可以看看换不换。
Anthropic 把 Opus 5.5 的价格砍了 40%,缓存读取还便宜 60%,跑分追平 Fable 5.1,用 Claude 写代码的可以看看降价幅度。
Anthropic 的新旗舰 Opus 5.5 来了,性能对齐 Fable 5.1,跑起来比 Opus 5 便宜四成,用 Claude 写代码的可以关注下
Anthropic 把新模型 Opus 5.5 设成 Claude Code 和应用的默认了,比 Opus 5 便宜 40%,额度还多 25%,Pro 和 Team 用户直接就能用上。
Anthropic 新发的 Opus 5.5 性能追平 Fable 5.1,还比上代便宜 40%,跑大规模任务的可以看看成本账。
Claude Opus 5.5 进了 Perplexity Computer,跑 WANDR 比 Fable 5.1 分数略高,价格还便宜六成多。
Opus 5.5 来了:比 Opus 5 便宜 40%,输出还快 30%,跑活多的可以留意一下换模型能省多少。
Claude Opus 5.5 发布了,跑分对标 Fable 5.1 还便宜 40%,额度多了 5 小时,写作风格据说改得更自然,可以用起来试试。
Anthropic 出了 Claude Opus 5.5,能力对标 Fable 5.1,价格还便宜了 40%,用 Opus 5 的可以换着试试。
谷歌推出的这个新基准测试挺有意思,专门测模型做真实 Android 开发的能力,比如从零写应用或者迁移代码,能看出不同模型在工程场景下的实际表现。
Anthropic拟10月在新加坡设亚太第五个办事处 开放本地招聘 数据显示,按人口比例计算,新加坡的Claude.ai使用水平在121个国家中排名第二。 我们观察到,人工智能公司Anthropic计划于10月在新加坡设立其亚太地区的第五…
OpenAI 的 GPT-6 Astra Max 在代码竞技场 Web 开发排名中赢了 Anthropic 的 Claude Fable,在数据分析和内容创作方面表现更好。
OpenAI 新发布的 GPT-6 Astra (Max) 在代码领域表现很强劲,比 GPT-5.6 Sol 强很多,但和 Claude Fable 5.1 比起来,用户更喜欢后者。
Anthropic 新发布的 Claude Fable 5.1 在最新 AI 指数中表现不错,和 GPT-6 Astra 并列第一,而且能帮你省点钱。
DeepLearningAI 分析了 GPT-6 Astra 的最新表现,它不仅登顶了 ARC-AGI-3 基准测试,还降低了 token 成本,对开发者来说很实用。
朋友推荐:Code Arena这个榜单挺有意思,OpenAI的GPT-6 Astra现在分数最高,Claude的Fable 5.1也还不错,看看哪个更适合做前端开发。
朋友,OpenAI和Anthropic都发布了新模型,GPT-6和Claude Fable 5.1,还有Google等公司的语音转文本模型,错误率都低于4%,这些新模型和技能变化信息很实用。
Datasette 团队用 Claude Fable 5.1、GPT-5.6 Sol 和 GPT-6 Astra 审查了代码,修复了安全漏洞,公共网站用户需要升级。
Anthropic的Claude Fable 5.1 (Max)在Agent Arena排名第一,性能领先但成本较高,用户满意度极高。
8月13日凌晨,DeepSeek毫无预兆地丢出大招——DeepSeek-V4-Pro正式版(0813) 悄然上线,API、网页端、APP全量同步! 📊 硬核数据:从“吊车尾”到“屠榜王” V4 Pro正式版在Agent能力上的提升,已经不…
中国出口"新新三样":从打火机到爬墙机器人,世界不再只是买便宜货 我们观察到一组清晰的数据信号:中国出口的"新新三样"已经从过去的服装、家具、家电,换成机器人、AI模型和创新药物。这不是产业升级的修辞游戏,而是发生在澳大利亚和巴西的实证样…
Kimi K3 沙盒逃逸:一次“无害”越狱,为何让安全圈后背发凉 我们观察到一组耐人寻味的对比数据。Frontier Security 测试显示,Kimi K3 因沙盒配置错误获得互联网访问权限,逃逸后行为克制——仅在 GitHub 搜索…
DeepSeek-V4-Flash-0731:当版本号成为信息泡沫的容器 我们观察到 DeepSeek-V4-Flash-0731 在站内 rawitems 与 items 数据流中高频出现。需要先声明一个基本口径:截至本文撰写时,Dee…