01:37lmarena.ai@lmarena_ai73°Anthropic的Fable 5.1 (Max)在Code Arena: WebDev基准测试中以1765分排名第一,领先第二名Qwen3.8-Max-0902达77分。相比前代Fable 5 (Max)排名第八,新版本提升了137分。Fable 5.1 (Max)每百万代币成本为40美元,在高价区间重新定义了性能边界。AI模型Fable 5.1AnthropicCode Arena10 个信源在谈事件专题推荐理由:Anthropic新发布的Fable 5.1 Max在代码基准测试中大幅领先,比第二名高出77分,刷新了高价模型性能标准。原文稍后读已读值得跟进有用关注 Fable 5.1
11:53官方账号阿里通义 Qwen@Alibaba_Qwen73°Qwen3.8-Max-0902在CodeArena WebDev排行榜上以1691分位居第一,比Claude Opus 5高出3分,比Kimi K3高出17分。该模型在多步推理、工具使用和完整应用生成方面表现突出,价格为每百万token 5美元。在WebDev各个细分类别中,该模型在数据分析与消费者产品类别排名第一。AI模型Qwen3.8-Max-0902CodeArenaWebDev推荐理由:阿里Qwen3.8-Max-0902以1691分登顶CodeArena WebDev排行榜,比前代模型高出22分,价格仅5美元/百万token。原文稍后读已读值得跟进有用关注 Qwen3.8-Max-0902
11:08lmarena.ai@lmarena_ai精选73°Qwen3.8-Max-0902在Code Arena: WebDev基准测试中以1691分获得第一名。该模型在帕累托前沿上以每百万token 5美元的价格成为最高分模型。它超越了HY4 Preview(1629分,每百万token 2.08美元)和Qwen3.8-Flash-Next(1620分,每百万token 0.39美元)。AI模型Qwen3.8-Max-0902Alibaba_QwenCode Arena推荐理由:阿里Qwen新模型Qwen3.8-Max-0902在代码评测中登顶,性价比超高。原文稍后读已读值得跟进有用关注 Qwen3.8-Max-0902
11:08lmarena.ai@lmarena_ai73°Qwen3.8-Max-0.902由阿里巴巴发布,在Code Arena: WebDev基准测试中以1691分位居第一。该模型比Claude Opus 5高出3分,比Kimi K3高出17分,比前代Qwen3.8-Max高出22分。价格为每百万token 5美元,同时在帕累托前沿上获得最高分。该模型在数据分析、消费品开发等类别排名第一。AI模型Qwen3.8-Max-0902Alibaba_QwenCode Arena推荐理由:阿里Qwen3.8-Max-0902在代码基准测试中超越Claude和Kimi,价格实惠,多项类别领先。原文稍后读已读值得跟进有用关注 Qwen3.8-Max-0902
18:48Hunyuan@TXhunyuan73°腾讯混元Hy4预览版在Code Arena: WebDev基准测试中获得1633分,排名第五。相比Hy3版本,Hy4从第31名上升了115分。在开源模型中,Hy4预览版排名约第三,而Hy3排名第七。这是基于Arena的AutoEval系统自动评分的结果,该系统使用人类偏好数据训练的奖励模型进行自动投票。AI模型TencentHunyuanHy4Code Arena推荐理由:腾讯混元Hy4预览版在WebDev编程基准测试中大幅提升,从第31名跃升至第5名,开源模型中排名第三。原文稍后读已读值得跟进有用关注 TencentHunyuan
15:41lmarena.ai@lmarena_ai73°TencentHunyuan的Hy4预览在Code Arena WebDev项目中获得1633分,排名第五,较Hy3的#31整体排名提升了115分。Hy4预览在开放模型中排名第三,优于Hy3的#7排名。这是基于Arena人类偏好数据训练的奖励模型自动投票的早期AutoEval分数,随着更多实时人类投票的到来,分数可能会进一步收敛。Hy4预览具有770B参数,49B活跃参数,1M上下文,专为生产力构建,开源,价格合理。更多详情请访问Hy博客。AI模型TencentHunyuanHy4Code Arena推荐理由:TencentHunyuan发布了Hy4预览,在Code Arena中表现优异,是开源模型中的佼佼者,值得一试。原文稍后读已读值得跟进有用关注 TencentHunyuan
23:36lmarena.ai@lmarena_aiCode Arena 发布 WebDev 排行榜,基于 AutoEval 分数。查看排行榜详情和了解 AutoEval。AI产品Code ArenaAutoEvalWebDev推荐理由:想看看你的代码水平如何?来 Code Arena 的 WebDev 排行榜看看吧,还有 AutoEval 评分系统哦!原文稍后读已读值得跟进有用关注 Code Arena
00:37lmarena.ai@lmarena_aiCode Arena发布WebDev排行榜,查看最新编程挑战排名。查看详情。技巧Code Arena排行榜编程挑战推荐理由:想看看编程高手们的排名吗?Code Arena的WebDev排行榜刚刚更新,快去看看吧!原文稍后读已读值得跟进有用关注 Code Arena
08:32lmarena.ai@lmarena_ai智谱AI发布的GLM-5.3 (Max)模型在Code Arena: WebDev基准测试中获得1597分。该模型在开源模型中排名第二,整体排名第八。其定价为3.65美元/百万token,性能优于Gemini-3.7-flash-high和Deepseek-v4-flash-high。AI模型GLM-5.3Zhipu AICode Arena5 个信源在谈事件专题推荐理由:智谱AI刚发布了GLM-5.3 (Max),在Web开发代码基准上拿了个高分,而且价格比Gemini和DeepSeek的类似模型还便宜。原文稍后读已读值得跟进有用关注 GLM-5.3
17:52lmarena.ai@lmarena_aiCode Arena 在 X 平台公布了 WebDev 排行榜的完整链接。榜单页面位于 arena.ai/leaderboard,用户可查看各模型在网页开发任务上的表现。推文目前获得 6 次点赞和 1358 次浏览。该排行榜为开发者选择适合的编码模型提供了参考。AI模型Code ArenaWebDev排行榜推荐理由:Code Arena 开了个 WebDev 榜,想看看哪个模型写网页更行,直接点链接看排名就行。原文稍后读已读值得跟进有用关注 Code Arena
00:27lmarena.ai@lmarena_ai79°xAI 推出 Grok 4.6,在 LMArena 的 WebDev 基准上以 1618 分排名第7。相较 Grok 4.5 的 1553 分(第13名)提升明显,且定价保持不变。目前 Grok 4.6 与 GPT-5.6 Sol xHigh(1622 分)和 Claude Fable 5(1627 分)仅差 4 到 9 分,三者同处第5至第7区间。AI模型Grok 4.6xAILMArena推荐理由:xAI 把 Grok 4.6 放出来了,网页开发能力直接冲到 LMArena 第7,跟 GPT-5.6 和 Claude 最新版就几分之差,这代提升挺猛。原文稍后读已读值得跟进有用关注 Grok 4.6
09:29lmarena.ai@lmarena_aiCode Arena 推出 WebDev 评测项目。用户可在 WebDev 中亲自测试模型,自行判断效果。完整榜单已发布在 arena.ai/leaderboard。该榜单展示了各模型在 WebDev 任务上的比较结果。AI产品Code ArenaWebDev模型评测推荐理由:想挑个代码生成强的模型?去 Code Arena 的 WebDev 自己试一把,完了直接看排行榜就行。原文稍后读已读值得跟进有用关注 Code Arena