16:14IT之家(博客/媒体)8月17日,Arena平台发布2026年第33周AI大模型盲测排名。Anthropic的claude-opus-4系列新模型密集入榜,claude-fable-5以1506分蝉联综合榜第一,claude-opus-4-6-high以1505分紧随其后。国产模型中,kimi-k3-max以1489分升至综合榜第12位,并在代码榜以1544分排名第6、前端开发榜以1674分保持第2。谷歌gemini-3.7-flash-high首次入榜即获第9名,阿里qwen3.8-max则降至第8名。榜单基于匿名盲测投票ELO分数,反映用户主观偏好。AI模型Anthropicclaude-opus-4kimi-k3-max10 个信源在谈事件专题推荐理由:这周Arena盲测榜变化大,Anthropic新Claude扎堆屠榜,国产kimi-k3-max在代码和前端都紧咬前排,看看具体分数吧。原文稍后读已读值得跟进有用关注 Anthropic
17:13IT之家(博客/媒体)Arena平台发布2026年第32周AI大模型盲测排名,综合榜前10名ELO均在1488分以上。阿里qwen3.8-max以1497分位列第6,与claude-opus-4-6同分;Meta muse-spark-1.2 (xHigh)首秀以1498分排第4。代码榜上月之暗面kimi-k3-max升至第6,ELO 1542分;阿里qwen3.8-max排第8,ELO 1532分。Anthropic claude-fable-5在综合榜和代码榜均居榜首。AI模型qwen3.8-maxmuse-spark-1.2kimi-k3-max10 个信源在谈事件专题推荐理由:这周榜单有意思:阿里qwen3.8-max追平Claude,Meta新模型第4,kimi代码第6,信息量足。原文稍后读已读值得跟进有用关注 qwen3.8-max
16:19IT之家(博客/媒体)Arena平台发布2026年第31周AI大模型排行榜。阿里qwen3.8-max以1496分位列综合榜第5,距榜首claude-fable-5仅差13分。月之暗面kimi-k3-max以1485分排综合榜第13。代码榜中,kimi-k3-max和qwen3.8-max分别以1531分和1530分进入Top10。前端开发榜kimi-k3-max以1676分排第二,字节seedream-5.0-pro进入AI生图榜第6名。AI模型qwen3.8-maxclaude-fable-5kimi-k3-max3 个信源在谈事件专题推荐理由:阿里新模型qwen3.8-max一上榜就冲到综合第五,只比榜首Claude差13分;kimi-k3-max代码也进了前十,国产模型进步挺明显,榜单值得翻翻。原文稍后读已读值得跟进有用关注 qwen3.8-max