8月20日
13:26
03:31
03:31lmarena.ai@lmarena_ai
Agent Arena对比了15款模型任务成本,Kimi K3 (Max)每任务成本仅$0.62;Claude Opus 5 (Max)成本达$3.37,与同类存在明显差距;Kimi K3 (Max)排名第4,成本远低于多数同级别模型;Grok和Qwen以较低成本实现了不错表现。
事件专题

推荐理由:Agent Arena发布了各模型任务成本对比,能清楚看到不同模型花多少钱和效果,和同类比啥不一样。
02:55
8月19日
22:39
22:39Philipp Schmid@_philschmid
artificialanalysis.ai平台发布的模型测试数据显示,其模型在GLUE基准测试中获得高分;测试结果显示该模型本轮得分达154分;与此前测试相比,此次成绩体现模型性能提升。
推荐理由:artificialanalysis.ai发布了最新模型测试数据,能直接查看各模型在GLUE的分数,和之前版本比信息更全了。
22:38