07:01官方账号Together AI@togethercompute精选使用DeepSWE基准对比了Kimi K3 Max和GPT 5.6 Sol Max在软件工程任务上的表现。Kimi K3 Max达到了与GPT 5.6 Sol Max相当的性能,而价格仅为后者的约55%。将两个模型联合使用时,性能可额外提升约16%。AI模型Kimi K3 MaxGPT 5.6 Sol MaxDeepSWE1 个信源在谈事件专题推荐理由:Kimi K3 Max性价比炸裂,软件工程能力不输GPT 5.6 Sol Max,混合使用还能再提分,值得关注。原文稍后读已读值得跟进有用关注 Kimi K3 Max
12:16AI Will@FinanceYF5Kimi K3 Max在Kimi内部知识工作基准上获得三项得分:Online Exp Bench 75.5分,DECK-Bench 73.5分,Finance-Bench 62.6分。这些基准测试模拟真实用户Agent工作流中的常见任务。三项成绩均超过Claude Opus 4.8(max)和GPT-5.5(xhigh)。这表明Kimi K3 Max在Agentic知识工作上的能力和可靠性有所提升。AI模型Kimi K3 MaxClaude OpusGPT-5.52 个信源在谈事件专题推荐理由:Kimi K3 Max在三个内部知识工作基准上全面超过Claude Opus和GPT-5.5,适合关注智能体工作流的人看看。原文稍后读已读值得跟进有用关注 Kimi K3 Max