04:56Cognition@cognition_labs73°Cognition宣布Gemini 3.7 Flash现已接入编程智能体Devin。在FrontierCode 1.1基准上,Gemini 3.7 Flash达到Claude Sonnet 5水平,成本不到后者一半。该模型保持Flash系列的低延迟特性,Devin用户现在可以直接选用。AI产品Gemini 3.7 FlashDevinFrontierCode 1.1推荐理由:Devin现在能用Gemini 3.7 Flash了,跑FrontierCode 1.1和Claude Sonnet 5差不多,成本砍半还快,写代码可以试试。原文稍后读已读值得跟进有用关注 Gemini 3.7 Flash
01:37Windsurf@windsurf_aiCognition 宣布 Kimi K3 模型已在 Devin Desktop 和 Devin CLI 中可用。在 FrontierCode 1.1 基准上,Kimi K3 是首个接近前沿性能的开源模型。该模型在代码任务上的表现接近闭源前沿模型。AI模型Kimi K3DevinCognition10 个信源在谈事件专题推荐理由:Cognition 把 Kimi K3 放进 Devin 桌面和终端了,在 FrontierCode 上接近前沿水平,开源模型里很能打。原文稍后读已读值得跟进有用关注 Kimi K3
01:02Cognition@cognition_labsCognition 宣布 Kimi K3 现已集成到 Devin Desktop 和 CLI。在 FrontierCode 1.1 基准测试中,Kimi K3 是首个接近前沿性能的开源模型。这标志着开源编码模型达到了新的高度。AI模型Kimi K3DevinFrontierCode 1.110 个信源在谈事件专题推荐理由:Cognition 把 Kimi K3 放进 Devin 了,在 FrontierCode 上接近顶尖水平,而且是开源,想试最新的编码模型可以直接用。原文稍后读已读值得跟进有用关注 Kimi K3
01:54Cognition@cognition_labs精选FrontierCode 1.1 是 Cognition 发布的评估真实工程任务的基准,考核代码合并性和质量。Opus 5 在该基准上取得 63.6% 的分数,扩展测试通过率 69.6%,性能接近 Fable 5 而成本仅为后者的一半。在 Devin 环境中,Opus 5 在困难调试和根因分析任务上表现突出。AI模型Opus 5FrontierCode 1.1Devin10 个信源在谈事件专题推荐理由:Opus 5 在代码工程基准上接近顶级模型,但价格只要一半,做调试分析特别强。原文稍后读已读值得跟进有用关注 Opus 5