07:26Guillermo Rauch@rauchg精选Vercel对GLM 5.3进行了网络安全能力评估。该模型在DeepsecBench基准中得分最高,是开源模型中的第一名。其运行成本仅为分数相近的专有模型的1/3。这使得防御性安全任务可以至少3倍频次地运行deepsec.sh脚本。AI模型GLM 5.3DeepsecBenchVercel2 个信源在谈事件专题推荐理由:Vercel测了GLM 5.3,网络安全评分是开源模型里最高的,价格只要别家三分之一,跑deepsec.sh能多跑三倍,防御岗可以关注。原文稍后读已读值得跟进有用关注 GLM 5.3
06:27Guillermo Rauch@rauchgGrok 4.5在Vercel的DeepsecBench网络安全漏洞检测基准中取得最佳性价比。其成本仅为Sol的1/10、Opus 5的1/5.7、Kimi K3的1/2.2,但性能与Kimi K3相近。Sol仍保持最高准确率分数,领先Opus 5。Kimi K3以1/5成本获得Sol一半的分数。AI模型Grok 4.5SolDeepsecBench推荐理由:Grok 4.5做安全漏洞检测,比Sol便宜10倍但性能接近Kimi,预算有限的团队可以考虑它。原文稍后读已读值得跟进有用关注 Grok 4.5