论文Agent 与开发者10:22研究指出编译率不能可靠评估 LLM 代码漏洞修复效果一篇打脸编译率的论文:64% 编译失败根本不怪模型,改个编译选项编译率就差 2 倍多,做代码修复评估的都该看看。#LLM#代码漏洞修复#CodeBLEU#diff_F1aarXiv cs.AI@Om Nepal 等 4 人原文稍后读已读值得跟进有用关注 LLM