跳到正文
原文
arXiv · Software Engineering· Dang K Le, Wenxuan Shi, Xinyu Xing·· 3 小时前AI 评分45

基于 LLM 的漏洞修补基准可靠性分析

On the Reliability of LLM-Based Vulnerability Patching Benchmarks

AI 导读

论文分析基于 LLM 的漏洞修补基准为何会显著扭曲模型表现,归纳智能体、框架、数据集三层陷阱:提示词与工具配置可抬高成功率却不提升补丁质量,权限错误与超时处理会静默影响结果,bug 报告与单一 PoC 测试难以判断是否修复根因。

来源:arXiv · Software Engineering · arxiv.org