跳到正文
原文
arXiv · Software Engineering· Mohammadali Charoosaei, Cedric Richter, Mike Papadakis·· 3 小时前AI 评分43

LLM 生成回归测试的风险研究

On the Risks of using LLM-Generated Tests for Regression Testing

AI 导读

研究对 SciPy、Qiskit 和 pandas 的 145 个已合并 pull request 应用 LLM 回归测试生成,发现 8%-17% 的生成测试属于固化错误行为的 fault-enforcing 测试,仅 2.4%-4.8% 能揭示缺陷。

来源:arXiv · Software Engineering · arxiv.org