arXiv · Software Engineering· Mohammadali Charoosaei, Cedric Richter, Mike Papadakis·· 4 hr agoAI score43
LLM 生成回归测试的风险研究
On the Risks of using LLM-Generated Tests for Regression Testing
AI brief
研究对 SciPy、Qiskit 和 pandas 的 145 个已合并 pull request 应用 LLM 回归测试生成,发现 8%-17% 的生成测试属于固化错误行为的 fault-enforcing 测试,仅 2.4%-4.8% 能揭示缺陷。
Source: arXiv · Software Engineering · arxiv.org