跳到正文
原文
arXiv · Software Engineering· Han Li, Lingxiang Hu, Jiacheng Huang, Ziqian Jiang, Jingkai Luo, Wei Gao, Yunfan Tan, Zun Wang, Jiaheng Liu·· 3 小时前AI 评分39

TestPrism:重新思考超越单一参考实现的测试评估

TestPrism: Rethinking Test Evaluation Beyond a Single Reference

AI 导读

论文提出 TestPrism 基准,含 300 个测试任务、17 个来源和 3000 个候选实现(有效与无效各半),以 Joint Success Function 指标要求测试在初始程序状态失败、接受全部有效候选并拒绝全部无效候选。

来源:arXiv · Software Engineering · arxiv.org