跳到正文
原文
arXiv · Software Engineering· Varun Kohli, Lee Bing Cheng, Nur Hazim Ghazali, Gao Yuze, Daryl Poon, Dinil Mon Divakaran·· 3 小时前AI 评分32

SoK:LLM 在源代码恢复中可靠吗?——分类体系与实证评测

SoK: Are LLMs Reliable at Source Code Recovery? A Taxonomy and Empirical Evaluation

AI 导读

该研究给出首个面向 LLM 辅助二进制到源代码恢复的系统化知识综述(SoK),提出以设计为中心的方法分类体系,并用 7 项关键指标、6 个评测维度做系统评估。评测覆盖 45,000 个测试样本,来自 4 种标准架构与 5 种嵌入式架构、5 种优化级别及符号剥离,并消融输入表示、上下文增强、模型规模、迭代与审查角色等设计选择,使用受控自研恢复管线与 3 个现成模型。

来源:arXiv · Software Engineering · arxiv.org