LLM 辅助二进制到源代码恢复的 SoK 实证评测
Get the story
2026年10月9日,arXiv 软件工程方向发布一项一手研究,题为《SoK:LLM 在源代码恢复中可靠吗?——分类体系与实证评测》。该研究自称是首个面向 LLM 辅助二进制到源代码恢复的系统化知识综述(SoK),提出以设计为中心的方法分类体系,并采用 7 项关键指标、6 个评测维度进行系统评估。评测覆盖 45,000 个测试样本,来源包括 4 种标准架构与 5 种嵌入式架构、5 种优化级别及符号剥离;研究还消融了输入表示、上下文增强、模型规模、迭代与审查角色等设计选择,实验使用受控自研恢复管线与 3 个现成模型。目前报道仅给出评测框架与规模,未披露具体模型名称、指标结果或结论。
Generated from reports · updated 3 hr ago
Timeline
Follow the coverage from different angles.
- arXiv · Software EngineeringSoK:LLM 在源代码恢复中可靠吗?——分类体系与实证评测
该研究给出首个面向 LLM 辅助二进制到源代码恢复的系统化知识综述(SoK),提出以设计为中心的方法分类体系,并用 7 项关键指标、6 个评测维度做系统评估。评测覆盖 45,000 个测试样本,来自 4 种标准架构与 5 种嵌入式架构、5 种优化级别及符号剥离,并消融输入表示、上下文增强、模型规模、迭代与审查角色等设计选择,使用受控自研恢复管线与 3 个现成模型。
Heat trend
Current heat 9·Comparable peak 10(Oct 9)·Comparable change over 24 hours –
The trend compares only the same participants observed continuously; its range may be smaller than the current heat count. Move or click on the chart to inspect hourly heat; use the left and right arrow keys to switch.