跳到正文
原文
arXiv · Software Engineering· Ali Mohammadi Esfahani, Nafiseh Kahani, Samuel A. Ajila·· 7 小时前AI 评分42

复杂度感知评估大语言模型代码理解能力

Complexity-Aware Evaluation of LLM Comprehension

AI 导读

DeepSeek-Coder-V2 在自动输入输出预测中整体准确率达 78.33%,Llama 为 70.33%,但随环复杂度、嵌套深度、分支数和 Halstead 体积升高,准确率均显著下降。

来源:arXiv · Software Engineering · arxiv.org