Skip to content
arXiv · Software Engineering· Batuhan Yeltekin, Daniel Bauer·· 4 hr agoAI score33

LLM 能否模拟新手程序员的认知误区?

Can LLMs Simulate Novice Programmers' Misconceptions?

AI brief

研究评估了 13 个 LLM 在代码生成、求解、模拟与诊断新手编程误区上的表现,聚焦代码追踪问题。前沿模型能可靠完成这些任务,但 ≤14B 的小模型在动态执行上吃力,代码微调模型在模拟误区时会退回正确执行。误区诊断在 True/False 格式下显著比开放式生成更容易。

Source: arXiv · Software Engineering · arxiv.org