跳到正文
原文
arXiv · Software Engineering· Angad Miglani, Samrath Singh Chadha, Kevin Li, Manas Venkata Sai Ravulapalli·· 6 小时前AI 评分29

扩散语言模型中的正确性信号:编辑器具有只读访问权限

The Editor Has Read-Only Access: Correctness Signals in Diffusion Language Models

AI 导读

扩散语言模型通过反复更新部分掩码序列生成代码。研究者在六个扩散模型中发现,线性探针能区分通过与失败的尝试,最强信号通常出现在早期层之后。使用小语义突变作为对照,支持其与正确性相关而非仅表面风格。探针点估计相比模型置信度无一致优势,将探针方向加入残差流未带来可靠提升,反方向则降低性能。

来源:arXiv · Software Engineering · arxiv.org