热点事件持续更新
Diffusion语言模型内部激活编码代码正确性信号研究
1 篇报道1 个报道来源6 小时前更新
先了解这件事
AI 综述
2026-09-30,arXiv Software Engineering 报道,研究者在六个扩散语言模型中发现,线性探针可区分代码生成的通过与失败尝试,最强信号通常出现在早期层之后;通过小语义突变对照,支持该信号与正确性相关而非仅表面风格;探针点估计相比模型置信度无一致优势,将探针方向加入残差流未带来可靠提升,反方向则降低性能。
AI 根据报道生成 · 2 小时前更新
报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- arXiv · Software Engineering扩散语言模型中的正确性信号:编辑器具有只读访问权限
扩散语言模型通过反复更新部分掩码序列生成代码。研究者在六个扩散模型中发现,线性探针能区分通过与失败的尝试,最强信号通常出现在早期层之后。使用小语义突变作为对照,支持其与正确性相关而非仅表面风格。探针点估计相比模型置信度无一致优势,将探针方向加入残差流未带来可靠提升,反方向则降低性能。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。