跳到正文
原文
arXiv · Computer Vision· Keuntae Kim, Yong Suk Choi·· 3 小时前AI 评分50

扩散多模态大模型中的两个时钟:答案何时在理由展开前稳定

Two Clocks in Diffusion MLLMs: When Answers Stabilize Before Rationales Unfold

AI 导读

扩散多模态大模型中,答案候选在理由尚未完全展开时即可稳定,研究区分了日志候选的事后稳定与 token 承诺。在单块 EOS 抑制 LaViDa 运行中,89.4-98.1% 的理由侧画布在稳定时仍未书写;V*Bench 上将块长度从 128 降至 8,该比例从 89.4% 降至 1.7%。

来源:arXiv · Computer Vision · arxiv.org