arXiv · Computation and Language· Yun-Ang Wu, Xanh Ho, Andre Greiner-Petter, Sunisth Kumar, Tian Cheng Xia, Florian Boudin, Akiko Aizawa·· 16 小时前AI 评分30
多模态声明验证对 LLM 改写有多稳健?
How Robust Is Multimodal Claim Verification to LLM Rewriting?
AI 导读
研究评估了 11 个跨五个 VLM 家族、参数规模 2B 至 38B 的开放权重模型,考察 LLM 改写对多模态声明验证准确性的影响。结果显示多数模型对自然改写和受控词汇注入均无显著准确率下降,验证比此前综述评分操纵研究更稳定,但概率分布仍出现一致偏移:模糊化措辞在几乎所有模型上引发显著偏移,润色类改写影响甚微。论文已被 AACL 2026 主会接收。
来源:arXiv · Computation and Language · arxiv.org