跳到正文
热点事件持续更新

VLMs与人类跨模态关联的选择与注视对齐研究

1 篇报道1 个报道来源6 小时前更新

先了解这件事

AI 综述

2026-09-30 arXiv Computation and Language 报道比较了人类(N=53)与多个视觉语言模型在跨模态关联任务中的选择与注视模式。结果显示,较大 VLMs 在选择上与人类一致,但其显著性图与人类注视的匹配度不如中心高斯基线;微调小 VLMs 可使其选择对齐达到人类多数投票参考水平,但注视仍不及基线;仅训练模型注视可提升注视相关性,却不改善选择对齐。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. arXiv · Computation and Language
    跨模态关联中人类与视觉语言模型的注视差异研究

    研究比较了人类(N=53)与多个视觉语言模型在跨模态关联任务中的选择与注视模式,发现较大 VLMs 在选择上与人类一致,但其显著性图与人类注视的匹配度不如中心高斯基线。微调小 VLMs 可使其选择对齐达到人类多数投票参考水平,但注视仍不及基线;仅训练模型注视可提升注视相关性,却不改善选择对齐。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。