热点事件持续更新
VLMs与人类跨模态关联的选择与注视对齐研究
1 篇报道1 个报道来源6 小时前更新
先了解这件事
AI 综述
2026-09-30 arXiv Computation and Language 报道比较了人类(N=53)与多个视觉语言模型在跨模态关联任务中的选择与注视模式。结果显示,较大 VLMs 在选择上与人类一致,但其显著性图与人类注视的匹配度不如中心高斯基线;微调小 VLMs 可使其选择对齐达到人类多数投票参考水平,但注视仍不及基线;仅训练模型注视可提升注视相关性,却不改善选择对齐。
AI 根据报道生成 · 2 小时前更新
最新进展9月30日 12:00
2026-09-30 arXiv 发布该研究,揭示 VLMs 选择对齐与注视对齐之间的差异与权衡。报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- arXiv · Computation and Language跨模态关联中人类与视觉语言模型的注视差异研究
研究比较了人类(N=53)与多个视觉语言模型在跨模态关联任务中的选择与注视模式,发现较大 VLMs 在选择上与人类一致,但其显著性图与人类注视的匹配度不如中心高斯基线。微调小 VLMs 可使其选择对齐达到人类多数投票参考水平,但注视仍不及基线;仅训练模型注视可提升注视相关性,却不改善选择对齐。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。