arXiv · Computer Vision· Zhaolu Kang, Shiyu Liu, Tailong Luo, Wei Zhang, Yingjie He, Lei Wei, Guansu Wang, Liang He, Siheng Wang, Guangyuan Dong, Jiaqi Su, Shuang Chen, Haoyu Ji, Qishi Zhan, Kaiyue Zhou·· 16 小时前AI 评分34
视频 MLLM 后训练的行为包优化方法 BPO
Behavior Pack Optimization for Video MLLM Post-Training
AI 导读
研究者提出 Behavior Pack Optimization(BPO),用跨反事实视图的行为包替代单一响应进行视频 MLLM 后训练,按问题类型选择视图并联合打分。
来源:arXiv · Computer Vision · arxiv.org