arXiv · Computer Vision· Shengyun Zhong, Xinkang Zhao, Ziyuan Chu, Linchao Zhu·· 3 小时前AI 评分35
MOBA-VL:基于事件定位的多轮强化学习实现 MOBA 实时解说
MOBA-VL: Event-Localized Multi-Turn Reinforcement Learning for Real-Time MOBA Commentary
AI 导读
MOBA-VL 是一个 9B 参数视觉语言模型,采用事件定位多轮强化学习训练,利用游戏遥测信号精确奖励描述每个事件的回合。研究收集了 MOBACast 数据集(860 场职业比赛约 460 小时,含词级时间戳解说)和 MOBACast-Bench 基准。
来源:arXiv · Computer Vision · arxiv.org