跳到正文
原文
arXiv · Computer Vision· Shengyun Zhong, Xinkang Zhao, Ziyuan Chu, Linchao Zhu·· 3 小时前AI 评分35

MOBA-VL:基于事件定位的多轮强化学习实现 MOBA 实时解说

MOBA-VL: Event-Localized Multi-Turn Reinforcement Learning for Real-Time MOBA Commentary

AI 导读

MOBA-VL 是一个 9B 参数视觉语言模型,采用事件定位多轮强化学习训练,利用游戏遥测信号精确奖励描述每个事件的回合。研究收集了 MOBACast 数据集(860 场职业比赛约 460 小时,含词级时间戳解说)和 MOBACast-Bench 基准。

来源:arXiv · Computer Vision · arxiv.org