arXiv · Computation and Language· Huijuan Wang, Chufan Shi, Cheng Yang, Yaokang Wu, Taylor Berg-Kirkpatrick, Xuezhe Ma·· 16 小时前AI 评分44
统一多模态模型中的递归自我改进
Recursive Self-Improvement in Unified Multimodal Models
AI 导读
研究者提出递归跨能力自我改进(RSI)训练循环,让统一多模态模型(UMMs)的文本与视觉能力互相生成训练数据,程序执行作为模型外的真值来源以避免误差跨轮累积。
来源:arXiv · Computation and Language · arxiv.org