跳到正文
原文
arXiv · Human-Computer Interaction· Xiaolin Chen, Xuemeng Song, Jinlan Fu, Weili Guan, Mong-Li Lee, Wynne Hsu·· 3 小时前AI 评分34

EmAvatar:通过冲突解析与表达引导实现多模态共情响应生成

EmAvatar: Multimodal Empathetic Response Generation via Conflict Resolution and Expressive Guidance

AI 导读

EmAvatar 提出一个多模态共情响应生成框架,通过冲突解析与表达引导实现精准情感感知与合成。系统先由 Conflict Inspector 与 Evidence Collector 多轮问答解析模态间情感冲突,再生成耦合文本与表达指令的复合脚本,并经迭代精炼后驱动音频与视频合成。在四项任务上优于现有方法,代码将公开。

来源:arXiv · Human-Computer Interaction · arxiv.org