跳到正文
原文
arXiv · Artificial Intelligence· Yuyang Cheng, Raghav Kaushik Ravi, Srivarshinee Sridhar, Sriparna Saha, Akash Ghosh, Chirag Agarwal·· 16 小时前AI 评分44

MEA:面向忠实模型解释的奖励驱动多智能体系统

MEA: A Reward-Driven Multi-Agent System for Faithful Model Explanations

AI 导读

MEA 是一个多智能体框架,用 Proposer 智能体按问题和模态选择并配置解释工具,用 Actor 智能体端到端优化忠实性,覆盖表格、文本和视觉模态。它引入特征归因、反事实推理和虚假特征检测等问题类型,并配以基于扰动的忠实性指标。在六个数据集上,MEA 相对未训练骨干模型带来 +28%(表格)、+21%(文本)、+34%(视觉)的忠实性提升,优于事后解释器、智能体和闭源基线。

来源:arXiv · Artificial Intelligence · arxiv.org