arXiv · Computation and Language· Nadhem Zmandar, Mo El-Haj, Paul Rayson·· 4 hr agoAI score17
Transformer 在长文档金融叙事摘要评测指标上的对比研究
A Comparative Study of Evaluation Metrics for Long-Document Financial Narrative Summarization with Transformers
AI brief
研究以 FNS 2020 共享任务数据集(伦敦证券交易所上市公司年报及对应摘要)为对象,对多种预训练 Transformer 与不同抽取技术的摘要方法进行基准测试,并比较多个评测指标的行为与适用性。研究提出新指标 BRUGEscore,即 ROUGE-2 与 BERTscore 的调和平均,并通过统计显著性检验与三种破坏方法的对抗分析验证结果稳健性。论文 12 页,发表于 NLDB 2023。
Source: arXiv · Computation and Language · arxiv.org