研究提出BRUGEscore并比较长文档摘要评估指标
热点事件持续更新
研究提出BRUGEscore并比较长文档摘要评估指标
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
一项针对长文档金融叙事摘要的研究提出新评估指标 BRUGEscore,并比较了多种现有指标的表现。作者 Nadhem Zmandar、Mo El-Haj 和 Paul Rayson 假设部分评估指标无法反映真实的摘要能力,因此提出由 ROUGE-2 与 BERTscore 的调和平均构成 BRUGEscore。 研究在英国伦敦证券交易所上市公司年报(平均约 80 页)的 FNS 2020 数据集上,对多种预训练 Transformer 与抽取技术进行了摘要方法基准测试,并对结果做统计显著性检验及三种损坏方法的对抗分析。BRUGEscore 是否更能反映真实摘要能力,报道中仅作为作者假设提出,未给出已验证的结论。
AI 根据报道生成 · 2 小时前更新
最新进展10月8日 12:00
基于 Transformer 的长文档金融叙事摘要评估指标对比研究报道时间线
沿着报道,了解事件的不同侧面。
10月8日
- arXiv cs.CL基于 Transformer 的长文档金融叙事摘要评估指标对比研究
研究对多种预训练 Transformer 与抽取技术在英国伦敦证券交易所上市公司年报(平均约 80 页)的 FNS 2020 数据集上进行了摘要方法基准测试,并比较了多种评估指标的表现。作者假设部分指标无法反映真实摘要能力,提出由 ROUGE-2 与 BERTscore 调和平均构成的新指标 BRUGEscore,并对结果进行统计显著性检验及三种损坏方法的对抗分析。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。