跳到正文
热点事件持续更新

研究提出BRUGEscore并比较长文档摘要评估指标

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

一项针对长文档金融叙事摘要的研究提出新评估指标 BRUGEscore,并比较了多种现有指标的表现。作者 Nadhem Zmandar、Mo El-Haj 和 Paul Rayson 假设部分评估指标无法反映真实的摘要能力,因此提出由 ROUGE-2 与 BERTscore 的调和平均构成 BRUGEscore。 研究在英国伦敦证券交易所上市公司年报(平均约 80 页)的 FNS 2020 数据集上,对多种预训练 Transformer 与抽取技术进行了摘要方法基准测试,并对结果做统计显著性检验及三种损坏方法的对抗分析。BRUGEscore 是否更能反映真实摘要能力,报道中仅作为作者假设提出,未给出已验证的结论。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月8日
  1. arXiv cs.CL
    基于 Transformer 的长文档金融叙事摘要评估指标对比研究

    研究对多种预训练 Transformer 与抽取技术在英国伦敦证券交易所上市公司年报(平均约 80 页)的 FNS 2020 数据集上进行了摘要方法基准测试,并比较了多种评估指标的表现。作者假设部分指标无法反映真实摘要能力,提出由 ROUGE-2 与 BERTscore 调和平均构成的新指标 BRUGEscore,并对结果进行统计显著性检验及三种损坏方法的对抗分析。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。