跳到正文
热点事件持续更新

提出X2Streaming-ASR流式语音识别方法

1 篇报道1 个报道来源2 小时前更新

先了解这件事

报道摘要

X2Streaming-ASR 将流式语音识别拆解为"何时提交"与"提交什么",通过三阶段训练建立流式识别能力并用字符级、分段分配的分组相对奖励优化提交策略。在十个中英文测试集上,其平均提交延迟相对强制对齐端点最低,中文为 32–109ms、英文为 12–85ms,识别准确率与现有系统相当。

摘自 arXiv cs.AI

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. arXiv cs.AI
    X2Streaming-ASR:不确定就等待,就绪即输出的流式 ASR

    X2Streaming-ASR 将流式语音识别拆解为"何时提交"与"提交什么",通过三阶段训练建立流式识别能力并用字符级、分段分配的分组相对奖励优化提交策略。在十个中英文测试集上,其平均提交延迟相对强制对齐端点最低,中文为 32–109ms、英文为 12–85ms,识别准确率与现有系统相当。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。