提出X2Streaming-ASR流式语音识别方法
热点事件持续更新
提出X2Streaming-ASR流式语音识别方法
1 篇报道1 个报道来源2 小时前更新
先了解这件事
报道摘要
X2Streaming-ASR 将流式语音识别拆解为"何时提交"与"提交什么",通过三阶段训练建立流式识别能力并用字符级、分段分配的分组相对奖励优化提交策略。在十个中英文测试集上,其平均提交延迟相对强制对齐端点最低,中文为 32–109ms、英文为 12–85ms,识别准确率与现有系统相当。
摘自 arXiv cs.AI
最新进展10月9日 12:00
X2Streaming-ASR:不确定就等待,就绪即输出的流式 ASR报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- arXiv cs.AIX2Streaming-ASR:不确定就等待,就绪即输出的流式 ASR
X2Streaming-ASR 将流式语音识别拆解为"何时提交"与"提交什么",通过三阶段训练建立流式识别能力并用字符级、分段分配的分组相对奖励优化提交策略。在十个中英文测试集上,其平均提交延迟相对强制对齐端点最低,中文为 32–109ms、英文为 12–85ms,识别准确率与现有系统相当。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。