GLAD: 全局局部感知动态专家混合模型用于多说话人 ASR.pdfVIP

  • 3
  • 0
  • 约2.34万字
  • 约 5页
  • 2026-02-27 发布于北京
  • 举报

GLAD: 全局局部感知动态专家混合模型用于多说话人 ASR.pdf

GLAD:全局局部感知动态专家混合模型用于多说话人ASR

YujieGuo,JiamingZhou,YuhangJia,ShiwanZhaoandYongQin

TMCC,CollegeofComputerScience,NankaiUniversity,Tianjin,China

Email:guoyujie02@

ABSTRACT语音信号本身携带有特定于说话人的声学特征,这些特征往往

在更深的网络层中被稀释。

端到端多说话人自动语音识别(MTASR)在准确转录音频重受此启发,我们提出了GLAD(G全局-L局部-A共享-D

叠部分,尤其是在高重叠条件下面临重大挑战。为了解决这动态专家混合模型),一种旨在改进MTASR中专家选择的新

些问题,我们提出了Global-LocalAwareDynamic混合专家框架。具体而言,我们引入了一个全局路由器来处理原始语音

(GLAD

文档评论(0)

1亿VIP精品文档

相关文档