- 3
- 0
- 约2.34万字
- 约 5页
- 2026-02-27 发布于北京
- 举报
GLAD:全局局部感知动态专家混合模型用于多说话人ASR
YujieGuo,JiamingZhou,YuhangJia,ShiwanZhaoandYongQin
TMCC,CollegeofComputerScience,NankaiUniversity,Tianjin,China
Email:guoyujie02@
ABSTRACT语音信号本身携带有特定于说话人的声学特征,这些特征往往
在更深的网络层中被稀释。
端到端多说话人自动语音识别(MTASR)在准确转录音频重受此启发,我们提出了GLAD(G全局-L局部-A共享-D
叠部分,尤其是在高重叠条件下面临重大挑战。为了解决这动态专家混合模型),一种旨在改进MTASR中专家选择的新
些问题,我们提出了Global-LocalAwareDynamic混合专家框架。具体而言,我们引入了一个全局路由器来处理原始语音
(GLAD
原创力文档

文档评论(0)