- 4
- 0
- 约2.35万字
- 约 19页
- 2024-02-28 发布于四川
- 举报
本申请公开了一种远场语音识别方法、系统、装置及存储介质,通过近场语音频域特征集预训练编码器和解码器,再使用近场语音频域特征集和远场语音频域特征集对域判别器、预训练后的编码器和解码器进行训练,再根据训练后得到的编码器和解码器构建得到声学模型,使得在预训练和训练的过程中结合了近场语音数据和远场语音数据,使得声学模型能够消除近场语音数据和远场语音数据之间的特征分布差异,将具备不同特征分布的近场语音数据和远场语音数据映射到同一个特征空间,能够实现声学模型的域适应,使得由声学模型、词典和语言模型构建的远场
(19)国家知识产权局
(12)发明专利申请
(10)申请公布号CN117612515A
(43)申请公布日2024.02.27
(21)申请号202311629811.3
(22)申请日2023.11.30
(71)申请人智慧眼科技股份有限公司
地址4
原创力文档

文档评论(0)