- 12
- 0
- 约1.3万字
- 约 11页
- 2023-06-06 发布于四川
- 举报
本发明公开了一种基于人工智能的声纹特征提取方法及装置。本发明包括如下步骤:采集语音数据和非语音数据,建立样本数据库;从样本数据库中取一音频文件,进行处理得到音频帧序列;对音频帧序列中每一帧进行傅里叶变化,得到该帧对应的频谱图信息;将时域信息和频域信息进行提取,得到时域特征和频域特征;将时域特征和频域特征进行特征聚合,得到聚合后的特征;对聚合后的特征进行向量嵌入,得到声纹特征向量;将声纹特征向量输入至卷积神经网络模型进行训练,得到声纹特征模型;获取待识别语音数据进行预处理;从预处理后的语音特征数据
(19)中华人民共和国国家知识产权局
(12)发明专利申请
(10)申请公布号 CN 112786059 A
(43)申请公布日 2021.05.11
(21)申请号 202110267332.6
(22)申请日 2021.03.11
(71)申请人 合肥
原创力文档

文档评论(0)