- 2
- 0
- 约1.75万字
- 约 15页
- 2023-06-03 发布于四川
- 举报
本公开提供了一种声纹识别的方法、装置、设备、存储介质以及程序产品,涉及大数据以及语音识别等领域。具体实现方案为:获取多个对话音频,各对话音频中分别包括有第一发言人的语音片段和第二发言人的语音片段;根据各对话音频对应的第一发言人的身份标识,将多个对话音频划分为多组,每组对话音频对应于相同的第一发言人;对目标组对话音频中各语音片段的声纹进行聚类,得到多个聚类结果;选取包含语音片段数量最多的聚类结果确定为候选聚类结果;将候选聚类结果对应的声纹确定为目标组对话音频对应的第一发言人的声纹。根据本公开的声纹
(19)国家知识产权局
(12)发明专利
(10)授权公告号 CN 112652313 B
(45)授权公告日 2023.04.07
(21)申请号 202011545572.X G06F 18/23 (2023.01)
原创力文档

文档评论(0)