- 0
- 0
- 约2.03万字
- 约 18页
- 2023-05-26 发布于四川
- 举报
本申请公开了一种角色区分方法、装置、设备及可读存储介质。该方案中,在获取待进行角色区分处理的视频数据,以及,与视频数据对应的音频数据之后;先从视频数据中提取各个参会人的唇形图片数据;再将音频数据与各个参会人的唇形图片数据进行匹配,得到匹配结果;当匹配结果指示存在与音频数据匹配的唇形图片数据时,将与音频数据匹配的唇形图片数据对应的参会人确定为音频数据的说话人。该方案同时利用视频数据和音频数据,在有多人干扰或者环境复杂的室内场景中,如果有多人交谈,能够对交谈的多人进行准确的角色区分。
(19)国家知识产权局
(12)发明专利申请
(10)申请公布号 CN 115985324 A
(43)申请公布日 2023.04.18
(21)申请号 202211654390.5
(22)申请日 2022.12.22
(71)申请人 科大讯飞股份有限公司
地址 23
原创力文档

文档评论(0)