- 9
- 0
- 约1.16万字
- 约 11页
- 2023-06-25 发布于四川
- 举报
本发明提供一种视频中人物说话识别方法,稳定,精度高,鲁棒性好,且轻量、运行效率高。本发明包括如下步骤:步骤一:使用目标检测算法对该视频进行人脸框检测,对每一帧图片得到人脸框,将人脸框按A倍外扩后得到人脸外扩框;步骤二:将人脸外扩框抠出来的图像缩放后,输入给人脸关键点检测模型,得到B个人脸关键点集合;基于嘴唇关键点向外做最大外接矩形,得到最大外接矩形框;将最大外接矩形框外扩C倍后再得到一矩形框,将该矩形框区域抠图保存下来,得到嘴唇数据;步骤三:将嘴唇数据放入帧队列,并对该矩形框记录连续E帧的数据,
(19)国家知识产权局
(12)发明专利申请
(10)申请公布号 CN 116311445 A
(43)申请公布日 2023.06.23
(21)申请号 202310242483.5 G06N 3/098 (2023.01)
(22)申请日 2023.03.
原创力文档

文档评论(0)