一种视频中人物说话识别方法.pdfVIP

  • 9
  • 0
  • 约1.16万字
  • 约 11页
  • 2023-06-25 发布于四川
  • 举报
本发明提供一种视频中人物说话识别方法,稳定,精度高,鲁棒性好,且轻量、运行效率高。本发明包括如下步骤:步骤一:使用目标检测算法对该视频进行人脸框检测,对每一帧图片得到人脸框,将人脸框按A倍外扩后得到人脸外扩框;步骤二:将人脸外扩框抠出来的图像缩放后,输入给人脸关键点检测模型,得到B个人脸关键点集合;基于嘴唇关键点向外做最大外接矩形,得到最大外接矩形框;将最大外接矩形框外扩C倍后再得到一矩形框,将该矩形框区域抠图保存下来,得到嘴唇数据;步骤三:将嘴唇数据放入帧队列,并对该矩形框记录连续E帧的数据,

(19)国家知识产权局 (12)发明专利申请 (10)申请公布号 CN 116311445 A (43)申请公布日 2023.06.23 (21)申请号 202310242483.5 G06N 3/098 (2023.01) (22)申请日 2023.03.

文档评论(0)

1亿VIP精品文档

相关文档