一种OCR文本纠错方法.pdfVIP

  • 11
  • 0
  • 约2.57万字
  • 约 19页
  • 2023-09-02 发布于四川
  • 举报
该发明公开了一种OCR文本纠错方法,本发明在编码器后链接一个全连接层(DenseLayer)作为解码器(Decoder)。在解码器解码过程中,使用集束搜索(BeamSearch)方法优化解空间的搜索路径,得到排名前K(K为集束搜索的搜索宽度)的候选结果。再对候选结果通过log_softmax函数计算出概率分布,最终从概率分布中选出概率分数最高的候选作为纠错后的文本。相比于之前仅使用纯本文进行OCR文本纠错,该发明能够更好地利用文档的布局和视觉信息,更好地提升了纠错结果,在数据集SROIE上的

(19)国家知识产权局 (12)发明专利申请 (10)申请公布号 CN 116682132 A (43)申请公布日 2023.09.01 (21)申请号 202310663686.1 (22)申请日 2023.06.06 (71)申请人 电子科技大学 地址 611731

文档评论(0)

1亿VIP精品文档

相关文档