- 11
- 0
- 约1.38万字
- 约 12页
- 2023-09-16 发布于四川
- 举报
本发明公开了一种基于深度学习的文本检测与识别的端到端方法,包括以下步骤:构建并训练基于神经网络的端到端模型,使用训练完成的端到端模型对给定图像中的文档文本进行检测和识别。本发明的文本检测与识别的端到端模型,在骨架网络阶段,通过设计的融合模块达成跨尺度的特征融合,不仅降低了计算开销,还提高了模型的精度;在训练的优化阶段,通过联合文本检测任务的损失函数和文本识别的损失函数,兼顾了文本检测与识别的损失,同时优化文本检测与文本识别任务,降低训练带来的时间成本;在推理阶段,模型只需要进行一次向前推理,就可
(19)国家知识产权局
(12)发明专利申请
(10)申请公布号 CN 116758552 A
(43)申请公布日 2023.09.15
(21)申请号 202310866899.4 G06N 3/08 (2023.01)
(22)申请日 2023.07.1
原创力文档

文档评论(0)