- 10
- 0
- 约2.35千字
- 约 2页
- 2024-01-05 发布于宁夏
- 举报
OCR⽂字识别:深度学习算法识别步骤
之前没有接触过OCR⽂字识别,本⽂主要对使⽤深度学习算法完成⽂字识别的整体步骤进⾏⼀下梳理。
⼀般来说,OCR⽂字识别是检测+识别,⾸先将可能在⽂字的区域检测出来,然后在进⾏识别。本质是识别图⽚中的⽂字,即在复杂的图⽚
背景下对所需⽬标⽂字进⾏识别提取。
1、⽂字识别基础步骤
①detection:检测存在⽂字的区域,得到proposal。
②recognation:识别proposal中的⽂字。
2、⽂字区域detection
对⽂字存在区域的detection⽅法,与⽬标检测领域的常⽤检测⽅法相当,分为one-stage和two-stage⽅法,(后续也可以考虑使
anchorfree的⽅法对⽂字propsal进⾏检测)。
(1)在⽂字识别领域,常⽤的two-stage⽅法为fasterrcnn,one-stage⽅法主要有yolo系列⽅法。相⽐之下,前者的精度更好,后者速
度更快。
(2)在⽂字识别领域,与传统⽬标检测的不同还在于⽂字的⽅向、扭曲程度等。
①对于⽔平⽂字的检测。⽔平⽂字⽂本框是规则的四边形(四个⾃由度),类似于物体检测。⽔平⽂字检测效果较好的算法为CPTN:
DetectingTexti
原创力文档

文档评论(0)