文字识别操作步骤.docVIP

下载本文档

3
0
约1.24千字
约 3页
2016-07-05 发布于安徽
举报
版权申诉

文字识别操作步骤.doc

1、本文档共3页，可阅读全部内容。
2、原创力文档（book118）网站文档一经付费（服务费），不意味着购买了该文档的版权，仅供个人/单位学习、研究之用，不得用于商业用途，未经授权，严禁复制、发行、汇编、翻译或者网络传播等，侵权必究。
3、本站所有内容均由合作方或网友上传，本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺！文档内容仅供研究参考，付费前请自行鉴别。如您付费，意味着您自己接受本站规则且自行承担风险，本站不退款、不进行额外附加服务；查看《如何避免下载的几个坑》。如果您已付费下载过本站文档，您可以点击这里二次下载。
4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等，请点击“版权申诉”（推荐），也可以打举报电话：400-050-0827(电话支持时间：9:00-18:30)。
5、该文档为VIP文档，如果想要下载，成为VIP会员后，下载免费。
6、成为VIP后，下载本文档将扣除1次下载权益。下载后，不支持退款、换文档。如有疑问请联系我们。
7、成为VIP后，您将拥有八大权益，权益包括：VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
8、VIP文档为合作方或网友上传，每下载1次，网站将根据用户上传文档的质量评分、类型等，对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档

文字识别操作步骤.doc

文字识别操作步骤本软件系统是应用OCR（Optical Character Recognition）技术，为满足书籍、报刊杂志、报表票据、公文档案等录入需求而设计的软件系统。目前，许多信息资料需要转化成电子文档以便于各种应用及管理，但因信息数字化处理的方式落后，不但费时费力，而且资金耗费巨大，造成了大量文档资料的积压，因此急需一种快速高效的软件系统来满足这种海量录入需求。本软件系统正是适用于个人、小型图书馆、小型档案馆、小型企业进行大规模文档输入、图书翻印、大量资料电子化的软件系统。识别字符简体字符集：国标GB2312-80的全部一、二级汉字6800多个。纯英文字符集。简繁字集：除了简体汉字外，还可以混识台湾繁体字5400多个以及香港繁体字和GBK汉字。识别字体种类能识别宋体、仿宋、楷、黑、魏碑、隶书、圆体、行楷等一百多种字体，并支持多种字体混排。识别字号初号小六号字体。表格识别可以自动判断、拆分、识别和还原各种通用型印刷体表格。可支持繁体WINDOWS系统 ? 用扫描仪扫描的文字图像，不能对个别文字进行编辑修改，在教学中，需要利用文字识别软件，将文字图像进行识别，将图像格式转化成文本格式，常见的文字识别软件有很多，主要功能基本相同，尚书七号就是其中很优秀的一款。用尚书七号对文字图像识别转化的过程，利用其主菜单：“文件”、“编辑”、“识别”、“输出”可以很方便地完成。具体步骤为：步骤1：获取文字图像文件。选择“文件”菜单下的“扫描”或“打开图像”（将已经扫描好的图像文件打开）命令，打开图像文件。如果连接了多台扫描仪，可以选择“文件”菜单下的“选择扫描仪”命令，调用扫描仪。步骤2：对扫描的图像页进行调整选择“编辑”菜单下“图像页面的处理”子菜单下的“图像页的倾斜校正”（提供自动和手动实现方法）及“旋转”等命令，将扫描的图像页进行调整。步骤3：版面分析与文字识别转化版面分析，选择识别范围，在进行文字识别前要选择识别范围，识别过程的核心是“版面分析”。尚书七号的自动版面分析功能很强，对报纸杂志等复杂的版面，也能保持很高的分析正确率。设置好后，直接点击“开始识别”的按钮就可以进行文字识别了。 ? 步骤4：校对修改自动识别完毕，识别结果的“文本窗口”会弹出，这个窗口能够提供识别结果的校对，为了校对方便，尚书七号增加了光标跟随显示原图像行的校对方法（如图3出现的黄色提示行的出现）。提供的校对方法，一眼就能够看到图像原文和识别出文本的差别，如果发现识别有误，可以进行修改。步骤5：输出如果检查修改后确认无误，选择识别结果的“输出”菜单，输出的文件格式有：RTF、HTML、XLS、2126，可以根据自己的需要选择对应的格式。如果用户想得到类似原文的识别结果，请选择RTF格式。把RTF格式输出的文件用WORD打开后，会发现几乎保留了原文的所有痕迹，包括原来页面中的彩色图像，都已经保留在WORD中了。

您可能关注的文档

文档评论（0）

youyang99 + 关注: 实名认证

文档贡献者

该用户很懒，什么也没介绍

咨询Ta 进入空间

1亿VIP精品文档

更多 >

文字识别操作步骤.docVIP