使用ABBYY FineReader 手动校正文档复杂结构

ABBYY FineReader 15（Windows系统）拥有强大的OCR识别功能，能对扫描仪或者数码相机等光学工具获取的图像进行识别，解析其中的文本、图像、表格、条形码等，方便用户进一步获取图像中的信息。

但由于设备或者拍摄时的客观因素影响，获取的图像可能并不是很理想的状态，比如图像可能会倾斜，识别的区域类型错误等，ABBYY FineReader 15 OCR文字识别软件配备了手动校正文档复杂结构的功能，更好地提高OCR的识别质量。接下来，小编以一个实例来演示一下手动校正文档的过程。

首先，要先把图像文件导入到软件的OCR编辑中，更为简便的方式是直接在“新任务窗口”的转换文档处使用“在OCR编辑器中打开”。

图1：打开OCR编辑器

第一步、对图像进行自动识别

导入图像后，ABBYY FineReader 15 OCR文字识别软件的OCR编辑器会对图像进行预处理的识别。导入了一张包含两个页面的、方向倒置的图书照片，软件会自动将其页面分割，并将页面翻转至正确方向，然后对其中的文本、图像、表格等进行区域分类。

图2：图像识别

图3：图像识别后

第二步、手动校正

在ABBYY FineReader 15 中，选中其中需要处理的图像，在“图像面板”处，可以看到图像中的右上角区域被定义为“图片”，但其中是包含有文本的，此时，就可以使用手动调整区域的功能。

图4：图片区域

·调整区域的边框，使用鼠标拖动图片区域的边框，将图片的文字部分减去。

图5：减去文本区域

·然后使用“图像面板”顶部工具栏的“新建区域”工具，新建文本区域。选择上一步中减去的文本区域，将其定义为文本，提高OCR识别的质量。

图6：新建的文本区域

·调整页面的属性，右击需要调整的区域，在其右击快捷菜单里选择“属性”，即可在图像面板的底部找到该区域的具体属性。选择其中的页脚文本，在其“功能属性”中，可将其定义为“页眉和页脚”。

图7：调整页面的属性

通过使用ABBYY FineReader 15 OCR文字识别软件的OCR识别功能，能帮助用户尽可能准确地获取到图像文件中的信息。通过预先识别+后期手动调整的方式，可帮助用户更有效地进行图像识别，既能减少不必要的简单重复劳动，也能发挥自我能动性。点击ABBYY FineReader教程即刻获取更多OCR识别技巧。

使用ABBYY FineReader 手动校正文档复杂结构的更多相关文章

如何使用ABBYY FineReader 手动管理文档区域
在运用OCR编辑器时,ABBYY FineReader 15(Windows系统)OCR文字识别软件会对扫描仪或数码相机导入的图像进行识别和检测.在识别和检测之前,软件会自动对PDF文档中的文本.图片 ...
ABBYY FineReader 15 PDF文档查看功能
PDF文档查看功能是ABBYY FineReader 15(Windows系统)OCR文字识别软件中PDF编辑器的一项基础功能,可供用户查看,搜索PDF文档,无需进入编辑模式,也可复制其中的文本,图片 ...
ABBYY FineReader 15 对比文档功能
想必大家在办公的时候都有着要处理各种各样文档的烦恼,一个文档经过一个人或不同人的多次修订都是常有的事,拥有文档对比功能的软件也就应势而生.ABBYY FineReader 15 有许多能够帮助我们办公 ...
ABBYY FineReader 15 PDF文档编辑功能详解
ABBYY FineReader 15(Windows系统)OCR文字识别软件作为一款通用 PDF 工具,能轻松有效地对各种 PDF文档和纸质文档,进行数字化.检索.编辑.转换.包含.分享和合作,而其 ...
HTML介绍、文档基本结构、meta标签、HTML标记的语法
一.HTML的介绍 Hyper Text Mark-up Language 超文本标记语言,是一种描述性标记语言(不是编程语言),主要用于描述网页(可以有图像,文字,声音,等..)但没有交互性 HTM ...
MFC单文档程序结构
MFC单文档程序结构三方面: Doc MainFrame View
深入分析MFC文档视图结构（项目实践）
k_eckel:http://www.mscenter.edu.cn/blog/k_eckel 文档视图结构(Document/View Architecture)是MFC的精髓,也是Observer ...
MFC文档视图结构学习笔记
文档/视图概述为了统一和简化数据处理方法,Microsoft公司在MFC中提出了文档/视图结构的概念,其产品Word就是典型的文档/视图结构应用程序 MFC通过其文档类和视图类提供了大量有关数据处理 ...
ABBYY 识别结果的文档怎么导出
使用ABBYY FineReader Pro for Mac OCR文字识别软件识别文档时,识别结果可以保存至一个文件.复制到剪贴板或通过电子邮件发送.可以执行下列操作:导出整个文档.仅导出所选页面. ...

随机推荐

Spring 缓存抽象
Spring从3.1开始定义了org.springframework.cache.Cache和org.springframework.cache.CacheManager接口来统一不同的缓存技术:并支 ...
user.ini Operation not permitted
rm: cannot remove '/public/.user.ini': Operation not permitted chattr -i .user.ini rm -f .user.ini
工业4G DTU是什么和普通DTU有什么不同
4G DTU作为一种物联网远程数据传输设备,现今在世界范围内都有非常广泛的应用,根据应用场景的不同,对4G DTU设备支持的功能,硬件设施的要求都有不同,特别是在工业现场,对4G DTU设备的要求非常 ...
[LuoguP2161[ [SHOI2009]会场预约 (splay)
题面传送门:https://www.luogu.org/problemnew/show/P2161 Solution splay 的确有线段树/树状数组的做法,但我做的时候脑残没想到我们可以考虑写 ...
final,static,this,super 关键字总结
一.final 关键字 final关键字主要用在三个地方:变量.方法.类. 1.对于一个final变量,如果是基本数据类型的变量,则其数值一旦在初始化之后便不能更改:如果是引用类型的变量,则在对其初始 ...
Netty源码解析 -- ChannelOutboundBuffer实现与Flush过程
前面文章说了,ChannelHandlerContext#write只是将数据缓存到ChannelOutboundBuffer,等到ChannelHandlerContext#flush时,再将Cha ...
视频直播源码开发中的流媒体协议：rtmp协议
一.概念与摘要视频直播源码的RTMP协议从属于应用层,被设计用来在适合的传输协议(如TCP)上复用和打包多媒体传输流(如音频.视频和互动内容).RTMP提供了一套全双工的可靠的多路复用消息服务,类似 ...
PHP修改css文件中的背景图片并下载到本地
扒网站当中一般css中的图片扒不下来,这个脚本就是用来下载这些图片到本地的流程 1.获取css文件路径 2.打开文件逐行读取判断是否包含需要的图片 2.1 包含则 -进行截取直接获取到相对路径 2. ...
利用sklearn实现knn
基于上面一篇博客k-近邻利用sklearns实现knn #!/usr/bin/env python # coding: utf-8 # In[1]: import numpy as np import ...
C\C++语言重点——指针篇 | 为什么指针被誉为 C 语言灵魂？（一文让你完全搞懂指针）
本篇文章来自小北学长的公众号,仅做学习使用,部分内容做了适当理解性修改和添加了博主的个人经历. 注:这篇文章好好看完一定会让你掌握好指针的本质! 看到标题有没有想到什么? 是的,这一篇的文章主题是「指 ...

使用ABBYY FineReader 手动校正文档复杂结构

使用ABBYY FineReader 手动校正文档复杂结构的更多相关文章

随机推荐

热门专题