Tesseract 引擎翻译

Category: 图像识别
Last Edited: Sep 17, 2018 10:29 AM
Tags: tesseract,字符识别,翻译

1.英文原文（中文翻译）

OCR options:（OCR选项）
--tessdata-dir PATH Specify the location of tessdata path（指定tessdata路径的位置）.
--user-words PATH Specify the location of user words file （指定用户词文件的位置）.
--user-patterns PATH Specify the location of user patterns file （指定用户模式文件的位置）.
-l LANG[+LANG] Specify language(s) used for OCR （指定用于OCR的语言）.
-c VAR=VALUE Set value for config variables Multiple -c arguments are allowed.（配置变量的设置值。 -c允许多个参数。）.
--psm NUM Specify page segmentation mode （指定页面分段模式）.
--oem NUM Specify OCR Engine mode （指定OCR引擎模式）.
NOTE: These options must occur before any configfile.

Page segmentation modes:
0 Orientation and script detection (OSD) only （仅限方向和脚本检测（OSD）。）.
1 Automatic page segmentation with OSD （使用OSD自动分页）.
2 Automatic page segmentation, but no OSD, or OCR （自动页面分割，但没有OSD或OCR）.
3 Fully automatic page segmentation, but no OSD. (Default) 全自动页面分割，但没有OSD（默认）
4 Assume a single column of text of variable sizes.（假设一列可变大小的文本）
5 Assume a single uniform block of vertically aligned text.（假设一个垂直对齐文本的统一块）
6 Assume a single uniform block of text.（假设一个统一的文本块）
7 Treat the image as a single text line.（将图像视为单个文本行）
8 Treat the image as a single word.（将图像视为单个单词）
9 Treat the image as a single word in a circle.（将图像视为圆形中的单个单词。）
10 Treat the image as a single character.（将图像视为单个字符。）
11 Sparse text. Find as much text as possible in no particular order.（稀疏文字。找到尽可能多的文本，没有特定的顺序。）
12 Sparse text with OSD.（带OSD的稀疏文本）
13 Raw line. Treat the image as a single text line,bypassing hacks that are Tesseract-specific.（将图像视为单个文本行）

***OCR Engine modes:***
0 Original Tesseract only.
1 Cube only.
2 Tesseract + cube.
3 Default, based on what is available.

***Single options:***
-h, --help Show this help message.
--help-psm Show page segmentation modes.
--help-oem Show OCR Engine modes.
-v, --version Show version information.
--list-langs List available languages for tesseract engine.
--print-parameters Print tesseract parameters to stdout.

Tesseract 引擎翻译的更多相关文章

NET 2.0 OCR文字识别技术（Tesseract 引擎）［转］
一.OCR简介参见http://baike.baidu.com/view/17761.htm?fr=ala0_1 大家参照,我第一次也是这么了解的,呵呵.高手见笑现在市面上好多OCR 引擎,不 ...
Tesseract引擎编译
1. 工具包下载链接 libtiff 4.09 http://download.osgeo.org/libtiff/tiff-4.0.9.zip leptonica 1.76.0 http://www ...
Tesseract：简单的Java光学字符识别
1.1 介绍开发具有一定价值的符号是人类特有的特征.对于人们来说识别这些符号和理解图片上的文字是非常正常的事情.与计算机那样去抓取文字不同,我们完全是基于视觉的本能去阅读它们. 另一方面,计算机的工 ...
selenium使用笔记（二）——Tesseract OCR
在自动化测试过程中我们经常会遇到需要输入验证码的情况,而现在一般以图片验证码居多.通常我们处理这种情况应该用最简单的方式,让开发给个万能验证码或者直接将验证码这个环节跳过.之前在技术交流群里也跟朋友讨 ...
Tesseract-OCR引擎入门
OCR(Optical Character Recognition):光学字符识别,是指对图片文件中的文字进行分析识别,获取的过程. Tesseract:开源的OCR识别引擎,初期Tesseract引 ...
Tomcat中JSP引擎工作原理
http://blog.csdn.net/linjiaxingqqqq/article/details/7164449 JSP运行环境: 执行JSP代码需要在服务器上安装JSP引擎,比较常见的引擎有W ...
JSP引擎的工作原理
JSP运行环境: 执行JSP代码需要在服务器上安装JSP引擎,比较常见的引擎有WebLogic和Tomcat.把这些支持JSP的web服务器配置好后.就可以再客户端通过浏览器来访问JSP页面了.默认端 ...
OCR图片识别引擎
OCR引擎 OCR(Optical Character Recognition)是指使用扫描仪或数码相机对文本资料进行扫描成图像文件,然后对图像文件进行分析处理,自动识别获取文字信息及版面信息的软件. ...
R+OCR︱借助tesseract包实现图片文本提取功能
2016年11月,Jeroen Ooms在CRAN发布了tesseract包,实现了R语言对简单图片的文本提取.分析功能. 利用开源OCR引擎进行图片处理,目前可以识别超过100种语言,R语言可以借助 ...

随机推荐

【HDU1000】A+B Problem
题目来源:www.acm.hdu.edu.cn 题目编号:1000 A+B Problem /*----------------------------------------原题目-------- ...
[转] The QCOW2 Image Format
The QCOW2 Image Format https://people.gnome.org/~markmc/qcow-image-format.html The QCOW image format ...
背水一战 Windows 10 (114) - 后台任务: 后台任务的 Demo（与 app 不同进程）, 后台任务的 Demo（与 app 相同进程）
[源码下载] 背水一战 Windows 10 (114) - 后台任务: 后台任务的 Demo(与 app 不同进程), 后台任务的 Demo(与 app 相同进程) 作者:webabcd 介绍背水一 ...
EmpireCMS_V7.5的一次审计
i春秋作家:Qclover 原文来自:EmpireCMS_V7.5的一次审计 EmpireCMS_V7.5的一次审计 1概述最近在做审计和WAF规则的编写,在CNVD和CNNVD等漏洞平台寻找 ...
Android语音识别
语音识别 - 科大讯飞开放平台 http://open.voicecloud.cn/ 需要拷贝lib.assets.并在清单文件中写一些权限 public class MainActivity ex ...
JDK设计模式之—单例模式和static关键字
首先了解static 关键字 static声明的方法是静态方法,static声明的成员变量为静态成员变量.对于该类的所有对象来说,static的成员变量和static只有一份存储空间即使没有创建该类 ...
Java面试集合（四）
1. jdk,jre,jvm之间的关系 JVM是Java虚拟机,是Java跨平台的重要保障,JVM实现Java跨平台的前提,可以针对不同的操作系统,有不同的JVM. 可以说Java语言是跨平台的,但J ...
hashMap，hashTable，concurrentHashMap区别
HashTable 底层数组+链表实现,无论key还是value都不能为null,线程安全,实现线程安全的方式是在修改数据时锁住整个HashTable,效率低,ConcurrentHashMap做了相 ...
Python中parameters与argument区别
定义(define)一个带parameters的函数: def addition(x,y): return (x+y) 这里的x,y就是parameter 调用addition(3,4) 调用(cal ...
ubuntu中minicom安装和使用
想要对嵌入式开发板进行开发和操作,都需要进行文件传输或者是控制,这时基本都是需要通过串口线或者是网线进行连接的,在Windows下是使用超级终端通过串口对开发板进行操作的,而在Linux下,最后最常见 ...

Tesseract 引擎翻译

Tesseract 引擎翻译

Tesseract 引擎翻译的更多相关文章

随机推荐

热门专题