image-processing - 使用模糊文本改善 Tesseract OCR 结果-6ren

image-processing - 使用模糊文本改善 Tesseract OCR 结果

转载作者：行者123 更新时间：2023-12-04 01:12:39

24

4

我正在研究打印文本的 OCR 识别。我特别关注预处理步骤以改进 Tesseract 的结果。引擎。
我已经通过自适应阈值、噪声去除、文本纠偏等获得了良好的结果......但是当其他商业产品返回不错的结果时，Tesseract 似乎仍然失败。

我使用了以下测试图像，这里是使用 Tesseract 3.04 与两个商业 OCR api 相比获得的结果。所有 3 个服务都提供了相同的二进制图像，其中包含一些稍微模糊的文本。

Text image used to compared the 3 OCR products

Tesseract

Careers in Technology Consulting

Networking Lunch
21 m 2014, 11:00 - 14:30

Definingthecorporatellstmtegy, Wammmwdngdeal, creating
uniquebwinessisighnwilgbigdam-doesﬂismﬂxemmyouaﬁoy?

Findoutmoreabanhowitfeektomkasatedlﬂogymbyjoiningour

for further mm please visit mAeloittexom/weers

ABBYY Fine Reader Online

Careers in Technology Consulting
Networking Lunch
21 November 2014,1140-14:30
Defining the corporate IT strategy, planning a multHnKon <Mar outsourcing deal, creating unique business insights using big data-doesthis sound Ifce something you enjoy?
Find out more about hour it feels to work as a technology consultant by joining our exclusive networking lunch,
For further information please visit wrwMuleloittexom/carcert

Online OCR

Careers in Technology Consulting Networking Lunch 21 November 2014, 11;00 —14:30 
Defining the corporate IT strategy, planning a muiti-indlimi dollar outsourcing deal, creating unique business insights using big data—does this sound like something you enjoy? 
Find out more about how it feels to work as a tedmology consultant by joining our exclusive networking lunch, 
For further information' please visit wwwdeloitte,com/careers

现在我想知道 Tesseract 和其他两个产品之间的巨大差距是由于不同的引擎(确定 ABBYY 使用自己的引擎，不确定 OCR Web Service)还是在运行 Tesseract 之前可以完成其他一些预处理步骤.你有什么建议吗？

最佳答案

这里有一个关于“魔法”OCR 预处理的建议。
为了解释所提出的预处理思想的原理，让我们考虑从所提供的文本图像中摘录的所有测试 OCR 都失败的内容:

并对其应用一些“预处理智慧”。首先是通常的阈值:

然后通过单词元素拍摄垂直线，检测最大。 2 像素高的“条”并在它们的边缘切割它们，同时将单词元素切割到其底线:

现在将通过此图像中的单词元素的拍摄线从垂直切换到水平，以检测非常宽的“条”并在其宽度的中间垂直切割它们:

这应该有助于任何 OCR 引擎在此特定图像上提供更好的结果。我可以想象一些商业 OCR 引擎使用这种方法已经能够提供比测试的更好的识别。

在这种情况下，让我提一下 Ubuntu 存储库中可用的另一个免费 OCR 引擎(与 tesseract 相当)。对它们进行相互测试，您可能会更想知道它们是如何提供不同结果的，然后查看它们的源代码以了解 :) 并从这种经验中推断出一些商业方面的经验。

sudo apt-get install cuneiform gocr ocrad

关于image-processing - 使用模糊文本改善 Tesseract OCR 结果，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/27671811/

24

4

0

文章推荐： google-maps - 谷歌用其他颜色映射 v3 默认标记路径

文章推荐： cdata-section的powershell解析

文章推荐： scala - 返回会破坏引用透明度吗？

tesseract - tesseract 的最小图像大小
我正在尝试使用 tesseract 来识别图像中的字符。这个图像是通过从另一个图像中抓取字符并将它们放在新图像中的一行来创建的。问题是，当我将这张图片提供给 tesseract 时，它在输出中没有显示
tesseract - 为新字体训练 Tesseract
使用创建聚类数据时 mftraining -F font_properties -U unicharset -O lan.unicharset *.tr 我收到以下消息 C:\Users\ \AppD
tesseract - 遇到问题训练 tesseract
我是 tesseract 的新手，对 github 页面中的不同目录有点困惑。 tesserac-ocr 代码库是我安装的。在/usr/local/share/tessdata/中安装了一个 tess
tesseract - Tesseract OCR 执行哪些预处理操作？
我找不到详细的文档，也没有浏览源代码的感觉。例如，如果 Tesseract 引擎已经完成，我不想重做精明的边缘检测。最佳答案本文档提供了引擎的概述:https://github.com/tesse
tesseract - 使用 Tesseract 检测黑色背景上的白色字符
我对 Tesseract OCR 完全陌生。这个问题可能很简单，但我似乎无法使用 Google 找到答案。基本上，我有一个包含两部分的图像:第一部分位于图像的顶部，黑色背景和白色文本；第二部分位于图
tesseract - Tesseract API 文档在哪里？
我浏览了整个 Google 代码网站，但没有找到任何从 API 角度解释如何使用 Tesseract 的内容。有人知道在哪里可以找到这个吗？最佳答案最新文档现已发布 here 和 here 。关
tesseract - 如何使用命令行获得对 tesseract 的字符明智的信心？
我可以通过命令行使用 tesseract 4.0 获得单词级别的置信度分数。有兴趣知道是否也有办法让角色自信。对于单词级别的置信度，使用以下命令: tesseract [Image name] ou
tesseract - 有没有办法将 tesseract 用于单个数字？
TL;DR It appears that tesseract cannot recognize images consisting of a single digit. Is there a wor
python - 没有这样的文件或目录 : 'tesseract' : 'tesseract' even though where to find tesseract is specified in pytesseract. py
所以我已经研究这个问题一段时间了，虽然其他人也有类似的问题，但对我来说没有任何作用: 我正在尝试将 pytesseract 用于项目，并将其安装在 User/Environments/testEnv/
tesseract - 无法使用 Tesseract 3.0.2.02 存档为 WIndows 编译 Tesseract API 示例
我正在考虑使用 Tesseract 来处理 PDF 文件，因此我想使用该库而不是外部可执行文件。我首先下载完整的 Tesseract 源代码并考虑构建它。遗憾的是，标准源没有任何方法可以在非 Lin
tesseract - 使用 Tesseract-OCR 获取识别字符的字体
是否可以使用 Tesseract-OCR 获取已识别字符的字体，即它们是 Arial 还是 Times New Roman，无论是从命令行还是使用 API。我正在扫描可能具有不同字体的不同部分的文档
tesseract - 强制 Tesseract 匹配模式(连续四位数字)
我试图让 Tesseract(使用 Tess4J 包装器)仅匹配特定模式。该模式是连续四位数字，我认为是\d\d\d\d。这是我正在提供 tesseract 的图像的一个非常小子集(平面图受到限制
tesseract - Tess4j Tesseract 与 Tesseract1
我不是 100% 确定 Java api 包 Tess4J 中 Tesseract 和 Tesseract1 对象的区别，任何人都可以解释一下吗？我知道 Tesseract 使用接口(interfa
tesseract - Hololens可以进行物体检测吗？或者如何在Hololens中使用YOLO/tensorflow/tesseract
我正在测试 Hololens 中的一些功能。想知道是否可以在 Hololens 中使用任何对象检测/文本识别功能？最佳答案 Hololens 1 本身不支持对象检测，您需要使用第三方代码。 Open
python-tesseract - 训练 Tesseract 来标记图标
我正在尝试为 Tesseract 4.0 创建训练数据来识别屏幕截图中的图标(例如，评论，分享，保存)。这是示例屏幕截图: 我想微调 Tesseract 以实现如下输出: 喜欢147 评论 29 已保
tesseract - 如何查找 Tesseract OCR 配置文件中支持的参数
我想知道Tesseract OCR使用的配置文件接受哪些参数，如何编写配置文件等我在 their site 上找不到任何有关此内容的文档。如何确定支持哪些参数及其含义？最佳答案 Tesseract
python-tesseract - 训练 Tesseract 来标记图标
我正在尝试为 Tesseract 4.0 创建训练数据来识别屏幕截图中的图标(例如，评论，分享，保存)。这是示例屏幕截图: 我想微调 Tesseract 以实现如下输出: 喜欢147 评论 29 已保
tesseract - 两个pip3包的区别: pytesseract vs tesseract
关闭。这个问题需要更多focused .它目前不接受答案。想改进这个问题吗？更新问题，使其只关注一个问题 editing this post . 关闭 6 年前。此帖于11个月前编辑提交审核，
tesseract - 如何在 python-tesseract 中设置 tessedit_write_images？
我正在尝试设置 tessedit_write_images但似乎做不到，我在任何地方都看不到 tessinput.tif 我正在做: import tesseract api = tesseract.
tesseract - `tesseract-ocr` 可以将结果写入 STDOUT 吗？
使用tesseract-ocr#3.02.02。 tesseract的基本用法是 tesseract sourc.png result 生成和result.txt。要获取结果文本，我必须 cat 这

首页

博学

6Ren·AI

商城

image-processing - 使用模糊文本改善 Tesseract OCR 结果