java使用Tess4J实现OCR图片文字识别

2023-11-01 09:50

本文主要是介绍java使用Tess4J实现OCR图片文字识别,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

目录

  • 介绍
  • 一、maven如下
  • 二、下载语言模型
    • 1.下载语言模型
    • 2.百度云下载
  • 三、测试
    • 1.测试代码
    • 2.测试图片
    • 3.效果

介绍

Tess4J 是 Tesseract OCR 的 java api 实现库,你可以通过 java 调用来轻松的实现图片识别并提取文字,也就是 OCR 图片提取文字技术。

Tess4J 支持识别的的图片格式:

  • TIFF、JPEG、GIF、PNG 和 BMP 图像格式
  • 多页 TIFF 图像
  • PDF文档格式

Tesseract OCR的github官网

Tesseract OCR 使用手册

Tess4J 官网

一、maven如下

        <dependency><groupId>net.sourceforge.tess4j</groupId><artifactId>tess4j</artifactId><version>5.7.0</version></dependency><!-- 解决输出的时候 slf4j 报错 -->   <dependency><groupId>org.slf4j</groupId><artifactId>slf4j-api</artifactId><version>1.8.0-beta4</version></dependency><dependency><groupId>org.slf4j</groupId><artifactId>slf4j-simple</artifactId><version>1.8.0-beta4</version></dependency>

二、下载语言模型

如果因为网络问题,你访问不了 github 或语言模型下载缓慢失败,可以直接看第2步百度云下载。

1.下载语言模型

tesseract 支持一百多种语言识别,你可以从 Traineddata 语言模型说明下载页面 选择自己想要识别的.traineddata 格式的语言模型文件下载。

(1)特殊的模型

  • 如果你想识别图片里的各种方向的文字可以下载 osd.traineddata 模型

  • 如果你想识别图片里的各种数学公式、方程可以下载 equ.traineddata 模型

(2)语言模型

tesseract 在 GitHub 上的有三个独立的语言模型存储库 tessdata、tessdata-best、tessdata-fast 他们分别都存储了语言模型,他们的区别是:

如何训练得到的速度识别准确性是否支持旧版是否支持再训练
tessdata传统+LSTM(并整合tessdata-best)比 tessdata-best 更快比 tessdata-best 准确度稍低支持不支持
tessdata-best仅 LSTM(基于langdata)最慢最准确不支持支持
tessdata-fast比 tessdata-best 更小的 LSTM网络整合最快的最不准确不支持不支持

我测试识别一张多文字图片的时候,tessdata-best 效果最好但花了快10秒,tessdata 花了3秒但效果稍微差一点。你可以根据自己的需要去选择下载语言模型文件,我这里选择的是 tessdata-best 库里下载 chi_sim.traineddata (简体中文)、eng.traineddata (英文模型)。

因为网络问题,如果你访问不了 github 或下载缓慢,可以从我的百度云下载 tessdata 和 tessdata-best,里面包含了所有的语言模型文件,(如果你只需要中英文的模型可以看我第 2 步):

百度云下载: tessdata-4.1.0.zip 约 635 MB (链接:https://pan.baidu.com/s/1e2UKTpMqnfhpCoq6NquIAQ
提取码:jc9p)

百度云下载: tessdata_best-4.1.0.zip 约1.29 GB (链接:https://pan.baidu.com/s/1dcHpukvaH6Rtma_drfqD9g
提取码:w3gh)

(3)项目的 resources 文件夹下新建 tessdata 文件夹,然后把上面下载的 .traineddata 格式的语言模型文件复制到 tessdata 下。

2.百度云下载

如果因为网络问题,你访问不了 github 或下载缓慢失败,可以从百度云下载我的 tessdata.zip ,里面包含了中英文语言模型 ,解压后把 tessdata 文件夹复制到你的 resources 文件夹下即可:

百度云下载: tessdata.zip 约27MB (链接:https://pan.baidu.com/s/1nXHJ_e4kzOGHbFwh95ijEg
提取码:k1qu)

三、测试

1.测试代码


import net.sourceforge.tess4j.Tesseract;
import net.sourceforge.tess4j.TesseractException;
import java.io.File;
import java.awt.*;public class MainServer {public static void main(String[] args) throws TesseractException {long start = System.currentTimeMillis();System.out.println("开始OCR文字识图,请稍后...");//加载要识别的图片File image = new File("F:\\image\\test1.jpg");//设置配置文件夹微视、识别语言、识别模式Tesseract tesseract = new Tesseract();tesseract.setDatapath("src/main/resources/tessdata");//设置识别语言为中文简体,(如果要设置为英文可改为"eng")tesseract.setLanguage("chi_sim");//使用 OSD 进行自动页面分割以进行图像处理tesseract.setPageSegMode(1);//设置引擎模式是神经网络LSTM引擎tesseract.setOcrEngineMode(1);//开始识别整张图片中的文字String result = tesseract.doOCR(image);long time = System.currentTimeMillis()-start;System.out.println("识别结束,耗时:"+time+" 毫秒,识别结果如下:");System.out.println();System.out.println(result);}
}

上面示例中是识别整张图片中的文字,如果你只想识别图片中特定部分的文字,可以像下面这样选定长宽范围识别:

String result = tesseract.doOCR(image, new Rectangle(300, 200));

2.测试图片

请添加图片描述

3.效果

请添加图片描述


参考:

Optical Character Recognition with Tesseract

这篇关于java使用Tess4J实现OCR图片文字识别的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/322151

相关文章

使用Python和OpenCV库实现实时颜色识别系统

《使用Python和OpenCV库实现实时颜色识别系统》:本文主要介绍使用Python和OpenCV库实现的实时颜色识别系统,这个系统能够通过摄像头捕捉视频流,并在视频中指定区域内识别主要颜色(红... 目录一、引言二、系统概述三、代码解析1. 导入库2. 颜色识别函数3. 主程序循环四、HSV色彩空间详解

Windows下C++使用SQLitede的操作过程

《Windows下C++使用SQLitede的操作过程》本文介绍了Windows下C++使用SQLite的安装配置、CppSQLite库封装优势、核心功能(如数据库连接、事务管理)、跨平台支持及性能优... 目录Windows下C++使用SQLite1、安装2、代码示例CppSQLite:C++轻松操作SQ

PostgreSQL中MVCC 机制的实现

《PostgreSQL中MVCC机制的实现》本文主要介绍了PostgreSQL中MVCC机制的实现,通过多版本数据存储、快照隔离和事务ID管理实现高并发读写,具有一定的参考价值,感兴趣的可以了解一下... 目录一 MVCC 基本原理python1.1 MVCC 核心概念1.2 与传统锁机制对比二 Postg

SpringBoot整合Flowable实现工作流的详细流程

《SpringBoot整合Flowable实现工作流的详细流程》Flowable是一个使用Java编写的轻量级业务流程引擎,Flowable流程引擎可用于部署BPMN2.0流程定义,创建这些流程定义的... 目录1、流程引擎介绍2、创建项目3、画流程图4、开发接口4.1 Java 类梳理4.2 查看流程图4

一文详解如何在idea中快速搭建一个Spring Boot项目

《一文详解如何在idea中快速搭建一个SpringBoot项目》IntelliJIDEA作为Java开发者的‌首选IDE‌,深度集成SpringBoot支持,可一键生成项目骨架、智能配置依赖,这篇文... 目录前言1、创建项目名称2、勾选需要的依赖3、在setting中检查maven4、编写数据源5、开启热

C++中零拷贝的多种实现方式

《C++中零拷贝的多种实现方式》本文主要介绍了C++中零拷贝的实现示例,旨在在减少数据在内存中的不必要复制,从而提高程序性能、降低内存使用并减少CPU消耗,零拷贝技术通过多种方式实现,下面就来了解一下... 目录一、C++中零拷贝技术的核心概念二、std::string_view 简介三、std::stri

Python常用命令提示符使用方法详解

《Python常用命令提示符使用方法详解》在学习python的过程中,我们需要用到命令提示符(CMD)进行环境的配置,:本文主要介绍Python常用命令提示符使用方法的相关资料,文中通过代码介绍的... 目录一、python环境基础命令【Windows】1、检查Python是否安装2、 查看Python的安

C++高效内存池实现减少动态分配开销的解决方案

《C++高效内存池实现减少动态分配开销的解决方案》C++动态内存分配存在系统调用开销、碎片化和锁竞争等性能问题,内存池通过预分配、分块管理和缓存复用解决这些问题,下面就来了解一下... 目录一、C++内存分配的性能挑战二、内存池技术的核心原理三、主流内存池实现:TCMalloc与Jemalloc1. TCM

OpenCV实现实时颜色检测的示例

《OpenCV实现实时颜色检测的示例》本文主要介绍了OpenCV实现实时颜色检测的示例,通过HSV色彩空间转换和色调范围判断实现红黄绿蓝颜色检测,包含视频捕捉、区域标记、颜色分析等功能,具有一定的参考... 目录一、引言二、系统概述三、代码解析1. 导入库2. 颜色识别函数3. 主程序循环四、HSV色彩空间

Java对异常的认识与异常的处理小结

《Java对异常的认识与异常的处理小结》Java程序在运行时可能出现的错误或非正常情况称为异常,下面给大家介绍Java对异常的认识与异常的处理,本文给大家介绍的非常详细,对大家的学习或工作具有一定的参... 目录一、认识异常与异常类型。二、异常的处理三、总结 一、认识异常与异常类型。(1)简单定义-什么是