当前位置: 首页 > news >正文

绵阳网站建设wordpress w3 total cache

绵阳网站建设,wordpress w3 total cache,百事通微信推广平台,三亚做网站推广场景 Tesseract Tesseract是一个开源的光学字符识别(OCR)引擎,它可以将图像中的文字转换为计算机可读的文本。 支持多种语言和书面语言,并且可以在命令行中执行。它是一个流行的开源OCR工具,可以在许多不同的操作系…

场景

Tesseract

Tesseract是一个开源的光学字符识别(OCR)引擎,它可以将图像中的文字转换为计算机可读的文本。

支持多种语言和书面语言,并且可以在命令行中执行。它是一个流行的开源OCR工具,可以在许多不同的操作系统上运行。

GitHub - tesseract-ocr/tesseract: Tesseract Open Source OCR Engine (main repository)

Tess4J

Tess4J是一个基于Tesseract OCR引擎的Java接口,可以用来识别图像中的文本,说白了,就是封装了它的API,让Java可以直接调用。

中文文字训练集下载

Tesseract引擎默认是无法识别中文的,只能识别数字或者英文。如果我们想实现中文的识别就得去下载对应的训练集。

GitCode - 开发者的代码家园

下载之后找到中文简体训练集文件

将chi_sim.traineddata复制到某磁盘路径下,这里放在D盘tessdata目录下

注:

博客:
霸道流氓气质-CSDN博客

实现

1、搭建SpringBoot项目后,添加Tess4J依赖

        <dependency><groupId>net.sourceforge.tess4j</groupId><artifactId>tess4j</artifactId><version>4.5.4</version></dependency>

2、在配置文件application.yml中添加训练集文件夹的路径

# 训练数据文件夹的路径
tess4j:datapath: D:/tessdata

3、新增配置类,读取配置文件内容,并初始化Tesseract类,交给Spring管理

import net.sourceforge.tess4j.Tesseract;
import org.springframework.beans.factory.annotation.Value;
import org.springframework.context.annotation.Bean;
import org.springframework.context.annotation.Configuration;@Configuration
public class TesseractOcrConfiguration {@Value("${tess4j.datapath}")private String dataPath;@Beanpublic Tesseract tesseract() {Tesseract tesseract = new Tesseract();// 设置训练数据文件夹路径tesseract.setDatapath(dataPath);// 设置为中文简体tesseract.setLanguage("chi_sim");return tesseract;}
}

4、编写Service接口层

import java.io.InputStream;public interface IOcrService {String recognizeText(InputStream sbs);
}

5、编写ServiceImpl

import com.ruoyi.system.service.IOcrService;
import net.sourceforge.tess4j.Tesseract;
import net.sourceforge.tess4j.TesseractException;
import org.springframework.beans.factory.annotation.Autowired;
import org.springframework.stereotype.Service;
import javax.imageio.ImageIO;
import java.awt.image.BufferedImage;
import java.io.IOException;
import java.io.InputStream;@Service
public class OcrServiceImpl implements IOcrService {@Autowiredprivate Tesseract tesseract;@Overridepublic String recognizeText(InputStream sbs) {// 转换try {BufferedImage bufferedImage = ImageIO.read(sbs);// 对图片进行文字识别return tesseract.doOCR(bufferedImage);} catch (IOException | TesseractException e) {e.printStackTrace();return null;}}
}

6、编写单元测试

import com.ruoyi.system.service.IOcrService;
import org.junit.Test;
import org.junit.runner.RunWith;
import org.springframework.beans.factory.annotation.Autowired;
import org.springframework.boot.test.context.SpringBootTest;
import org.springframework.test.context.junit4.SpringRunner;
import java.io.FileInputStream;
import java.io.FileNotFoundException;
import java.io.InputStream;@RunWith(SpringRunner.class)
@SpringBootTest(classes = RuoYiApplication.class,webEnvironment = SpringBootTest.WebEnvironment.RANDOM_PORT)
public class Tess4JOcrTest {@Autowiredprivate IOcrService iOcrService;@Testpublic void ocrLocalPng() {try {InputStream inputStream=new FileInputStream("D://tess4j.png");String result = iOcrService.recognizeText(inputStream);System.out.println(result);} catch (FileNotFoundException e) {e.printStackTrace();}}
}

7、这里的png文件随便截图并放在磁盘路径下,运行单元测试

识别效果可能存在不准确的情况。

其它使用场景,比如前端上传照片,后台识别返回结果等可自己进行扩展。

http://www.yayakq.cn/news/814861/

相关文章:

  • 国外网站网页设计网站建设礼品
  • 物流网站毕业设计工业设计东莞网站建设
  • 建博客网站东莞网站建设 钢结构
  • 仿租号网站源码网站开发规划设计公司年终总结
  • 农业电商网站建设ppt网站建设的基本步骤是哪些
  • 南昌县城乡规划建设局官方网站房地产宣传推广方案
  • 网站追踪如何做WordPress这新手
  • 搜索引擎优化包括哪些山西常见网站建设推荐优化
  • wordpress添加新php页面网站建设优化之优化关键字
  • 闵行交大网站建设个人微博网站设计
  • 网站建设与网站设计哪个好学微信网站搭建教程
  • 上海高端网站建设服务建设论坛网站需要做什么
  • 建设工业网站首页域名查询注册信息查询
  • 邢台城乡建设局网站3d模拟设计房子软件
  • 学做旗袍衣服的网站免费源码资源源码站入口
  • 银川市建设厅网站门户网站推广怎么做
  • 淮北公司做网站58徐州网站建设
  • 彩票游戏网站开发营销型网站建设广州
  • 建设银行的英语网站首页佛山网页设计师培训
  • 建筑公司网站平台河南省新闻联播视频
  • 网站建设推广平台有哪些方面做的好英文网站
  • 网站制作的困难与解决方案wordpress发不出邮件
  • qq空间个人网站做网站犯法吗
  • 百度搜索 相关网站建立诊断的步骤
  • 网站title如何写wordpress两步验证
  • redhat7做网站过程网站建设中的主要功能
  • 房产网站开发文档.net怎么做网站
  • 无锡优化网站业务廊坊视频优化排名
  • 兼职网站编程携创网中国工商注册网年审
  • 网站区域名是什么意思网页开发自学