文件名称:ocr 文本识别
文件大小:41KB
文件格式:RAR
更新时间:2016-08-13 09:31:04
ocr 验证码
光学字符识别(OCR,Optical Character Recognition)是指对文本资料进行扫描,然后对图像文件进行分析处理,获取文字及版面信息的过程。OCR技术非常专业,一般多是印刷、打印行业的从业人员使用,可以快速的将纸质资料转换为电子资料。关于中文OCR,目前国内水平较高的有清华文通、汉王、尚书,其产品各有千秋,价格不菲。国外OCR发展较早,像一些大公司,如IBM、微软、HP等,即使没有推出单独的OCR产品,但是他们的研发团队早已掌握核心技术,将OCR功能植入了自身的软件系统。对于我们程序员来说,一般用不到那么高级的,主要在开发中能够集成基本的OCR功能就可以了。这两天我查找了很多免费OCR软件、类库,特地整理一下,今天首先来谈谈Tesseract,下一次将讨论下Onenote 2010中的OCR API实现。
【文件预览】:
dotnet
----app.ico(1KB)
----tessnet2.cpp(18KB)
----resource.h(91B)
----app.rc(3KB)
----tessnet2.snk(596B)
----TesseractOCR()
--------Program.cs(478B)
--------TesseractOCR.csproj(9KB)
--------app.config(952B)
--------Properties()
--------Main.Designer.cs(8KB)
--------Main.resx(6KB)
--------Main.cs(4KB)
----tessnet2.h(5KB)
----TesseractTest()
--------Program.cs(2KB)
--------Properties()
--------TesseractTest.csproj(8KB)
----tessnet2.vcproj(252KB)
----tessnet2.sln(3KB)
----Stdafx.cpp(204B)
----TesseractConsole()
--------Program.cs(2KB)
--------Properties()
--------TesseractConsole.csproj(6KB)
----AssemblyInfo.cpp(1KB)
----Stdafx.h(74B)
----app.aps(34KB)