应用介绍
想把扫描件、PDF、图片里的文字提取出来,又不想在命令行里折腾 tesseract?gImageReader 给它套上易用的图形界面——导入图片或 PDF,框选区域识别,支持多语言、拼写检查,还能直接输出可搜索的 hOCR/PDF。对着识别结果可微调段落和词块。免费开源,批量 OCR 的顺手工具。
图形 OCR:为 tesseract-ocr 提供易用图形界面。
多来源:支持图片、PDF 与扫描仪来源。
区域识别:可框选区域并按段落词块微调。
可搜索输出:输出 hOCR、可搜索 PDF 或纯文本。
软件功能
图形 OCR:为 tesseract-ocr 提供易用图形界面。
多来源:支持图片、PDF 与扫描仪来源。
区域识别:可框选区域并按段落词块微调。
可搜索输出:输出 hOCR、可搜索 PDF 或纯文本。

