
ocr-table:从PDF文件中提取OCR生成的表格
5星
- 浏览量: 0
- 大小:None
- 文件类型:ZIP
简介:
该项目的目标是通过OCR技术从扫描图像中提取表格信息。项目依赖以下软件包进行安装:Tesseract OCR、ImageMagick、Poppler-utils以及Python环境中的requirements.txt文件。具体操作步骤如下:首先,将所有需要扫描的PDF文件移动到工作目录;其次,在命令行界面运行预设脚本shellocr.py以执行OCR转换过程;最后,生成后的文本将被保存在指定位置。此外,项目还提供了备用方案供用户参考使用。
全部评论 (0)
还没有任何评论哟~


