OCR通用文字识别系统是一款面向企业用户及文档数字化需求者研发的全能型文字识别工具,软件以通用、精准、高效为设计核心,不仅支持从图片、扫描件及PDF文件中批量识别提取文字,还具备多语言识别、版面还原及结果导出等实用功能,并且内置了基于深度学习的高精度识别引擎,更具备本地离线运行与API接口对接及数据安全保障等特性,从而全面满足企业文档数字化、票据信息采集及多语种文字提取等各类场景的使用需求。
1、点击区域截图。

2、点击开始识别。

3、内容识别成功。

1、支持多种来源文件解析识别
能够处理扫描图片、相机拍摄文档、PDF分页内容,兼容市面上主流图片格式,适配单位各类纸质资料数字化的实际需求。
2、支持自定义分区局部识别处理
可以框选图片当中指定区域,只对选定范围执行文字识别,能够跳过图片当中不需要的水印、logo等无关画面内容。
3、多语种识别满足多样业务需要
除简体中文之外,还可以识别英文等常见语种文本,能够处理包含双语内容的资料,适配外贸以及多语言档案处理工作。
4、大批量任务队列管理能力完善
支持导入大量文件建立识别任务队列,后台自动依次处理任务,用户可以查看整体进度,方便统筹大批量档案处理项目。
5、文本过滤清洗减少后期修改量
可以开启文本过滤功能,自动剔除多余空行、无效符号,整理识别输出文本,减轻后续人工校对整理文本的工作负担。
1、适用场景
企事业单位档案数字化、票据纸质资料录入、扫描文档批量处理、多语种资料识别、档案归档整理等业务场景。
2、核心功能
图片与PDF识别、局部分区识别、多语种支持、任务队列管理、文本过滤、校对编辑、多格式导出、任务工程保存。
3、版本模式
Windows端面向机构的OCR系统,基础识别功能开放,大批量任务处理、PDF分页解析等高级能力需要正式版本授权。
4、系统环境
适配Windows主流操作系统,大批量任务建议配备内存充足的电脑,PDF处理需要预留足够本地磁盘存储空间。
5、输入条件
各类图片文件、扫描版PDF文档,识别语种选择,局部选区设置,文本过滤开关,构成识别任务的配置输入信息。