工具目录 / OCR-D
OCR-D
让历史印刷 OCR 流程可复现
为何收录
以统一工作区串联版面与识别组件,保留每次处理的中间结果。
输入材料
扫描件与 METS 描述
输出结果
PAGE XML 与识别文本
适用范围与限制
偏研究与工程使用;不是一键通用识别服务。
站内基础能力
这些能力覆盖部分基础任务,不表示完整重制原软件。
- 扫描图像整理
旋转书页、调节灰度与二值阈值,下载处理后的图片。 1 MB、600 万像素以内;只执行指定处理,不自动判断歪斜和版面。
- 本地图像文字识别
在当前应用识别简体、繁体及英文印刷文字,再进入校读。 使用本地 Tesseract;图像 1 MB、600 万像素以内。手写、异体字和复杂竖排需要人工核对,不训练新模型。

