工具目录 / OCRmyPDF
OCRmyPDF
给扫描 PDF 增加可搜索的文字层
为何收录
尽量保留页面视觉,在原 PDF 上附加 OCR 文字以便检索。
输入材料
扫描 PDF
输出结果
带文字层的 PDF
适用范围与限制
需要安装及语言包;罕见字必须校读。
站内基础能力
这些能力覆盖部分基础任务,不表示完整重制原软件。
- PDF 文字层提取
从本地 PDF 提取逐页文字,送入检索、校勘与标注。 1 MB、50 页以内;只读已有文字层,不给扫描 PDF 写入 OCR 文字层,不还原复杂排版。
- 扫描图像整理
旋转书页、调节灰度与二值阈值,下载处理后的图片。 1 MB、600 万像素以内;只执行指定处理,不自动判断歪斜和版面。

