工具目录 / OCRmyPDF

OCRmyPDF

给扫描 PDF 增加可搜索的文字层

打开关联站内模块

为何收录

尽量保留页面视觉,在原 PDF 上附加 OCR 文字以便检索。

输入材料

扫描 PDF

输出结果

带文字层的 PDF

适用范围与限制

需要安装及语言包;罕见字必须校读。

站内基础能力

这些能力覆盖部分基础任务,不表示完整重制原软件。

  • PDF 文字层提取

    从本地 PDF 提取逐页文字,送入检索、校勘与标注。 1 MB、50 页以内;只读已有文字层,不给扫描 PDF 写入 OCR 文字层,不还原复杂排版。

  • 扫描图像整理

    旋转书页、调节灰度与二值阈值,下载处理后的图片。 1 MB、600 万像素以内;只执行指定处理,不自动判断歪斜和版面。

配合这些知识点学习

继续探索

检索典籍材料 · 关联知识与练习

关联非遗文化

查看完整关联

沿着文脉,继续探索

Art SciForu发现冷门工具
有方法,也有出处

搜索全部工具