工具目录 / Kraken
Kraken
识别历史印刷品与手写文本
为何收录
支持非拉丁书写与自定义模型,适合通用 OCR 难以处理的材料。
输入材料
书页图像与识别模型
输出结果
带坐标的识别文本
适用范围与限制
命令行工具;效果取决于文字体系和训练材料。
站内基础能力
这些能力覆盖部分基础任务,不表示完整重制原软件。
- 本地图像文字识别
在当前应用识别简体、繁体及英文印刷文字,再进入校读。 使用本地 Tesseract;图像 1 MB、600 万像素以内。手写、异体字和复杂竖排需要人工核对,不训练新模型。

