本地 OCR:让每一页扫描件都可搜索

Last updated: 2026-09-02

本地 OCR:让每一页扫描件都可搜索

OCR(光学字符识别)将扫描页面转换为可选、可复制、可搜索的文本。Paper Scan 完全在设备上运行 OCR,使用 Apple 和 Google 的端侧 ML Kit,因此任何扫描内容都不会被发送到外部服务器进行识别。识别后的页面会在本地库中建立索引,保存的瞬间即可搜索。

OCR 带来的能力

页面识别完成后:

为什么端侧处理很重要

准确率与基于服务器的 OCR 服务相当;区别在于计算运行的位置。

准确识别的最佳实践

OCR 准确率主要取决于输入质量。按重要性排序的三个因素:

  1. 光照。 来自窗户的均匀间接光比头顶聚光灯效果更好。跨越页面的阴影是误读字符的最常见原因。
  2. 聚焦。 如果自动对焦选错目标,在拍摄前点击文本中央。模糊的扫描几乎无法使用。
  3. 滤镜选择。 黑白为印刷表格提供最干净的文本。当墨水褪色或纸张发黄时,推荐使用「魔法色彩」。Auto 适合大多数日常场景。
  4. 页面平整。 向书脊弯曲的页面会在装订线附近丢失字符。尽量用另一只手把页面压平。
  5. 语言提示。 为单语言页面(例如中文)显式设置 OCR 语言。混排脚本可在单次中中处理识别,无需提示。

准确率限制

OCR 在印刷文本上表现良好(准确率 95%+),但在以下情况可靠性较低:

在所有情况下,原始图像都保留可用。如果 OCR 在关键页面上失败,扫描件本身仍可阅读。

免费版与 Pro

免费版包含每日 OCR 额度——通常足以应付日常发票、名片和偶尔的书籍章节。Pro 取消了每日上限,并增加了在单次操作中对整个文件夹运行 OCR 的能力。对于有积压未识别扫描的库,Pro 提供了最高效的批量处理方式。

支持的语言

端侧引擎支持拉丁文字(英语、法语、德语、西班牙语、葡萄牙语、意大利语等)、中文(简体和繁体)、日语、韩语以及大多数欧洲文字。混排页面在单次识别中处理。