OCR на устройстве: доступный для поиска текст с каждой сканированной страницы

Last updated: 2026-09-02

OCR (оптическое распознавание символов) преобразует сканированную страницу в текст, который можно выделить, скопировать и найти. Paper Scan выполняет OCR полностью на устройстве с помощью ML-комплектов Apple и Google, поэтому никакое содержимое сканов не передается на внешние серверы для распознавания. Распознанные страницы индексируются в локальной библиотеке и становятся доступными для поиска сразу после сохранения.

Что открывает OCR

Когда страница распознана:

Почему обработка на устройстве важна

Точность сопоставима с серверными сервисами OCR; разница в том, где выполняются вычисления.

Лучшие практики для точного распознавания

Точность OCR зависит в первую очередь от качества ввода. Три фактора по порядку важности:

  1. Освещение. Равномерный, непрямой свет от окна работает лучше, чем один потолочный прожектор. Тени, пересекающие страницу, являются наиболее частой причиной неправильного чтения символов.
  2. Фокус. Если автофокус выбирает не тот объект, нажмите на центр текста перед съемкой. Размытое сканирование редко бывает пригодным для использования.
  3. Выбор фильтра. Черно-белый дает самый чистый текст для печатных форм. Волшебный цвет рекомендуется, когда чернила выцвели или бумага пожелтела. Авто обрабатывает большинство повседневных случаев.
  4. Плоские страницы. Страницы, которые выгибаются к корешку, теряют символы у желоба. По возможности прижмите страницу плоско другой рукой.
  5. Подсказка языка. Установите язык OCR явно для одноязычных страниц. Страницы со смешанными шрифтами обрабатываются за один проход без подсказки.

Ограничения точности

OCR хорошо работает с печатным текстом (точность 95%+), но менее надежен для рукописного курсива, очень маленьких шрифтов, стилизованных декоративных шрифтов, отражений глянцевых журналов и старых чеков, где чернила физически выцвели. Исходное изображение остается доступным во всех случаях: если OCR не срабатывает на критической странице, сам скан все равно можно прочитать.

Бесплатный уровень включает дневную квоту OCR, которой достаточно для повседневных чеков, визитных карточек и случайных глав книг. Pro снимает дневной лимит и добавляет возможность запуска OCR для целой папки за одну операцию.

Движок на устройстве поддерживает латинские шрифты (английский, французский, немецкий, испанский, португальский, итальянский и другие), китайский (упрощенный и традиционный), японский, корейский и большинство европейских шрифтов. Страницы со смешанными шрифтами обрабатываются за один проход распознавания.