OCR (оптическое распознавание символов) преобразует сканированную страницу в текст, который можно выделить, скопировать и найти. Paper Scan выполняет OCR полностью на устройстве с помощью ML-комплектов Apple и Google, поэтому никакое содержимое сканов не передается на внешние серверы для распознавания. Распознанные страницы индексируются в локальной библиотеке и становятся доступными для поиска сразу после сохранения.
Что открывает OCR
Когда страница распознана:
- Копировать текст из скана. Нажмите и удерживайте любое слово, чтобы открыть оверлей выделения, покрывающий всю страницу. Выделенный текст можно вставить в любое другое приложение.
- Искать внутри сканов. Строка поиска в верхней части списка Документов запрашивает распознанный текст каждой страницы, а не только заголовки и теги. Номера телефонов, имена, номера счетов и адреса можно найти по всей библиотеке.
- Цитировать и ссылаться. Сканированные чеки, контракты, рукописные заметки и снимки доски становятся цитируемым текстом, на который можно ссылаться позже.
Почему обработка на устройстве важна
- Конфиденциальность. Содержимое сканов никогда не покидает устройство для распознавания. Это актуально для счетов, контрактов, медицинских форм и любых документов, содержащих личные данные.
- Задержка. Нет сетевого раундтрипа. На современных iPhone и флагманских Android-устройствах OCR для стандартной страницы обычно завершается менее чем за секунду.
- Доступность офлайн. OCR работает в самолетах, подвалах и в регионах без покрытия сети. Подключение не требуется.
Точность сопоставима с серверными сервисами OCR; разница в том, где выполняются вычисления.
Лучшие практики для точного распознавания
Точность OCR зависит в первую очередь от качества ввода. Три фактора по порядку важности:
- Освещение. Равномерный, непрямой свет от окна работает лучше, чем один потолочный прожектор. Тени, пересекающие страницу, являются наиболее частой причиной неправильного чтения символов.
- Фокус. Если автофокус выбирает не тот объект, нажмите на центр текста перед съемкой. Размытое сканирование редко бывает пригодным для использования.
- Выбор фильтра. Черно-белый дает самый чистый текст для печатных форм. Волшебный цвет рекомендуется, когда чернила выцвели или бумага пожелтела. Авто обрабатывает большинство повседневных случаев.
- Плоские страницы. Страницы, которые выгибаются к корешку, теряют символы у желоба. По возможности прижмите страницу плоско другой рукой.
- Подсказка языка. Установите язык OCR явно для одноязычных страниц. Страницы со смешанными шрифтами обрабатываются за один проход без подсказки.
Ограничения точности
OCR хорошо работает с печатным текстом (точность 95%+), но менее надежен для рукописного курсива, очень маленьких шрифтов, стилизованных декоративных шрифтов, отражений глянцевых журналов и старых чеков, где чернила физически выцвели. Исходное изображение остается доступным во всех случаях: если OCR не срабатывает на критической странице, сам скан все равно можно прочитать.
Бесплатный уровень включает дневную квоту OCR, которой достаточно для повседневных чеков, визитных карточек и случайных глав книг. Pro снимает дневной лимит и добавляет возможность запуска OCR для целой папки за одну операцию.
Движок на устройстве поддерживает латинские шрифты (английский, французский, немецкий, испанский, португальский, итальянский и другие), китайский (упрощенный и традиционный), японский, корейский и большинство европейских шрифтов. Страницы со смешанными шрифтами обрабатываются за один проход распознавания.