Подготовка снимка: что она даёт по каждому файлу

Перед распознаванием сервис приводит страницу в порядок: доворачивает лист до горизонта, снимает зерно и точки, выравнивает свет и контраст, отделяет текст от фона чёрно-белой маской и проверяет, хватает ли разрешения. Чтобы увидеть, сколько это даёт, каждый из пяти файлов прогнали дважды — без подготовки и с подготовкой — и сравнили с эталоном одними и теми же правилами, что и в первом замере.

Доля верно прочитанных значений

ФайлЗначений в эталонеБез подготовкиС подготовкойРост

Значение считается верным, если оно совпало с эталоном: наименование — не менее чем на 90 % символов, числа — до копейки. Строк товаров всего 47.

Целых строк товара прочитано без единой ошибки

ФайлСтрок в эталонеБез подготовкиС подготовкойРост

Кривой снимок: там подготовка решает всё

Пять файлов заказчика сняты ровно и при хорошем свете — доворот листа на них не срабатывает вовсе, поэтому и прибавка от подготовки небольшая. Чтобы увидеть её на кривом снимке, ту же первую накладную специально повернули на 6,5°, притемнили углом тень и добавили зерно — как если бы лист сфотографировали с рук. Это наша копия для проверки, а не документ заказчика; эталон у неё тот же.

СнимокЗначений в эталонеБез подготовкиС подготовкойРост

Что подготовка сделала с каждой страницей

Перекос ни на одной странице пяти файлов не превысил порога в 0,15° — доворот не потребовался. На перекошенной копии он срабатывает: лист развёрнут на 6,5° и возвращён к горизонту, а разрешение поднято со 100 до 186 точек на дюйм.

Как это считалось

Первый замер и разбор ошибок — точность по каждому файлу; как выглядит страница до и после подготовки — две картинки рядом.