Перед распознаванием сервис приводит страницу в порядок: доворачивает лист до горизонта, снимает зерно и точки, выравнивает свет и контраст, отделяет текст от фона чёрно-белой маской и проверяет, хватает ли разрешения. Чтобы увидеть, сколько это даёт, каждый из пяти файлов прогнали дважды — без подготовки и с подготовкой — и сравнили с эталоном одними и теми же правилами, что и в первом замере.
| Файл | Значений в эталоне | Без подготовки | С подготовкой | Рост |
|---|
Значение считается верным, если оно совпало с эталоном: наименование — не менее чем на 90 % символов, числа — до копейки. Строк товаров всего 47.
| Файл | Строк в эталоне | Без подготовки | С подготовкой | Рост |
|---|
Пять файлов заказчика сняты ровно и при хорошем свете — доворот листа на них не срабатывает вовсе, поэтому и прибавка от подготовки небольшая. Чтобы увидеть её на кривом снимке, ту же первую накладную специально повернули на 6,5°, притемнили углом тень и добавили зерно — как если бы лист сфотографировали с рук. Это наша копия для проверки, а не документ заказчика; эталон у неё тот же.
| Снимок | Значений в эталоне | Без подготовки | С подготовкой | Рост |
|---|
Перекос ни на одной странице пяти файлов не превысил порога в 0,15° — доворот не потребовался. На перекошенной копии он срабатывает: лист развёрнут на 6,5° и возвращён к горизонту, а разрешение поднято со 100 до 186 точек на дюйм.
Первый замер и разбор ошибок — точность по каждому файлу; как выглядит страница до и после подготовки — две картинки рядом.