На складе распознавание документов оценивают не по точности, а по тому, куда попадает результат. Распознанная строка, которая через две секунды подставилась в задание приёмки на терминале кладовщика, экономит минуты у ворот и ловит расхождение при водителе. Та же строка, которая попала в очередь на разбор и будет проверена завтра оператором, экономит только ввод — а машина всё равно простояла свои 38 минут и уехала.
Отсюда практическое следствие, из-за которого складские проекты и бухгалтерские считаются по-разному. В бухгалтерии допустимо распознать пачку за ночь. На приёмке задержка в час обесценивает половину эффекта, а задержка в сутки — почти весь. Поэтому в складском проекте первым обсуждается не вендор, а точка, куда придёт результат.
Ниже — перечень складских документов с честной оценкой распознаваемости каждого, разбор того, почему фото на телефоне работает хуже сканера и чем это компенсируется, сравнение двух маршрутов результата, российский стек на 2026 год, правила работы с ошибками и расчёт на потоке 400 документов в месяц.
Пять складских документов и что мешает в каждом
Складской поток отличается от бухгалтерского составом. УПД и накладные здесь тоже есть, но рядом с ними лежат бумаги, которых бухгалтерия почти не видит: паллетные листы, доверенности водителей, путевые листы. У каждой свои сложности, и они разные.
| Документ | Что нужно вытащить | Распознаётся | Что мешает |
|---|---|---|---|
| ТТН и транспортная накладная | Номер, дата, отправитель, перевозчик, номер машины, количество мест | Устойчиво, если бланк печатный | Рукописные правки в графах о приёме груза, подписи и печати поверх текста |
| УПД и товарная накладная | Шапка целиком и вся табличная часть построчно | Шапка устойчиво, таблица заметно хуже | Многострочные наименования, переносы страниц, номенклатура поставщика вместо вашей |
| Паллетный лист | Номер паллеты, артикулы, количества, срок годности | Устойчиво при печати, плохо при рукописи | Часто заполняется от руки на складе отправителя, мнётся и пачкается в пути |
| Доверенность на получение | ФИО, паспортные данные, срок действия, перечень | Шапка устойчиво, перечень хуже | Свой бланк у каждого контрагента, персональные данные требуют отдельного режима хранения |
| Путевой лист | Номер, дата, водитель, машина, отметки времени | Средне | Штампы медосмотра и выпуска на линию, рукописные отметки времени, сгибы бумаги |
| Акт о расхождении при приёмке | Позиции с расхождением и их количества | Слабо | Заполняется от руки в момент приёмки, дописывается на коленке, часто без бланка |
Закономерность в таблице простая: устойчиво читается то, что напечатано машиной у отправителя, и плохо читается то, что дописано рукой на рампе. Никакой вендор эту границу не сдвинет — она проходит по способу заполнения, а не по алгоритму. Вывод из неё практический: акт о расхождении не надо пытаться распознать, его надо не создавать на бумаге. Как это устроено на приёмке, разобрано отдельно в статье про сверку факта с УПД, а про табличную часть накладных и подмену номенклатуры — в материале о распознавании накладных и УПД.
Почему фото на телефоне хуже сканера
На приёмке снимают телефоном или камерой терминала — сканера у ворот обычно нет. Это не каприз: нести бумаги в офис и возвращаться означает потерять те самые минуты, ради которых всё затевалось. Но качество исходника падает сразу по четырём причинам, и все они физические.
- Перспективные искажения. Снимок с руки почти всегда под углом: линии таблицы сходятся, и разбор колонок ломается раньше, чем разбор символов.
- Блики. Файл в мультифоре или под плёнкой на планшете даёт засветку ровно в той зоне, где обычно стоят количества.
- Собственная тень. Кладовщик наклоняется над документом, и половина листа уходит в полутень с падением контраста.
- Обрезка и мятая бумага. Край листа за пределами кадра стоит целой колонки, а сгиб посередине разрывает строку на две.
Компенсируется это не выбором вендора, а дешёвой физикой. Полка или подставка у поста приёмки с равномерной подсветкой стоит порядка 8 000–15 000 ₽ и убирает тень и блики. Рамка в приложении с автоспуском по контуру листа снимает перспективу и обрезку. Автоматическое выравнивание и повышение контраста на стороне сервиса добирает остальное. По нашим замерам на приёмке, связка «подставка со светом плюс рамка в приложении» поднимает долю документов, прошедших без ручной правки, примерно с половины до четырёх пятых — заметно сильнее, чем переход с одного движка распознавания на другой. Более подробно разрыв между заявленной и фактической точностью разобран в статье про реальную точность распознавания.
Сравнение в три колонки. Колонка «С руки»: лист под углом, на нём затемнённая зона тени и белое пятно блика, подпись «перспектива, блики, тень», помета «около половины документов без правки». Колонка «Подставка со светом и рамка в приложении»: лист лежит ровно на подставке, сверху две лампы, в кадре прямоугольная рамка, подпись «8 000–15 000 ₽ на пост», помета «около четырёх пятых без правки». Колонка «Планшетный сканер в офисе»: лист в сканере, рядом перечёркнутые часы с подписью «документ уезжает с рампы». Чертёжный стиль, подписи по-русски.
Куда попадает результат: два маршрута
Это и есть главный выбор проекта. Один и тот же движок распознавания в двух маршрутах даёт эффект, отличающийся в разы, потому что маршруты закрывают разные потери.
- 1Маршрут А. Результат подставляется в приёмку на терминале
Кладовщик снимает документ у ворот, через несколько секунд строки появляются в задании приёмки на его терминале, он сканирует товар и видит расхождение сразу. Экономятся ввод шапки, половина сопоставления позиций и — главное — расхождение фиксируется при водителе, а не через сутки, когда доказать что-либо уже сложно. Требует связки распознавания с терминалом и справочника соответствий номенклатуры.
- 2Маршрут Б. Результат уходит в очередь на разбор
Документ снимается или сканируется, попадает в очередь, оператор разбирает её в течение дня или на следующее утро. Экономится ручной ввод, и только он. Машина стоит у ворот столько же, расхождения ловятся задним числом, недостача обсуждается с поставщиком по переписке. Дешевле во внедрении, но закрывает меньшую половину потерь.
Маршрут Б имеет право на жизнь как первый этап: он дешевле, запускается за 3–4 недели и не требует трогать терминалы. Ошибка в том, чтобы остановиться на нём и считать проект законченным, — тогда через полгода выясняется, что очередь на разбор просто переехала из одного кабинета в другой. Если задача и правда сводится к офисной обработке входящих накладных, её честнее так и назвать — состав такого контура описан на странице обработки накладных, и стоит он дешевле складского.
Схема с одной точкой ветвления. Слева блок «Снимок документа у ворот», от него стрелка в блок «Распознавание». Дальше две ветки. Верхняя: стрелка с подписью «секунды» в блок «Задание приёмки на терминале», далее «Сканирование товара» и выделенный блок «Расхождение зафиксировано при водителе»; под веткой помета «экономит 16 минут на поставку». Нижняя: стрелка с подписью «до суток» в блок «Очередь на разбор», далее «Оператор проверяет» и блок «Расхождение обнаружено задним числом»; под веткой помета «экономит 4 минуты на документ». Чертёжный стиль, подписи по-русски.
Российский стек на сентябрь 2026 года
Выбор здесь не такой богатый, как кажется по рекламным материалам, и определяется он в первую очередь тем, есть ли у вас 1С и нужен ли контур без выхода наружу.
| Продукт | Под какие задачи склада | Что учесть |
|---|---|---|
| Content AI (российский преемник ABBYY) | Универсальный поток: ТТН, УПД, паллетные листы; ContentCapture для потоковой обработки | Наиболее зрелый вариант для смешанного потока; требует настройки шаблонов под ваши бланки |
| Smart Engines | Документы с фиксированной структурой и удостоверения: доверенности, паспортные данные водителя | Умеет работать на устройстве без передачи изображения наружу — важно для персональных данных |
| 1С:Распознавание первичных документов | УПД и накладные, когда учёт и так в 1С | Самый короткий путь к результату внутри 1С; за пределами первички возможностей меньше |
| Directum | Складские документы как часть общего документооборота предприятия | Оправдан, если система документооборота уже стоит; ради одного склада ставить дорого |
В доверенности есть ФИО и паспортные данные водителя, в путевом листе — ФИО и отметка медосмотра. Как только такой документ ушёл в облачный сервис распознавания, у вас появляется трансграничная или как минимум внешняя обработка персональных данных со всеми требованиями 152-ФЗ: основание, срок хранения, поручение обработки подрядчику. Что именно относится к персональным данным и какие обязанности возникают, разобрано в статье «Что относится к персональным данным». Практический выход — распознавать такие документы контуром внутри периметра, а наружу отдавать только товарные.
Что делать с ошибками распознавания
Ошибки будут всегда, вопрос только в том, кто их увидит первым: ваш сотрудник до проводки или бухгалтер через месяц. Конструкция, которая работает, состоит из трёх частей и настраивается один раз.
- 1Порог уверенности по полям, а не по документу. Каждое поле возвращается с оценкой уверенности. Ниже порога — поле подсвечивается и требует подтверждения человеком; остальные подставляются молча. Порог для количеств и артикулов ставится жёстче, чем для адреса отправителя, — цена ошибки разная.
- 2Арифметические и логические проверки. Сумма строк равна итогу, количество мест в ТТН совпадает с числом паллет, срок годности не в прошлом, артикул есть в справочнике. Эти проверки ловят ошибки, которые распознавание считает уверенными, и стоят дёшево — это правила, а не модель.
- 3Очередь ручной проверки с явным владельцем. Всё, что не прошло порог или проверки, попадает в очередь. У очереди должен быть один ответственный и норматив разбора — на приёмке это минуты, а не часы. Очередь без владельца через месяц превращается в свалку, и проект тихо возвращается к ручному вводу.
Отдельно стоит договориться, кто исправляет. На приёмке правку делает кладовщик прямо в терминале, потому что он единственный, кто в этот момент видит и документ, и товар. Оператор в офисе исправит формально верно и содержательно неправильно: он не знает, что на паллете было 11 коробок, а не 12.
Расчёт на 400 документах в месяц
Считаем склад с 200 поставками в месяц. Документов на этом потоке 400: 200 ТТН или УПД, 120 паллетных листов, 50 доверенностей и 30 актов. Машина стоит у ворот в среднем 38 минут, из них 12 минут — разгрузка и пересчёт, а 26 минут — работа с бумагами: 9 минут ввод шапки, 14 минут сопоставление позиций со своей номенклатурой, 3 минуты печать и подписи.
Внедрение такого контура — настройка пяти типов документов, порогов и проверок, связка с терминалом приёмки и наполнение справочника соответствий — обходится примерно в 290 000 ₽ и 5 000 ₽ в месяц сопровождения. Чистыми остаётся 26 340 ₽ в месяц, окупаемость около 11 месяцев. Отдельно стоит отметить то, что в расчёт не вошло: машина уезжает на 16 минут раньше, и это экономия перевозчика, а не ваша. В переговорах о ставке она конвертируется в деньги, но модельно её считать нечестно.
Каскадная диаграмма из пяти столбцов, ось Y — рубли в месяц. Слева два растущих столбца: «Часы кладовщика у ворот, 53,3 часа» — 29 330 ₽ и «Отменённый отложенный разбор, 13,3 часа» — 9 330 ₽, над ними суммарная отметка 38 660 ₽. Далее два убывающих столбца: «Ручная проверка, 72 документа» — минус 2 520 ₽ и «Плата за распознавание, 400 документов» — минус 4 800 ₽. Справа итоговый выделенный столбец «Чистая экономия» — 31 340 ₽. Под графиком строка вводных: «200 поставок, 400 документов, час кладовщика 550 ₽, час оператора 700 ₽». Чертёжный стиль, подписи по-русски.
Когда распознавание на складе не окупится
Два случая, в которых проект лучше не начинать, и оба определяются одной проверкой на калькуляторе.
Меньше сотни документов в месяц. Пересчитаем ту же модель на потоке 100 документов и 50 поставок: экономия у ворот 7 330 ₽, отменённый разбор 2 330 ₽, минус проверка 630 ₽ и плата 1 200 ₽ — остаётся 7 830 ₽ в месяц, а после вычета сопровождения 2 830 ₽. Те же 290 000 ₽ внедрения окупаются больше восьми лет. Никакая скидка вендора этот разрыв не закроет: он в объёме, а не в цене.
Поставщики переходят на ЭДО. Электронный УПД приходит структурированными данными, распознавать в нём нечего. Если 70 % поставок уже идут по ЭДО, распознавание нужно только для хвоста, и объём этого хвоста надо считать отдельно — обычно он оказывается ниже порога окупаемости. Проверить это до начала проекта дешевле, чем после: как устроен переход и что для него нужно, разобрано в статье про ЭДО и что нужно для старта.
Есть и третий случай, реже, но он самый досадный. Распознавание бессмысленно, пока нет справочника соответствий номенклатуры поставщика и вашей: машина прочитает строку идеально, а положить её будет некуда, и кладовщик всё равно полезет искать позицию руками. Справочник — это не часть проекта распознавания, это его предусловие, и делать его надо до, а не в процессе.
