В накладной ломается не шапка, а табличная часть. Реквизиты сторон, номер, дата и суммы извлекаются надёжно и проверяются справочниками — с этой половиной документа справляется даже недорогое решение. А вот таблица позиций устроена так, что проверить её почти нечем: наименование товара нельзя сверить с ЕГРЮЛ, у количества нет контрольного разряда, а у строки, которая при печати переехала на два ряда, нет никакого признака, что она одна.

Разберём четыре сбоя табличной части, которые дают почти все ошибки в приходных документах, покажем работающий способ сопоставить номенклатуру поставщика с вашей без ручного словаря на тысячу строк, назовём проверки, ловящие ошибку до проводки, и посчитаем модель на 3 000 строк в месяц. Расчёт даст неудобный, но полезный результат.

Вводные расчётов прозрачные и модельные: оптовая компания, 250 приходных документов в месяц, в среднем 12 позиций в каждом, оборот по приходу 9 000 000 ₽ в месяц — то есть средняя строка стоит 3 000 ₽. Ставка бухгалтера и приёмщика — 540 ₽/час с налогами и взносами. Учётная система — 1С:Управление торговлей, но логика та же для 1С:Бухгалтерии и 1С:ERP. Состояние рынка и цены — на сентябрь 2026 года.

Шапку проверить легко, таблицу — нечем

Разница между двумя частями документа не в объёме текста, а в наличии внешнего арбитра. У ИНН есть контрольный разряд, у расчётного счёта — контрольная сумма по БИК, у контрагента — справочник, у договора — номер, который либо есть у этого поставщика, либо нет. Стоит цифре распознаться неверно — проверка это сразу видит. Мы разбирали устройство этих проверок подробно в материале про распознавание счетов и актов, и для шапки накладной там всё то же самое.

Шапка УПДТабличная часть на 12 позиций
Сколько значений извлекаетсяоколо 26от 100 до 180 в зависимости от числа граф
Чем проверяетсяКонтрольные разряды, справочники контрагентов и договоров, календарьТолько внутренней арифметикой документа и историей поставок
Что бывает при ошибкеДокумент не создаётся, уходит в очередь с конкретной претензиейДокумент создаётся, но с неверной позицией, количеством или ценой
Доля трудоёмкости проектаоколо 20 %около 80 %, и почти вся она приходится на сопоставление номенклатуры

Отсюда практическое следствие для переговоров с подрядчиком. Демонстрация, где на экране красиво подсвечиваются ИНН, номер и дата, не говорит о вашем потоке ничего: это лёгкие 20 %. Просите показать разбор вашего самого длинного ТОРГ-12 на четырёх листах — и смотрите на нижнюю строку итога.

Четыре сбоя табличной части

Эти четыре случая дают подавляющую часть ошибок в таблице. Важно, что каждый из них имеет собственный внешний признак — по нему сбой ловится, даже если система не понимает, что именно пошло не так.

  1. 1
    Перенос строки

    Длинное наименование не помещается в графу и печатается в две-три визуальные строки, а количество и цена стоят только напротив первой. Наивный разбор делает из одной позиции две: у первой есть числа, у второй — пустые графы и обрывок названия. В учёте появляется фантомная позиция с нулевым количеством, а число строк перестаёт сходиться с полем «Всего наименований». Признак: разобранных строк больше, чем указано в подвале документа.

  2. 2
    Объединённые ячейки и промежуточные итоги

    Многие поставщики группируют позиции по складам или по ставке налога и вставляют подытоги, а в графе «единица» объединяют ячейки на несколько строк подряд. Разбор принимает подытог за товарную позицию, и количество задваивается: сначала строки группы, потом та же сумма ещё раз. Признак: сумма строк превышает итог документа ровно на величину одного из подытогов.

  3. 3
    Многостраничность

    Таблица на трёх-пяти листах, шапка повторяется на каждом, а итог стоит только на последнем. Часть решений разбирает страницы независимо и теряет связь между ними: повторяющаяся шапка попадает в таблицу как строка, а порядковая нумерация начинается заново. Признак: в разобранной таблице встречаются повторяющиеся номера позиций либо строка, дословно совпадающая с заголовком граф.

  4. 4
    Повёрнутый и перекошенный скан

    ТОРГ-12 печатают альбомно и кладут в сканер как есть, а на многостраничных документах лист смещается в лотке. Поворот на полтора-три градуса накапливается по ширине листа и уводит границы колонок: цифра из графы «цена» попадает в графу «сумма», а «масса нетто» — в «количество». Это единственный из четырёх сбоев, который надёжно лечится не программой, а организацией: направляющие в сканере и разворот листа перед подачей. Признак: количество × цена не даёт сумму строки сразу у большинства позиций.

сравнениеraspoznavanie-nakladnyh-i-upd--01
Четыре сбоя табличной части накладной: перенос строки, подытог, многостраничность, перекос

Сетка из четырёх панелей одинакового размера, в каждой — фрагмент таблицы накладной без реальных названий. Панель 1 «Перенос строки»: одна позиция напечатана в две строки, у второй графы количества и цены пустые; подпись «разобранных строк больше, чем в поле Всего наименований». Панель 2 «Объединённые ячейки и подытоги»: строка «Итого по группе» выделена и помечена стрелкой «принята за товар»; подпись «сумма строк больше итога на величину подытога». Панель 3 «Многостраничность»: три листа внахлёст, на втором подсвечена повторённая шапка таблицы; подпись «повторяющиеся номера позиций». Панель 4 «Перекос скана»: та же таблица, наклонённая на три градуса, границы колонок показаны штриховыми линиями и явно смещены; подпись «количество × цена не даёт сумму строки». Чертёжная графика, подписи по-русски.

У каждого сбоя есть внешний признак — по нему ошибка ловится до проводки, даже если причина неизвестна

Номенклатура поставщика против вашей: три слоя

Извлечь из накладной строку «Кабель ВВГнг 3х2,5, 200 м, 118 ₽/м» несложно. Сложно понять, что это позиция вашего справочника с другим наименованием, другой единицей и другим артикулом. Это уже не распознавание, а сопоставление — и именно оно съедает большую часть трудоёмкости, при том что в презентациях о нём обычно нет ни слова.

Ручной словарь на тысячу строк здесь не работает: его невозможно ни заполнить, ни поддерживать, а поставщик меняет написание позиции чаще, чем вы успеваете его править. Работающий подход собирается из трёх слоёв, и главный из них — не алгоритм, а накопленная история подтверждений.

  1. 1Словарь истории. Если строка этого поставщика уже сопоставлялась и человек подтвердил решение, оно применяется без вопросов. Словарь ведётся отдельно по каждому поставщику: одно и то же слово у разных продавцов означает разные позиции, и общий словарь на всех — источник тихих ошибок.
  2. 2Нечёткое сравнение. Наименование нормализуется: убирается регистр и лишняя пунктуация, разворачиваются сокращения, отдельно выделяются артикул, размерность и единица. Дальше сравнение идёт по значимым частям, а не по строке целиком, поэтому «Кабель ВВГнг-LS 3х2.5» и «ВВГнг(А)-LS 3*2,5» сходятся, а «3х2,5» и «3х4» — нет. Единица измерения сверяется отдельно: перепутанные «шт» и «упак» дают ошибку не в названии, а в количестве, и она дороже.
  3. 3Очередь оператора. То, что не сошлось, показывается человеку в виде трёх вариантов-подсказок с процентом совпадения и историей закупок. Выбор оператора уходит в словарь истории навсегда — именно поэтому очередь в первый месяц длинная, а к третьему сокращается в разы.

Как это выглядит в числах — самое полезное, что стоит показать до начала проекта, потому что первый месяц эксплуатации обычно застаёт заказчика врасплох.

Месяц эксплуатацииЗакрыл словарь историиДобавило нечёткое сравнениеСтрок в очередьДокументов из 12 строк без правки
Первый0 %62 %38 %0,3 %
Второй70 %22 %8 %37 %
Третий и далее88 %10 %2 %78 %
Правая колонка — это степень, а не среднее

Документ проходит без правки, только если чисто сопоставились все его строки сразу. При 2 % строк в очередь документ из 12 позиций проходит в 0,98 в двенадцатой степени, то есть в 78 % случаев, а документ из 30 позиций — уже в 55 %. Это ровно те диапазоны, которые мы приводили в разборе реальной точности распознавания: 72–88 % для УПД и 55–75 % для длинного ТОРГ-12. Требовать одинаковую норму для документа на 8 позиций и на 30 бессмысленно — это разные задачи.

графикraspoznavanie-nakladnyh-i-upd--02
Три месяца сопоставления номенклатуры: очередь падает с 38 % строк до 2 %

Столбчатая диаграмма с накоплением, три группы по месяцам эксплуатации. Каждый столбец разбит на три сегмента снизу вверх: «Словарь истории» (0 %, 70 %, 88 %), «Нечёткое сравнение» (62 %, 22 %, 10 %), «Очередь оператора» (38 %, 8 %, 2 %). Поверх столбцов линия с точками «Документов из 12 строк без правки»: 0,3 %, 37 %, 78 % — с собственной осью справа. Под первым столбцом подпись «словарь пуст». Ось Y слева — доля строк, 0–100 %. Подписи по-русски, чертёжная графика.

Первый месяц выглядит как провал проекта. Это не провал, а наполнение словаря подтверждениями

Проверки, которые ловят ошибку до проводки

Ни одна из проверок ниже не повышает точность распознавания. Все они делают другое — переводят ошибку из категории «незамеченная» в категорию «помеченная». Ошибка, ушедшая в очередь, стоит четыре минуты приёмщика; ошибка, ушедшая в проводку, всплывает на инвентаризации через полгода.

  • Сумма строк равна итогу документа с точностью до копейки округления. Базовая проверка, ловящая и задвоение подытогом, и потерянную строку на последнем листе.
  • Количество × цена равно сумме строки — по каждой позиции отдельно. Массовое несхождение по всей таблице означает съехавшие колонки, единичное — ошибку в разряде.
  • Число разобранных строк равно полю «Всего наименований» из подвала документа. Самая дешёвая и самая недооценённая проверка: она одна закрывает и перенос строки, и потерю страницы.
  • Итог минус налог равен сумме без налога, а ставка есть в справочнике ставок. Отдельная ветка нужна для документов без налога — их всё ещё много у поставщиков на упрощённой системе.
  • Построчная сверка с заказом поставщику: позиция, количество, цена. Здесь ловится не ошибка распознавания, а недовоз и пересорт — и это, как показывает расчёт ниже, главные деньги во всей задаче.
  • Правдоподобие количества по истории. Количество, отличающееся от медианы прошлых поставок этой позиции больше чем в пять раз, уходит в очередь. Проверка ловит лишний ноль — самую дорогую ошибку в таблице, потому что она проходит и арифметику строки, и арифметику итога, если ноль появился и там и там.
  • Правдоподобие остатка после проводки. Если приход уводит остаток в отрицательные значения или поднимает его выше двухмесячной нормы продаж, документ смотрит человек. Это не бухгалтерская, а складская проверка, и она чаще всего забывается при постановке задачи.
Сверка с заказом должна быть построчной, а не по сумме

Сверка «итог накладной против итога заказа» пропускает самый частый и самый дорогой случай: поставщик недовёз одну позицию и довёз другую на ту же сумму. Итоги сходятся, документ проходит автоматически, а на складе появляется пересорт, который найдётся через квартал. Такая же логика ошибок разбирается в материале про дубли и пересорт при обмене с 1С — механизм разный, результат в учёте одинаковый.

УПД и ТОРГ-12: почему УПД разбирать дешевле

Полей у УПД больше, а разбирать его дешевле — контринтуитивный, но устойчивый факт. Причина в форме: универсальный передаточный документ имеет рекомендованную ФНС форму, которую поставщики почти не переделывают, а унифицированная форма ТОРГ-12 с 2013 года не обязательна, и каждый рисует свою.

УПДТОРГ-12
Что закрываетПередачу и счёт-фактуру сразу (статус 1) либо только передачу (статус 2)Только передачу товара, счёт-фактура идёт отдельным документом
Реквизитов шапкиоколо 26около 18
Граф в таблице10–12, включая код вида товара, страну происхождения и номер декларациидо 15, включая массу брутто и нетто, число мест и вид упаковки
Устойчивость формыВысокая: форма рекомендована ФНС, поставщики её почти не меняютНизкая: форма необязательна с 2013 года, у каждого поставщика своя вёрстка
Живёт ли шаблонГодами, один на всех поставщиковТолько по конкретному поставщику и до первой смены его бланка
Документов без правки, скан 300 dpi72–88 %55–75 % при 20 и более позициях

Практический вывод простой: если поставщик даёт на выбор УПД или пару «ТОРГ-12 плюс счёт-фактура», просите УПД — это дешевле не только вам, но и вашему конвейеру. А по тем поставщикам, кто присылает длинный ТОРГ-12, имеет смысл потратить время на индивидуальный шаблон: у десятка крупнейших он окупается за пару месяцев, потому что снимает и перекос колонок, и путаницу с графами массы.

сравнениеraspoznavanie-nakladnyh-i-upd--03
Сравнение УПД и ТОРГ-12: 26 и 18 реквизитов, 72-88 % и 55-75 % документов без правки

Две колонки-карточки рядом, слева «УПД», справа «ТОРГ-12». В каждой шесть строк сравнения с одинаковыми подписями слева: «Реквизитов шапки — 26 / 18», «Граф в таблице — 10–12 / до 15», «Устойчивость формы — высокая, рекомендована ФНС / низкая, необязательна с 2013 года», «Шаблон живёт — годами / до смены бланка поставщика», «Документов без правки, скан 300 dpi — 72–88 % / 55–75 %». Под колонкой УПД зелёная пометка «дешевле разбирать», под ТОРГ-12 — нейтральная «нужен шаблон по поставщику». Чертёжная графика, подписи по-русски, без логотипов.

Полей у УПД больше, а разбирается он лучше: форма устойчивая, шаблон живёт годами

ЭДО убирает часть потока, но не весь

Формализованный УПД, пришедший через Контур.Диадок, Saby ЭДО или 1С-ЭДО, — это структурированный файл по формату ФНС с подписью. Его не читают картинкой, а загружают: точность стопроцентная, стоимость шага нулевая, табличная часть уже разобрана на поля. Поэтому первое действие в любом таком проекте — не выбор вендора распознавания, а перепись потока. Как устроен обмен и что нужно для старта, мы описали в отдельном разборе ЭДО.

И сразу честная оговорка, которую редко делают продавцы ЭДО: обмен не убирает распознавание совсем. Даже у компании с развитым ЭДО 15–30 % приходной первички продолжает приходить картинкой, и вот из чего этот хвост складывается.

  • Мелкие поставщики и индивидуальные предприниматели, которые не подключатся никогда: их по штукам много, по обороту мало, и давить на них бессмысленно.
  • ТОРГ-12: формализованный формат по-настоящему прижился у УПД, а товарная накладная в обмене чаще ходит неформализованным вложением — то есть тем же PDF или сканом внутри контейнера, который всё равно надо читать.
  • Подотчёт и мелкие закупки: товарные чеки и накладные из розничных магазинов, привезённые водителем в кармане.
  • Возвраты, претензии и акты о расхождении: их часто оформляют бумагой на месте, с подписью кладовщика поставщика.
  • Сбои роуминга между операторами ЭДО: документ не дошёл, поставщик досылает скан почтой, и он всё равно попадает в общий поток.

Правильная последовательность поэтому такая: сначала разложить месячный поток на три части — формализованный ЭДО, PDF со встроенным текстовым слоем и настоящие сканы, — потом подключить к обмену тех поставщиков, кого можно подключить, и только затем считать проект по остатку. Если подрядчик называет цену за страницу распознавания на весь ваш объём, вы платите за воздух.

Расчёт на 3 000 строк в месяц

Считаем полный процесс, а не только ввод: приём и сортировку, шапку, строки и разбор расхождений с заказом. Отдельно считаем то, о чём в сметах обычно молчат, — деньги, теряемые на расхождениях, которые никто не заметил.

Что сейчас стоит ручная обработка 250 приходных документов и 3 000 строк
Приём, сортировка, привязка к поставщику: 250 × 1,5 мин = 6,25 ч3 375 ₽
Ввод шапки, поиск контрагента и договора: 250 × 3 мин = 12,5 ч6 750 ₽
Ввод табличной части: 3 000 строк × 30 с = 25 ч13 500 ₽
Разбор расхождений, найденных при приёмке: 46 строк × 12 мин = 9,2 ч4 968 ₽
Разбор расхождений, всплывших позже: 13 строк × 40 мин = 8,7 ч4 698 ₽
Расхождения, которые не нашлись вовсе: 6 строк × 3 000 ₽18 000 ₽
Итого51 291 ₽ в месяц и 61,7 человеко-часа. Больше трети суммы — не труд, а потери на непойманных расхождениях

Пояснение к трём последним строкам. В модели 20 % приходов содержат расхождение с заказом — недовоз, пересорт или другая цена; это 65 спорных строк в месяц. Приёмка вручную ловит около 70 % из них сразу, часть находится позже на сверке или инвентаризации, а примерно шесть строк в месяц не находятся никогда и списываются как недостача. Ровно эти шесть строк по 3 000 ₽ и составляют главную статью потерь.

Что остаётся после внедрения на том же потоке
Машинная обработка: 250 документов × 8,55 ₽2 138 ₽
Очередь проверки: 22 % документов, 55 шт × 2,5 мин = 2,3 ч1 242 ₽
Ведение словаря сопоставлений и справочника номенклатуры: 8 ч4 320 ₽
Разбор расхождений: теперь видны все 65 строк до проводки, 65 × 4 мин = 4,3 ч2 322 ₽
Остаточные потери: 3 строки без заказа в системе × 3 000 ₽9 000 ₽
Инфраструктура, хранение и архив исходников3 000 ₽
Поддержка подрядчика20 000 ₽
Итого42 022 ₽ в месяц и 14,6 человеко-часа вместо 61,7. Экономия 9 269 ₽ в месяц, внедрение 280 000 ₽ возвращается за 30 месяцев

Тридцать месяцев — это «не окупается», и мы говорим это прямо. Постоянная часть расходов — поддержка, инфраструктура и часы на словарь — почти не зависит от объёма и на 3 000 строках съедает всю экономию. Но вывод отсюда не «накладные автоматизировать бессмысленно», а другой: объём в этой задаче измеряется строками, а не документами, и на строках картина меняется быстро.

Показатель3 000 строк/мес9 000 строк/мес24 000 строк/мес
Приходных документов в месяц2507502 000
Часов ручной работы сейчас62185492
Стоимость процесса сейчас, ₽/мес51 300156 700421 700
Часов работы после внедрения153273
Расходы после внедрения, ₽/мес42 00077 100167 500
Экономия, ₽/мес9 30079 600254 200
Внедрение, разово280 000 ₽340 000 ₽480 000 ₽
Окупаемость30 месяцев4,3 месяца1,9 месяца

Порог, ниже которого начинать не стоит, лежит примерно на 5 500–6 000 строках в месяц: там проект выходит в операционный ноль, а уверенная окупаемость до полугода начинается с 8 000. Проверить свою цифру просто — возьмите месячную пачку приходных документов и сложите число позиций, а не число бумажек.

графикraspoznavanie-nakladnyh-i-upd--04
Окупаемость по объёму строк: 30 месяцев на 3 000, 4,3 на 9 000 и 1,9 на 24 000

Комбинированная диаграмма с тремя группами по объёму: 3 000, 9 000 и 24 000 строк в месяц. В каждой группе два столбца: «Стоимость процесса сейчас» (51 300 / 156 700 / 421 700 ₽) и «Расходы после внедрения» (42 000 / 77 100 / 167 500 ₽). Поверх столбцов линия «Окупаемость, месяцев» с точками 30 / 4,3 / 1,9 и собственной осью справа. Под группой 3 000 красная подпись «не окупается», вертикальная штриховая линия между первой и второй группой с подписью «порог: 5 500–6 000 строк». Левая ось — рубли в месяц, правая — месяцы. Подписи по-русски, чертёжная графика.

Постоянные расходы не зависят от потока — поэтому решает не число накладных, а число строк в них

Чего в расчёте намеренно нет. Не учтён период настройки: первые два месяца очередь длиннее расчётной, и это видно по таблице трёх слоёв. Не учтено время приёмщиков и бухгалтерии на обучение — 15–20 часов на проект. Не учтён объём связки с учётной системой и складом, а он обычно больше самого распознавания; перечень систем, с которыми мы соединяем такие конвейеры, собран на странице интеграций. Все три поправки двигают окупаемость вправо, и заложить их честнее, чем обнаружить.

Когда не надо

У этой задачи чёткая граница применимости, и называть её лучше до договора, а не после первого квартала эксплуатации.

  • Меньше 5 500 строк в месяц. Постоянные расходы около 27 000 ₽ в месяц съедают экономию целиком. Оператор на неполный день дешевле, и это арифметика, а не поражение.
  • Основной объём уже идёт формализованным УПД через ЭДО. Тогда правильное действие — доподключить оставшихся поставщиков, а не строить распознавание. Это стоит переписки и нескольких часов.
  • Некому вести словарь сопоставлений. Без выделенных 8–12 часов в месяц очередь не сокращается, а растёт, и таблица трёх слоёв никогда не доходит до третьей строки.
  • Заказы поставщикам не ведутся в системе. Тогда отпадает построчная сверка — то есть та самая часть, которая в расчёте даёт основные деньги. Сначала заказы, потом распознавание.
  • Приход оформляется по спецификации, а не по накладной: цена и позиции согласуются отдельным документом, а в накладной стоят коды поставщика. Здесь нужен другой проект — сопоставление спецификаций, а не разбор таблиц.
  • Товар принимается по факту, без сверки с документом: кладовщик пересчитывает коробки и подписывает. В этом случае распознавание ускорит попадание в учёт неверных данных.

В накладной автоматизируется не чтение, а сопоставление. Читать умеют все, а сопоставлять — только тот, у кого накопилась история подтверждений.