В накладной ломается не шапка, а табличная часть. Реквизиты сторон, номер, дата и суммы извлекаются надёжно и проверяются справочниками — с этой половиной документа справляется даже недорогое решение. А вот таблица позиций устроена так, что проверить её почти нечем: наименование товара нельзя сверить с ЕГРЮЛ, у количества нет контрольного разряда, а у строки, которая при печати переехала на два ряда, нет никакого признака, что она одна.
Разберём четыре сбоя табличной части, которые дают почти все ошибки в приходных документах, покажем работающий способ сопоставить номенклатуру поставщика с вашей без ручного словаря на тысячу строк, назовём проверки, ловящие ошибку до проводки, и посчитаем модель на 3 000 строк в месяц. Расчёт даст неудобный, но полезный результат.
Вводные расчётов прозрачные и модельные: оптовая компания, 250 приходных документов в месяц, в среднем 12 позиций в каждом, оборот по приходу 9 000 000 ₽ в месяц — то есть средняя строка стоит 3 000 ₽. Ставка бухгалтера и приёмщика — 540 ₽/час с налогами и взносами. Учётная система — 1С:Управление торговлей, но логика та же для 1С:Бухгалтерии и 1С:ERP. Состояние рынка и цены — на сентябрь 2026 года.
Шапку проверить легко, таблицу — нечем
Разница между двумя частями документа не в объёме текста, а в наличии внешнего арбитра. У ИНН есть контрольный разряд, у расчётного счёта — контрольная сумма по БИК, у контрагента — справочник, у договора — номер, который либо есть у этого поставщика, либо нет. Стоит цифре распознаться неверно — проверка это сразу видит. Мы разбирали устройство этих проверок подробно в материале про распознавание счетов и актов, и для шапки накладной там всё то же самое.
| Шапка УПД | Табличная часть на 12 позиций | |
|---|---|---|
| Сколько значений извлекается | около 26 | от 100 до 180 в зависимости от числа граф |
| Чем проверяется | Контрольные разряды, справочники контрагентов и договоров, календарь | Только внутренней арифметикой документа и историей поставок |
| Что бывает при ошибке | Документ не создаётся, уходит в очередь с конкретной претензией | Документ создаётся, но с неверной позицией, количеством или ценой |
| Доля трудоёмкости проекта | около 20 % | около 80 %, и почти вся она приходится на сопоставление номенклатуры |
Отсюда практическое следствие для переговоров с подрядчиком. Демонстрация, где на экране красиво подсвечиваются ИНН, номер и дата, не говорит о вашем потоке ничего: это лёгкие 20 %. Просите показать разбор вашего самого длинного ТОРГ-12 на четырёх листах — и смотрите на нижнюю строку итога.
Четыре сбоя табличной части
Эти четыре случая дают подавляющую часть ошибок в таблице. Важно, что каждый из них имеет собственный внешний признак — по нему сбой ловится, даже если система не понимает, что именно пошло не так.
- 1Перенос строки
Длинное наименование не помещается в графу и печатается в две-три визуальные строки, а количество и цена стоят только напротив первой. Наивный разбор делает из одной позиции две: у первой есть числа, у второй — пустые графы и обрывок названия. В учёте появляется фантомная позиция с нулевым количеством, а число строк перестаёт сходиться с полем «Всего наименований». Признак: разобранных строк больше, чем указано в подвале документа.
- 2Объединённые ячейки и промежуточные итоги
Многие поставщики группируют позиции по складам или по ставке налога и вставляют подытоги, а в графе «единица» объединяют ячейки на несколько строк подряд. Разбор принимает подытог за товарную позицию, и количество задваивается: сначала строки группы, потом та же сумма ещё раз. Признак: сумма строк превышает итог документа ровно на величину одного из подытогов.
- 3Многостраничность
Таблица на трёх-пяти листах, шапка повторяется на каждом, а итог стоит только на последнем. Часть решений разбирает страницы независимо и теряет связь между ними: повторяющаяся шапка попадает в таблицу как строка, а порядковая нумерация начинается заново. Признак: в разобранной таблице встречаются повторяющиеся номера позиций либо строка, дословно совпадающая с заголовком граф.
- 4Повёрнутый и перекошенный скан
ТОРГ-12 печатают альбомно и кладут в сканер как есть, а на многостраничных документах лист смещается в лотке. Поворот на полтора-три градуса накапливается по ширине листа и уводит границы колонок: цифра из графы «цена» попадает в графу «сумма», а «масса нетто» — в «количество». Это единственный из четырёх сбоев, который надёжно лечится не программой, а организацией: направляющие в сканере и разворот листа перед подачей. Признак: количество × цена не даёт сумму строки сразу у большинства позиций.
Сетка из четырёх панелей одинакового размера, в каждой — фрагмент таблицы накладной без реальных названий. Панель 1 «Перенос строки»: одна позиция напечатана в две строки, у второй графы количества и цены пустые; подпись «разобранных строк больше, чем в поле Всего наименований». Панель 2 «Объединённые ячейки и подытоги»: строка «Итого по группе» выделена и помечена стрелкой «принята за товар»; подпись «сумма строк больше итога на величину подытога». Панель 3 «Многостраничность»: три листа внахлёст, на втором подсвечена повторённая шапка таблицы; подпись «повторяющиеся номера позиций». Панель 4 «Перекос скана»: та же таблица, наклонённая на три градуса, границы колонок показаны штриховыми линиями и явно смещены; подпись «количество × цена не даёт сумму строки». Чертёжная графика, подписи по-русски.
Номенклатура поставщика против вашей: три слоя
Извлечь из накладной строку «Кабель ВВГнг 3х2,5, 200 м, 118 ₽/м» несложно. Сложно понять, что это позиция вашего справочника с другим наименованием, другой единицей и другим артикулом. Это уже не распознавание, а сопоставление — и именно оно съедает большую часть трудоёмкости, при том что в презентациях о нём обычно нет ни слова.
Ручной словарь на тысячу строк здесь не работает: его невозможно ни заполнить, ни поддерживать, а поставщик меняет написание позиции чаще, чем вы успеваете его править. Работающий подход собирается из трёх слоёв, и главный из них — не алгоритм, а накопленная история подтверждений.
- 1Словарь истории. Если строка этого поставщика уже сопоставлялась и человек подтвердил решение, оно применяется без вопросов. Словарь ведётся отдельно по каждому поставщику: одно и то же слово у разных продавцов означает разные позиции, и общий словарь на всех — источник тихих ошибок.
- 2Нечёткое сравнение. Наименование нормализуется: убирается регистр и лишняя пунктуация, разворачиваются сокращения, отдельно выделяются артикул, размерность и единица. Дальше сравнение идёт по значимым частям, а не по строке целиком, поэтому «Кабель ВВГнг-LS 3х2.5» и «ВВГнг(А)-LS 3*2,5» сходятся, а «3х2,5» и «3х4» — нет. Единица измерения сверяется отдельно: перепутанные «шт» и «упак» дают ошибку не в названии, а в количестве, и она дороже.
- 3Очередь оператора. То, что не сошлось, показывается человеку в виде трёх вариантов-подсказок с процентом совпадения и историей закупок. Выбор оператора уходит в словарь истории навсегда — именно поэтому очередь в первый месяц длинная, а к третьему сокращается в разы.
Как это выглядит в числах — самое полезное, что стоит показать до начала проекта, потому что первый месяц эксплуатации обычно застаёт заказчика врасплох.
| Месяц эксплуатации | Закрыл словарь истории | Добавило нечёткое сравнение | Строк в очередь | Документов из 12 строк без правки |
|---|---|---|---|---|
| Первый | 0 % | 62 % | 38 % | 0,3 % |
| Второй | 70 % | 22 % | 8 % | 37 % |
| Третий и далее | 88 % | 10 % | 2 % | 78 % |
Документ проходит без правки, только если чисто сопоставились все его строки сразу. При 2 % строк в очередь документ из 12 позиций проходит в 0,98 в двенадцатой степени, то есть в 78 % случаев, а документ из 30 позиций — уже в 55 %. Это ровно те диапазоны, которые мы приводили в разборе реальной точности распознавания: 72–88 % для УПД и 55–75 % для длинного ТОРГ-12. Требовать одинаковую норму для документа на 8 позиций и на 30 бессмысленно — это разные задачи.
Столбчатая диаграмма с накоплением, три группы по месяцам эксплуатации. Каждый столбец разбит на три сегмента снизу вверх: «Словарь истории» (0 %, 70 %, 88 %), «Нечёткое сравнение» (62 %, 22 %, 10 %), «Очередь оператора» (38 %, 8 %, 2 %). Поверх столбцов линия с точками «Документов из 12 строк без правки»: 0,3 %, 37 %, 78 % — с собственной осью справа. Под первым столбцом подпись «словарь пуст». Ось Y слева — доля строк, 0–100 %. Подписи по-русски, чертёжная графика.
Проверки, которые ловят ошибку до проводки
Ни одна из проверок ниже не повышает точность распознавания. Все они делают другое — переводят ошибку из категории «незамеченная» в категорию «помеченная». Ошибка, ушедшая в очередь, стоит четыре минуты приёмщика; ошибка, ушедшая в проводку, всплывает на инвентаризации через полгода.
- Сумма строк равна итогу документа с точностью до копейки округления. Базовая проверка, ловящая и задвоение подытогом, и потерянную строку на последнем листе.
- Количество × цена равно сумме строки — по каждой позиции отдельно. Массовое несхождение по всей таблице означает съехавшие колонки, единичное — ошибку в разряде.
- Число разобранных строк равно полю «Всего наименований» из подвала документа. Самая дешёвая и самая недооценённая проверка: она одна закрывает и перенос строки, и потерю страницы.
- Итог минус налог равен сумме без налога, а ставка есть в справочнике ставок. Отдельная ветка нужна для документов без налога — их всё ещё много у поставщиков на упрощённой системе.
- Построчная сверка с заказом поставщику: позиция, количество, цена. Здесь ловится не ошибка распознавания, а недовоз и пересорт — и это, как показывает расчёт ниже, главные деньги во всей задаче.
- Правдоподобие количества по истории. Количество, отличающееся от медианы прошлых поставок этой позиции больше чем в пять раз, уходит в очередь. Проверка ловит лишний ноль — самую дорогую ошибку в таблице, потому что она проходит и арифметику строки, и арифметику итога, если ноль появился и там и там.
- Правдоподобие остатка после проводки. Если приход уводит остаток в отрицательные значения или поднимает его выше двухмесячной нормы продаж, документ смотрит человек. Это не бухгалтерская, а складская проверка, и она чаще всего забывается при постановке задачи.
Сверка «итог накладной против итога заказа» пропускает самый частый и самый дорогой случай: поставщик недовёз одну позицию и довёз другую на ту же сумму. Итоги сходятся, документ проходит автоматически, а на складе появляется пересорт, который найдётся через квартал. Такая же логика ошибок разбирается в материале про дубли и пересорт при обмене с 1С — механизм разный, результат в учёте одинаковый.
УПД и ТОРГ-12: почему УПД разбирать дешевле
Полей у УПД больше, а разбирать его дешевле — контринтуитивный, но устойчивый факт. Причина в форме: универсальный передаточный документ имеет рекомендованную ФНС форму, которую поставщики почти не переделывают, а унифицированная форма ТОРГ-12 с 2013 года не обязательна, и каждый рисует свою.
| УПД | ТОРГ-12 | |
|---|---|---|
| Что закрывает | Передачу и счёт-фактуру сразу (статус 1) либо только передачу (статус 2) | Только передачу товара, счёт-фактура идёт отдельным документом |
| Реквизитов шапки | около 26 | около 18 |
| Граф в таблице | 10–12, включая код вида товара, страну происхождения и номер декларации | до 15, включая массу брутто и нетто, число мест и вид упаковки |
| Устойчивость формы | Высокая: форма рекомендована ФНС, поставщики её почти не меняют | Низкая: форма необязательна с 2013 года, у каждого поставщика своя вёрстка |
| Живёт ли шаблон | Годами, один на всех поставщиков | Только по конкретному поставщику и до первой смены его бланка |
| Документов без правки, скан 300 dpi | 72–88 % | 55–75 % при 20 и более позициях |
Практический вывод простой: если поставщик даёт на выбор УПД или пару «ТОРГ-12 плюс счёт-фактура», просите УПД — это дешевле не только вам, но и вашему конвейеру. А по тем поставщикам, кто присылает длинный ТОРГ-12, имеет смысл потратить время на индивидуальный шаблон: у десятка крупнейших он окупается за пару месяцев, потому что снимает и перекос колонок, и путаницу с графами массы.
Две колонки-карточки рядом, слева «УПД», справа «ТОРГ-12». В каждой шесть строк сравнения с одинаковыми подписями слева: «Реквизитов шапки — 26 / 18», «Граф в таблице — 10–12 / до 15», «Устойчивость формы — высокая, рекомендована ФНС / низкая, необязательна с 2013 года», «Шаблон живёт — годами / до смены бланка поставщика», «Документов без правки, скан 300 dpi — 72–88 % / 55–75 %». Под колонкой УПД зелёная пометка «дешевле разбирать», под ТОРГ-12 — нейтральная «нужен шаблон по поставщику». Чертёжная графика, подписи по-русски, без логотипов.
ЭДО убирает часть потока, но не весь
Формализованный УПД, пришедший через Контур.Диадок, Saby ЭДО или 1С-ЭДО, — это структурированный файл по формату ФНС с подписью. Его не читают картинкой, а загружают: точность стопроцентная, стоимость шага нулевая, табличная часть уже разобрана на поля. Поэтому первое действие в любом таком проекте — не выбор вендора распознавания, а перепись потока. Как устроен обмен и что нужно для старта, мы описали в отдельном разборе ЭДО.
И сразу честная оговорка, которую редко делают продавцы ЭДО: обмен не убирает распознавание совсем. Даже у компании с развитым ЭДО 15–30 % приходной первички продолжает приходить картинкой, и вот из чего этот хвост складывается.
- Мелкие поставщики и индивидуальные предприниматели, которые не подключатся никогда: их по штукам много, по обороту мало, и давить на них бессмысленно.
- ТОРГ-12: формализованный формат по-настоящему прижился у УПД, а товарная накладная в обмене чаще ходит неформализованным вложением — то есть тем же PDF или сканом внутри контейнера, который всё равно надо читать.
- Подотчёт и мелкие закупки: товарные чеки и накладные из розничных магазинов, привезённые водителем в кармане.
- Возвраты, претензии и акты о расхождении: их часто оформляют бумагой на месте, с подписью кладовщика поставщика.
- Сбои роуминга между операторами ЭДО: документ не дошёл, поставщик досылает скан почтой, и он всё равно попадает в общий поток.
Правильная последовательность поэтому такая: сначала разложить месячный поток на три части — формализованный ЭДО, PDF со встроенным текстовым слоем и настоящие сканы, — потом подключить к обмену тех поставщиков, кого можно подключить, и только затем считать проект по остатку. Если подрядчик называет цену за страницу распознавания на весь ваш объём, вы платите за воздух.
Расчёт на 3 000 строк в месяц
Считаем полный процесс, а не только ввод: приём и сортировку, шапку, строки и разбор расхождений с заказом. Отдельно считаем то, о чём в сметах обычно молчат, — деньги, теряемые на расхождениях, которые никто не заметил.
Пояснение к трём последним строкам. В модели 20 % приходов содержат расхождение с заказом — недовоз, пересорт или другая цена; это 65 спорных строк в месяц. Приёмка вручную ловит около 70 % из них сразу, часть находится позже на сверке или инвентаризации, а примерно шесть строк в месяц не находятся никогда и списываются как недостача. Ровно эти шесть строк по 3 000 ₽ и составляют главную статью потерь.
Тридцать месяцев — это «не окупается», и мы говорим это прямо. Постоянная часть расходов — поддержка, инфраструктура и часы на словарь — почти не зависит от объёма и на 3 000 строках съедает всю экономию. Но вывод отсюда не «накладные автоматизировать бессмысленно», а другой: объём в этой задаче измеряется строками, а не документами, и на строках картина меняется быстро.
| Показатель | 3 000 строк/мес | 9 000 строк/мес | 24 000 строк/мес |
|---|---|---|---|
| Приходных документов в месяц | 250 | 750 | 2 000 |
| Часов ручной работы сейчас | 62 | 185 | 492 |
| Стоимость процесса сейчас, ₽/мес | 51 300 | 156 700 | 421 700 |
| Часов работы после внедрения | 15 | 32 | 73 |
| Расходы после внедрения, ₽/мес | 42 000 | 77 100 | 167 500 |
| Экономия, ₽/мес | 9 300 | 79 600 | 254 200 |
| Внедрение, разово | 280 000 ₽ | 340 000 ₽ | 480 000 ₽ |
| Окупаемость | 30 месяцев | 4,3 месяца | 1,9 месяца |
Порог, ниже которого начинать не стоит, лежит примерно на 5 500–6 000 строках в месяц: там проект выходит в операционный ноль, а уверенная окупаемость до полугода начинается с 8 000. Проверить свою цифру просто — возьмите месячную пачку приходных документов и сложите число позиций, а не число бумажек.
Комбинированная диаграмма с тремя группами по объёму: 3 000, 9 000 и 24 000 строк в месяц. В каждой группе два столбца: «Стоимость процесса сейчас» (51 300 / 156 700 / 421 700 ₽) и «Расходы после внедрения» (42 000 / 77 100 / 167 500 ₽). Поверх столбцов линия «Окупаемость, месяцев» с точками 30 / 4,3 / 1,9 и собственной осью справа. Под группой 3 000 красная подпись «не окупается», вертикальная штриховая линия между первой и второй группой с подписью «порог: 5 500–6 000 строк». Левая ось — рубли в месяц, правая — месяцы. Подписи по-русски, чертёжная графика.
Чего в расчёте намеренно нет. Не учтён период настройки: первые два месяца очередь длиннее расчётной, и это видно по таблице трёх слоёв. Не учтено время приёмщиков и бухгалтерии на обучение — 15–20 часов на проект. Не учтён объём связки с учётной системой и складом, а он обычно больше самого распознавания; перечень систем, с которыми мы соединяем такие конвейеры, собран на странице интеграций. Все три поправки двигают окупаемость вправо, и заложить их честнее, чем обнаружить.
Когда не надо
У этой задачи чёткая граница применимости, и называть её лучше до договора, а не после первого квартала эксплуатации.
- Меньше 5 500 строк в месяц. Постоянные расходы около 27 000 ₽ в месяц съедают экономию целиком. Оператор на неполный день дешевле, и это арифметика, а не поражение.
- Основной объём уже идёт формализованным УПД через ЭДО. Тогда правильное действие — доподключить оставшихся поставщиков, а не строить распознавание. Это стоит переписки и нескольких часов.
- Некому вести словарь сопоставлений. Без выделенных 8–12 часов в месяц очередь не сокращается, а растёт, и таблица трёх слоёв никогда не доходит до третьей строки.
- Заказы поставщикам не ведутся в системе. Тогда отпадает построчная сверка — то есть та самая часть, которая в расчёте даёт основные деньги. Сначала заказы, потом распознавание.
- Приход оформляется по спецификации, а не по накладной: цена и позиции согласуются отдельным документом, а в накладной стоят коды поставщика. Здесь нужен другой проект — сопоставление спецификаций, а не разбор таблиц.
- Товар принимается по факту, без сверки с документом: кладовщик пересчитывает коробки и подписывает. В этом случае распознавание ускорит попадание в учёт неверных данных.
В накладной автоматизируется не чтение, а сопоставление. Читать умеют все, а сопоставлять — только тот, у кого накопилась история подтверждений.
