Для потока в 5 000 страниц в месяц модельная смета выглядит так: 725 000 ₽ разово на внедрение и 85 320 ₽ в месяц на эксплуатацию, включая человека, который разбирает спорные документы. Рыночная вилка внедрения — 350 000–1 200 000 ₽, и место внутри неё определяет не объём пачки, а число типов документов и то, насколько они однообразны.
Почти все коммерческие предложения на распознавание считаются по страницам, потому что так проще выставить прайс. Но работа системы измеряется в другом: она извлекает поля, а человек проверяет документы. Между этими тремя единицами — страницами, документами и полями — стоит арифметика, которая переворачивает смету, и именно её обычно не показывают на пресейле.
Ниже — разбор сметы построчно на конкретной пачке, честный расчёт очереди ручной проверки при трёх уровнях точности, живой российский стек с его границами и порог объёма, ниже которого проект не окупается ни при какой скидке. Все цифры модельные и пересчитываются на калькуляторе; ставки те же, что и в остальных материалах раздела: 3 000 ₽ за час подрядчика и 700 ₽ за полный час сотрудника заказчика.
Страницы, документы, поля: три разные единицы счёта
Подрядчик продаёт страницы, потому что их считает сканер. Учётная система принимает документы. Ошибку делает поле. Смета, в которой есть только страницы, не даёт посчитать главное — сколько работы останется людям.
Страница — единица тарификации у большинства вендоров. Документ — единица работы человека: если хотя бы в одном поле система не уверена, на проверку уходит документ целиком, а не отдельная ячейка. Поле — единица точности: заявленные «96 %» вендора почти всегда относятся именно к полям, а не к документам.
Возьмём типичную пачку оптовой компании: 5 000 страниц в месяц. После разбора выясняется, что это 3 420 документов — в среднем 1,5 страницы на документ, — и около 14 извлекаемых полей в каждом. Итого 47 880 полей в месяц, и именно это число определяет и цену настройки, и размер очереди на проверку.
Горизонтальная воронка из трёх ступеней слева направо: «5 000 страниц в месяц» → «3 420 документов, в среднем 1,5 страницы» → «47 880 полей, в среднем 14 на документ». Под первой ступенью подпись «единица прайса подрядчика», под второй — «единица работы человека», под третьей — «единица точности системы». Чертёжный стиль, приглушённая палитра, все подписи по-русски.
Цена зависит от типа документа, а не от толщины пачки
Настройка платится за каждый тип документа отдельно: своя структура, свои поля, свои правила проверки. Поэтому пачка из одного типа на 5 000 страниц стоит дешевле, чем пачка из шести типов на 2 000. Ниже — та же модельная пачка в разрезе типов и с ожидаемой долей документов, которые всё равно придётся править руками на устоявшемся режиме.
| Тип документа | Страниц/мес | Документов/мес | Страниц на документ | Ручная доработка |
|---|---|---|---|---|
| УПД и счета-фактуры | 1 900 | 1 400 | 1,4 | 6 % |
| Накладные ТОРГ-12 | 1 000 | 620 | 1,6 | 9 % |
| Акты выполненных работ | 700 | 600 | 1,2 | 8 % |
| Счета на оплату | 600 | 560 | 1,1 | 5 % |
| Банковские выписки и платёжки | 400 | 180 | 2,2 | 4 % |
| Договоры с приложениями | 400 | 60 | 6,7 | 45 % |
| Итого | 5 000 | 3 420 | 1,5 | — |
Обратите внимание на последнюю строку. Договоры — это 8 % страниц и меньше 2 % документов, но по страницам, которые всё равно проходят через руки, на них приходится 180 из 486 по всей пачке, то есть больше трети. Причина не в объёме: у договоров нет устойчивой структуры, поля разбросаны по тексту, а приложения меняют условия основного документа. Задача «вытащить сумму и срок из договора» решается не шаблоном, а моделью с проверкой человеком — мы разбирали её отдельно как извлечение данных из договоров, и в смете распознавания первички ей не место.
Самый частый способ занизить смету — посчитать настройку по двум «показательным» типам документов и умолчать про остальные четыре. Признак: в коммерческом предложении есть цена за страницу, но нет перечня типов документов с числом полей в каждом. Требуйте разбивку по типам до подписания — после подписания недостающие типы становятся дополнительным соглашением по полной цене.
Российский стек и его границы
По состоянию на сентябрь 2026 года рабочий выбор в России такой. Content AI — преемник ABBYY, ушедшей из страны в 2022 году: ContentReader PDF вместо FineReader и ContentCapture вместо FlexiCapture, самый универсальный вариант для разнородной пачки. Smart Engines — узкоспециализированные движки под УПД, УКД, счета-фактуры, акты, КС-2 и КС-3, ТОРГ-12 и ТОРГ-13, банковские выписки, платёжки и ГТД; сильны на потоковом однообразном вводе. 1С:Распознавание первичных документов — самый короткий путь, если весь поток идёт в 1С и типы стандартные. Directum — когда распознавание нужно внутри документооборота с маршрутами согласования, а не само по себе.
Границы у всех примерно одинаковые, и их полезно знать до того, как вы сравниваете цены. Ни один движок не читает рукописный текст в бухгалтерском качестве. Ни один не гарантирует точность на фотографиях, снятых с рук под углом. И ни один не подставит правильную номенклатуру, если в вашем справочнике «Болт М8» лежит в четырёх вариантах написания — сопоставление позиций живёт не в распознавании, а в справочниках, и это отдельная строка сметы.
Практический вывод: выбор вендора двигает итоговую цену на 15–20 %, а качество исходников и порядок в справочниках — в разы. Прежде чем сравнивать прайсы, посмотрите, как документы вообще попадают к вам: скан на потоковом сканере, PDF из электронного документооборота и фотография из мессенджера дают разную точность на одном и том же движке.
Горизонтальная столбчатая диаграмма: шесть типов документов, у каждого две величины — доля в пачке по страницам и доля ручной доработки. Значения: «Банковские выписки и платёжки — 400 страниц, 4 %», «Счета на оплату — 600 страниц, 5 %», «УПД и счета-фактуры — 1 900 страниц, 6 %», «Акты выполненных работ — 700 страниц, 8 %», «Накладные ТОРГ-12 — 1 000 страниц, 9 %», «Договоры с приложениями — 400 страниц, 45 %». Последний столбец выделен контрастно и подписан «8 % страниц, 180 из 486 страниц ручной доработки». Чертёжный стиль, подписи по-русски.
Смета внедрения: 725 000 ₽ построчно
Модельная компания: оптовая торговля, 90 сотрудников, 1С:Управление торговлей, поток 5 000 страниц и 3 420 документов в месяц, шесть типов документов, документы приходят почтой, из электронного документооборота и на потоковом сканере. Считаем внедрение с нуля, без уже готового справочника контрагентов.
Нижняя граница вилки получается, когда типов документов два-три, они приходят из электронного документооборота в машинном виде, а справочник контрагентов уже в порядке. Верхняя — когда типов больше восьми, часть документов приходит фотографиями, а номенклатуру нужно сопоставлять с прайсами поставщиков. Как читать такую смету и какие строки в ней обязаны быть названы отдельно, разобрано в материале как читать смету на автоматизацию.
Эксплуатация считается отдельно и состоит из трёх постоянных строк плюс переменной — очереди проверки, к которой перейдём дальше.
Строка, которой нет в коммерческих предложениях: человек на проверке
Здесь и находится главная арифметическая ловушка распознавания. Вендор называет точность по полям, а очередь проверки формируется по документам: документ уходит человеку, если система не уверена хотя бы в одном поле. При 14 полях в документе доля полностью чистых документов — это точность в четырнадцатой степени, и падает она быстро.
| Точность по полям | Доля документов без единой ошибки | На проверку, док/мес | Часов оператора | Стоимость, ₽/мес |
|---|---|---|---|---|
| 92 % | 31 % | 2 360 | 59 | 41 300 ₽ |
| 96 % | 56 % | 1 505 | 37,6 | 26 320 ₽ |
| 99 % | 87 % | 445 | 11,1 | 7 770 ₽ |
Расчёт повторяется на калькуляторе: 0,96 в четырнадцатой степени — это 0,56, значит 44 % от 3 420 документов, то есть 1 505 штук, попадают на проверку. Полторы минуты на документ — открыть, найти подсвеченное поле, сверить с исходником, подтвердить — дают 2 258 минут, или 37,6 часа. При полной стоимости часа сотрудника 700 ₽ это 26 320 ₽ в месяц. Откуда берётся сама точность и почему заявленная вендором цифра не переносится на вашу пачку, подробно разобрано в статье реальная точность распознавания.
Четыре процентных пункта точности по полям превращаются в 855 документов разницы в очереди, 21,4 часа оператора и 14 980 ₽ в месяц — почти 180 000 ₽ за год. Поэтому торговаться имеет смысл не за цену страницы, а за качество исходников и за настройку правил проверки: они двигают именно эту строку.
Столбчатая диаграмма с тремя парами столбцов. Ось X — точность по полям: 92 %, 96 %, 99 %. Первый столбец пары — доля чистых документов (31 %, 56 %, 87 %), второй — число документов на проверку из 3 420 (2 360, 1 505, 445). Под каждой парой подпись стоимости очереди: 41 300 ₽, 26 320 ₽, 7 770 ₽ в месяц. Сверху пометка «14 полей в документе». Чертёжный стиль, подписи по-русски.
Что получается на общем счёте и когда это окупается
Собираем всё вместе на реалистичной точности 96 %. Сейчас те же 3 420 документов вводятся руками: в среднем пять минут на документ с поиском контрагента, сверкой с заказом и проводкой. Это 285 часов в месяц — примерно полтора человека полного дня.
Из этой же арифметики выводится порог объёма. Экономия на одном документе — 50,63 ₽: 58,33 ₽ ручного ввода минус 7,70 ₽ проверки. Постоянные расходы 59 000 ₽ в месяц перекрываются только начиная примерно с 1 165 документов, а чтобы внедрение вернулось за двенадцать месяцев, нужно около 2 400 документов в месяц. Ниже этого объёма проект не запрещён, но окупаться будет два года и дольше — а за два года у вас поменяются и формы поставщиков, и справочники.
Подставьте свою смету внедрения и месячные расходы системы. Экономию берите как разницу между текущими часами ручного ввода и часами очереди проверки — обе величины считаются по методике выше.
Сколько стоит ручная работа в вашем процессе
Расчёт учитывает только время сотрудников. Возвращённые продажи, снятые ошибки и штрафы, скорость реакции — сверх этой модели. На диагностике считаем по вашим фактическим цифрам.
Пилот на 50 000 документов: зачем платить 500 000 ₽ до проекта
Пилот на 50 000 документов стоит от 500 000 ₽ и занимает 4–6 недель. Для нашей модельной компании это архив примерно за 15 месяцев — то есть проверка идёт не на подобранной витрине, а на всём, что реально приходило, включая плохие сканы, нестандартные формы и поставщиков, которые печатают УПД в собственном шаблоне.
- 1Фактическая точность по каждому типу на вашей пачке, а не на демонстрационном наборе вендора. Расхождение между демонстрацией и реальным потоком доходит до двух раз, и узнать об этом лучше до подписания договора на промышленную обработку.
- 2Реальный размер очереди проверки в документах и часах — та самая строка, из которой потом складывается 26 320 ₽ или 41 300 ₽ в месяц.
- 3Список типов, которые не берутся: если договоры дают 45 % ручной доработки, разумнее исключить их из контура и оставить людям, а не платить за настройку, которая всё равно не снимет работу.
- 4Качество исходников по каналам поступления: сканер, электронный документооборот, почта, фотографии. Часто дешевле поменять способ подачи документов, чем движок распознавания.
- 5Состояние справочников: сколько позиций номенклатуры и контрагентов не сопоставляется автоматически. Это прямая оценка той части сметы, что в модельном расчёте стоит 150 000 ₽.
Пилот имеет смысл при потоке от 3 000 документов в месяц: на меньших объёмах он сопоставим по цене с самим внедрением. Для потока в 500–1 500 документов дешевле короткий замер на выборке из 300 документов — он входит в первую строку нашей сметы и стоит 60 000 ₽.
Лента времени на 4–6 недель из четырёх отрезков слева направо. «Неделя 1: выгрузка архива за 15 месяцев — 50 000 документов». «Недели 2–3: прогон по шести типам, замер фактической точности». «Неделя 4: сверка с учётной системой, оценка очереди проверки в часах». «Недели 5–6: отчёт — точность по типам, размер очереди, список типов, которые не берутся». Под лентой ценник «от 500 000 ₽». Чертёжный стиль, подписи по-русски.
Когда распознавание не окупится
Есть три ситуации, в которых мы советуем не начинать проект, и все три видны до подписания договора.
- Меньше 300 документов в месяц. Ручной ввод на таком объёме стоит 25 часов и 17 500 ₽ в месяц, а постоянные расходы системы начинаются от 59 000 ₽. Расходы превышают весь фонд ручного труда до всякого учёта внедрения. Здесь дешевле оставить оператора и вложиться в порядок в справочниках — с него всё равно начинается любой следующий шаг, и это разобрано в материале дашборд начинается со справочников.
- Каждый документ уникален по форме. Проектная документация, договоры с индивидуальными приложениями, акты в шаблоне заказчика — там, где структура не повторяется, шаблоны не работают, а ручная доработка держится на уровне 40–50 %. Экономия съедается очередью проверки, и это тот случай, когда автоматизация не отменяет работу, а перекладывает её на другого человека.
- Ошибка стоит дороже экономии. Если неверно распознанная сумма уходит в платёж без второго контроля, цена одного пропущенного знака превышает годовую экономию. В таких контурах распознавание ставят только вместе со сверкой и запретом на автоматическую проводку — как устроена такая двойная проверка, разобрано в решении автоматическая сверка документов.
И общее правило, которое стоит держать в голове при чтении любого предложения на распознавание: вы покупаете не точность, а сокращение очереди. Ни один вендор не снимает работу целиком, и честная смета всегда содержит строку с оставшимися часами человека. Если такой строки нет, её не забыли — её спрятали, и она проявится на третьем месяце эксплуатации в виде дополнительной ставки оператора, которой не было в расчёте окупаемости.
Распознавание не убирает человека из процесса. Оно превращает ввод в проверку — и проверка тоже стоит денег.
