Для потока в 5 000 страниц в месяц модельная смета выглядит так: 725 000 ₽ разово на внедрение и 85 320 ₽ в месяц на эксплуатацию, включая человека, который разбирает спорные документы. Рыночная вилка внедрения — 350 000–1 200 000 ₽, и место внутри неё определяет не объём пачки, а число типов документов и то, насколько они однообразны.

Почти все коммерческие предложения на распознавание считаются по страницам, потому что так проще выставить прайс. Но работа системы измеряется в другом: она извлекает поля, а человек проверяет документы. Между этими тремя единицами — страницами, документами и полями — стоит арифметика, которая переворачивает смету, и именно её обычно не показывают на пресейле.

Ниже — разбор сметы построчно на конкретной пачке, честный расчёт очереди ручной проверки при трёх уровнях точности, живой российский стек с его границами и порог объёма, ниже которого проект не окупается ни при какой скидке. Все цифры модельные и пересчитываются на калькуляторе; ставки те же, что и в остальных материалах раздела: 3 000 ₽ за час подрядчика и 700 ₽ за полный час сотрудника заказчика.

Страницы, документы, поля: три разные единицы счёта

Подрядчик продаёт страницы, потому что их считает сканер. Учётная система принимает документы. Ошибку делает поле. Смета, в которой есть только страницы, не даёт посчитать главное — сколько работы останется людям.

Что это значитПоле, документ, страница

Страница — единица тарификации у большинства вендоров. Документ — единица работы человека: если хотя бы в одном поле система не уверена, на проверку уходит документ целиком, а не отдельная ячейка. Поле — единица точности: заявленные «96 %» вендора почти всегда относятся именно к полям, а не к документам.

Возьмём типичную пачку оптовой компании: 5 000 страниц в месяц. После разбора выясняется, что это 3 420 документов — в среднем 1,5 страницы на документ, — и около 14 извлекаемых полей в каждом. Итого 47 880 полей в месяц, и именно это число определяет и цену настройки, и размер очереди на проверку.

графикskolko-stoit-raspoznavanie-dokumentov--01
Воронка: 5000 страниц превращаются в 3420 документов и 47880 извлекаемых полей

Горизонтальная воронка из трёх ступеней слева направо: «5 000 страниц в месяц» → «3 420 документов, в среднем 1,5 страницы» → «47 880 полей, в среднем 14 на документ». Под первой ступенью подпись «единица прайса подрядчика», под второй — «единица работы человека», под третьей — «единица точности системы». Чертёжный стиль, приглушённая палитра, все подписи по-русски.

Одна и та же пачка в трёх единицах счёта — и продают вам только первую

Цена зависит от типа документа, а не от толщины пачки

Настройка платится за каждый тип документа отдельно: своя структура, свои поля, свои правила проверки. Поэтому пачка из одного типа на 5 000 страниц стоит дешевле, чем пачка из шести типов на 2 000. Ниже — та же модельная пачка в разрезе типов и с ожидаемой долей документов, которые всё равно придётся править руками на устоявшемся режиме.

Тип документаСтраниц/месДокументов/месСтраниц на документРучная доработка
УПД и счета-фактуры1 9001 4001,46 %
Накладные ТОРГ-121 0006201,69 %
Акты выполненных работ7006001,28 %
Счета на оплату6005601,15 %
Банковские выписки и платёжки4001802,24 %
Договоры с приложениями400606,745 %
Итого5 0003 4201,5

Обратите внимание на последнюю строку. Договоры — это 8 % страниц и меньше 2 % документов, но по страницам, которые всё равно проходят через руки, на них приходится 180 из 486 по всей пачке, то есть больше трети. Причина не в объёме: у договоров нет устойчивой структуры, поля разбросаны по тексту, а приложения меняют условия основного документа. Задача «вытащить сумму и срок из договора» решается не шаблоном, а моделью с проверкой человеком — мы разбирали её отдельно как извлечение данных из договоров, и в смете распознавания первички ей не место.

Проверьте, что вам считают по вашей пачке

Самый частый способ занизить смету — посчитать настройку по двум «показательным» типам документов и умолчать про остальные четыре. Признак: в коммерческом предложении есть цена за страницу, но нет перечня типов документов с числом полей в каждом. Требуйте разбивку по типам до подписания — после подписания недостающие типы становятся дополнительным соглашением по полной цене.

Российский стек и его границы

По состоянию на сентябрь 2026 года рабочий выбор в России такой. Content AI — преемник ABBYY, ушедшей из страны в 2022 году: ContentReader PDF вместо FineReader и ContentCapture вместо FlexiCapture, самый универсальный вариант для разнородной пачки. Smart Engines — узкоспециализированные движки под УПД, УКД, счета-фактуры, акты, КС-2 и КС-3, ТОРГ-12 и ТОРГ-13, банковские выписки, платёжки и ГТД; сильны на потоковом однообразном вводе. 1С:Распознавание первичных документов — самый короткий путь, если весь поток идёт в 1С и типы стандартные. Directum — когда распознавание нужно внутри документооборота с маршрутами согласования, а не само по себе.

Границы у всех примерно одинаковые, и их полезно знать до того, как вы сравниваете цены. Ни один движок не читает рукописный текст в бухгалтерском качестве. Ни один не гарантирует точность на фотографиях, снятых с рук под углом. И ни один не подставит правильную номенклатуру, если в вашем справочнике «Болт М8» лежит в четырёх вариантах написания — сопоставление позиций живёт не в распознавании, а в справочниках, и это отдельная строка сметы.

Практический вывод: выбор вендора двигает итоговую цену на 15–20 %, а качество исходников и порядок в справочниках — в разы. Прежде чем сравнивать прайсы, посмотрите, как документы вообще попадают к вам: скан на потоковом сканере, PDF из электронного документооборота и фотография из мессенджера дают разную точность на одном и том же движке.

сравнениеskolko-stoit-raspoznavanie-dokumentov--02
Шесть типов документов и доля ручной доработки по каждому: от 4 % до 45 %

Горизонтальная столбчатая диаграмма: шесть типов документов, у каждого две величины — доля в пачке по страницам и доля ручной доработки. Значения: «Банковские выписки и платёжки — 400 страниц, 4 %», «Счета на оплату — 600 страниц, 5 %», «УПД и счета-фактуры — 1 900 страниц, 6 %», «Акты выполненных работ — 700 страниц, 8 %», «Накладные ТОРГ-12 — 1 000 страниц, 9 %», «Договоры с приложениями — 400 страниц, 45 %». Последний столбец выделен контрастно и подписан «8 % страниц, 180 из 486 страниц ручной доработки». Чертёжный стиль, подписи по-русски.

Восемь процентов страниц дают больше трети всей ручной доработки

Смета внедрения: 725 000 ₽ построчно

Модельная компания: оптовая торговля, 90 сотрудников, 1С:Управление торговлей, поток 5 000 страниц и 3 420 документов в месяц, шесть типов документов, документы приходят почтой, из электронного документооборота и на потоковом сканере. Считаем внедрение с нуля, без уже готового справочника контрагентов.

Разовые расходы на внедрение распознавания, 5 000 страниц в месяц
Разбор пачки: перепись типов, выборка 300 документов, замер базовой точности — 20 часов60 000 ₽
Настройка извлечения по пяти стабильным типам, по 42 000 ₽ на тип210 000 ₽
Справочники и сопоставление: контрагенты по ИНН, номенклатура, привязка к договорам150 000 ₽
Интеграция с 1С:УТ: создание документов, статусы, повторная загрузка исправленных160 000 ₽
Экран проверки: очередь спорных полей, права доступа, журнал правок90 000 ₽
Приёмка на контрольной выборке 500 документов, обучение двух операторов55 000 ₽
Итого725 000 ₽ разово при рыночной вилке 350 000–1 200 000 ₽

Нижняя граница вилки получается, когда типов документов два-три, они приходят из электронного документооборота в машинном виде, а справочник контрагентов уже в порядке. Верхняя — когда типов больше восьми, часть документов приходит фотографиями, а номенклатуру нужно сопоставлять с прайсами поставщиков. Как читать такую смету и какие строки в ней обязаны быть названы отдельно, разобрано в материале как читать смету на автоматизацию.

Эксплуатация считается отдельно и состоит из трёх постоянных строк плюс переменной — очереди проверки, к которой перейдём дальше.

Постоянные расходы эксплуатации, в месяц
Лицензия или подписка на распознавание, 5 000 страниц (вилка 12 000–45 000 ₽)22 000 ₽
Сервер и хранилище документов в российском контуре9 000 ₽
Поддержка связки и шаблонов: правки правил, разбор сбоев, новые формы поставщиков28 000 ₽
Итого59 000 ₽ в месяц до учёта человека на проверке

Строка, которой нет в коммерческих предложениях: человек на проверке

Здесь и находится главная арифметическая ловушка распознавания. Вендор называет точность по полям, а очередь проверки формируется по документам: документ уходит человеку, если система не уверена хотя бы в одном поле. При 14 полях в документе доля полностью чистых документов — это точность в четырнадцатой степени, и падает она быстро.

Точность по полямДоля документов без единой ошибкиНа проверку, док/месЧасов оператораСтоимость, ₽/мес
92 %31 %2 3605941 300 ₽
96 %56 %1 50537,626 320 ₽
99 %87 %44511,17 770 ₽

Расчёт повторяется на калькуляторе: 0,96 в четырнадцатой степени — это 0,56, значит 44 % от 3 420 документов, то есть 1 505 штук, попадают на проверку. Полторы минуты на документ — открыть, найти подсвеченное поле, сверить с исходником, подтвердить — дают 2 258 минут, или 37,6 часа. При полной стоимости часа сотрудника 700 ₽ это 26 320 ₽ в месяц. Откуда берётся сама точность и почему заявленная вендором цифра не переносится на вашу пачку, подробно разобрано в статье реальная точность распознавания.

Разница между 92 % и 96 % — это почти 180 000 ₽ в год на зарплате

Четыре процентных пункта точности по полям превращаются в 855 документов разницы в очереди, 21,4 часа оператора и 14 980 ₽ в месяц — почти 180 000 ₽ за год. Поэтому торговаться имеет смысл не за цену страницы, а за качество исходников и за настройку правил проверки: они двигают именно эту строку.

графикskolko-stoit-raspoznavanie-dokumentov--03
График: при точности 92, 96 и 99 процентов на проверку уходит 2360, 1505 и 445 документов

Столбчатая диаграмма с тремя парами столбцов. Ось X — точность по полям: 92 %, 96 %, 99 %. Первый столбец пары — доля чистых документов (31 %, 56 %, 87 %), второй — число документов на проверку из 3 420 (2 360, 1 505, 445). Под каждой парой подпись стоимости очереди: 41 300 ₽, 26 320 ₽, 7 770 ₽ в месяц. Сверху пометка «14 полей в документе». Чертёжный стиль, подписи по-русски.

Точность по полям и очередь по документам — это разные величины

Что получается на общем счёте и когда это окупается

Собираем всё вместе на реалистичной точности 96 %. Сейчас те же 3 420 документов вводятся руками: в среднем пять минут на документ с поиском контрагента, сверкой с заказом и проводкой. Это 285 часов в месяц — примерно полтора человека полного дня.

Было и стало на потоке 3 420 документов в месяц
Ручной ввод сейчас: 3 420 док × 5 мин = 285 часов × 700 ₽199 500 ₽/мес
Постоянные расходы системы после внедрения59 000 ₽/мес
Очередь проверки при точности 96 %: 37,6 часа × 700 ₽26 320 ₽/мес
Итого расходы после внедрения85 320 ₽/мес
Экономия в месяц114 180 ₽/мес
Внедрение725 000 ₽
ИтогоОкупаемость на седьмом месяце: 725 000 ₽ ÷ 114 180 ₽ = 6,35 месяца

Из этой же арифметики выводится порог объёма. Экономия на одном документе — 50,63 ₽: 58,33 ₽ ручного ввода минус 7,70 ₽ проверки. Постоянные расходы 59 000 ₽ в месяц перекрываются только начиная примерно с 1 165 документов, а чтобы внедрение вернулось за двенадцать месяцев, нужно около 2 400 документов в месяц. Ниже этого объёма проект не запрещён, но окупаться будет два года и дольше — а за два года у вас поменяются и формы поставщиков, и справочники.

Посчитайте окупаемость на своих числах

Подставьте свою смету внедрения и месячные расходы системы. Экономию берите как разницу между текущими часами ручного ввода и часами очереди проверки — обе величины считаются по методике выше.

Калькулятор рутины

Сколько стоит ручная работа в вашем процессе

4
2.5 ч
700
70%
725 000
85 320
Ручная работа сейчас обходится в
147 000 ₽/мес
Чистая экономия с системой
+17 580 ₽/мес
Окупаемость внедрения≈ 42 мес.
Эффект за первый год (за вычетом внедрения)-514 040 ₽

Расчёт учитывает только время сотрудников. Возвращённые продажи, снятые ошибки и штрафы, скорость реакции — сверх этой модели. На диагностике считаем по вашим фактическим цифрам.

Пилот на 50 000 документов: зачем платить 500 000 ₽ до проекта

Пилот на 50 000 документов стоит от 500 000 ₽ и занимает 4–6 недель. Для нашей модельной компании это архив примерно за 15 месяцев — то есть проверка идёт не на подобранной витрине, а на всём, что реально приходило, включая плохие сканы, нестандартные формы и поставщиков, которые печатают УПД в собственном шаблоне.

  1. 1Фактическая точность по каждому типу на вашей пачке, а не на демонстрационном наборе вендора. Расхождение между демонстрацией и реальным потоком доходит до двух раз, и узнать об этом лучше до подписания договора на промышленную обработку.
  2. 2Реальный размер очереди проверки в документах и часах — та самая строка, из которой потом складывается 26 320 ₽ или 41 300 ₽ в месяц.
  3. 3Список типов, которые не берутся: если договоры дают 45 % ручной доработки, разумнее исключить их из контура и оставить людям, а не платить за настройку, которая всё равно не снимет работу.
  4. 4Качество исходников по каналам поступления: сканер, электронный документооборот, почта, фотографии. Часто дешевле поменять способ подачи документов, чем движок распознавания.
  5. 5Состояние справочников: сколько позиций номенклатуры и контрагентов не сопоставляется автоматически. Это прямая оценка той части сметы, что в модельном расчёте стоит 150 000 ₽.

Пилот имеет смысл при потоке от 3 000 документов в месяц: на меньших объёмах он сопоставим по цене с самим внедрением. Для потока в 500–1 500 документов дешевле короткий замер на выборке из 300 документов — он входит в первую строку нашей сметы и стоит 60 000 ₽.

этапыskolko-stoit-raspoznavanie-dokumentov--04
Пилот на 50 000 документов: четыре-шесть недель и пять проверяемых результатов

Лента времени на 4–6 недель из четырёх отрезков слева направо. «Неделя 1: выгрузка архива за 15 месяцев — 50 000 документов». «Недели 2–3: прогон по шести типам, замер фактической точности». «Неделя 4: сверка с учётной системой, оценка очереди проверки в часах». «Недели 5–6: отчёт — точность по типам, размер очереди, список типов, которые не берутся». Под лентой ценник «от 500 000 ₽». Чертёжный стиль, подписи по-русски.

За 500 000 ₽ пилот отвечает на пять вопросов, от которых зависит вся смета

Когда распознавание не окупится

Есть три ситуации, в которых мы советуем не начинать проект, и все три видны до подписания договора.

  • Меньше 300 документов в месяц. Ручной ввод на таком объёме стоит 25 часов и 17 500 ₽ в месяц, а постоянные расходы системы начинаются от 59 000 ₽. Расходы превышают весь фонд ручного труда до всякого учёта внедрения. Здесь дешевле оставить оператора и вложиться в порядок в справочниках — с него всё равно начинается любой следующий шаг, и это разобрано в материале дашборд начинается со справочников.
  • Каждый документ уникален по форме. Проектная документация, договоры с индивидуальными приложениями, акты в шаблоне заказчика — там, где структура не повторяется, шаблоны не работают, а ручная доработка держится на уровне 40–50 %. Экономия съедается очередью проверки, и это тот случай, когда автоматизация не отменяет работу, а перекладывает её на другого человека.
  • Ошибка стоит дороже экономии. Если неверно распознанная сумма уходит в платёж без второго контроля, цена одного пропущенного знака превышает годовую экономию. В таких контурах распознавание ставят только вместе со сверкой и запретом на автоматическую проводку — как устроена такая двойная проверка, разобрано в решении автоматическая сверка документов.

И общее правило, которое стоит держать в голове при чтении любого предложения на распознавание: вы покупаете не точность, а сокращение очереди. Ни один вендор не снимает работу целиком, и честная смета всегда содержит строку с оставшимися часами человека. Если такой строки нет, её не забыли — её спрятали, и она проявится на третьем месяце эксплуатации в виде дополнительной ставки оператора, которой не было в расчёте окупаемости.

Распознавание не убирает человека из процесса. Оно превращает ввод в проверку — и проверка тоже стоит денег.