Сервис распознавания первички выбирают не по проценту точности в презентации, а по одному вопросу: накрывает ли он вашу стопку. Компания, у которой 80 % потока — УПД от двадцати постоянных поставщиков, и компания, у которой половина пачки — акты КС-2 и КС-3 со стройки, будут довольны разными инструментами, и никакой общий рейтинг здесь не помогает.
Поэтому подборка ниже устроена от документов, а не от брендов. Сначала перепись пачки по типам, потом — четыре класса инструментов и то, что каждый закрывает, дальше — расчёт на трёх объёмах и честная отметка, при каком раскладе внедрение не окупается никогда. Отдельно — про способ подачи документов, который влияет на экономику сильнее, чем выбор поставщика.
Одно предупреждение перед началом. Состав поддерживаемых форм у каждого поставщика меняется от релиза к релизу, и перечень из статьи полугодовой давности — плохая опора. Запрашивайте актуальный список форм на дату разговора и требуйте не список, а обработку двухсот ваших собственных документов. Всё, что ниже, — по состоянию на сентябрь 2026 года.
Сначала — перепись пачки: что к вам вообще приходит
Эта работа занимает один рабочий день и определяет весь дальнейший выбор. Берётся месяц входящих документов и раскладывается по типам с подсчётом штук. Ниже — модельная пачка производственно-торговой компании: 3 000 входящих первичных документов в месяц. Ваши доли будут другими, и именно в этом смысл упражнения.
| Тип документа | Штук в месяц | Доля | Что в нём тяжёлого для машины |
|---|---|---|---|
| УПД | 1 080 | 36 % | Табличная часть: строки номенклатуры, ставки НДС, переносы на вторую страницу |
| ТОРГ-12 и ТОРГ-13 | 420 | 14 % | Формы поставщиков расходятся: колонки в разном порядке, свои шапки |
| Акт выполненных работ | 360 | 12 % | Свободная формулировка работ, нет жёсткого шаблона |
| Счёт-фактура | 330 | 11 % | Печать поверх текста, подписи в поле номера |
| Платёжное поручение | 270 | 9 % | Реквизиты в фиксированных местах — самый простой тип |
| Банковская выписка | 240 | 8 % | Многостраничные таблицы, разные форматы банков |
| КС-2 и КС-3 | 150 | 5 % | Длинные сметные таблицы, ссылки на расценки, приложения |
| Прочее: счета на оплату, ГТД, договоры | 150 | 5 % | Разнородные формы, часть не поддаётся шаблону |
Горизонтальная столбчатая диаграмма из восьми полос с подписями и числами: УПД — 1 080 (36 %), ТОРГ-12 и ТОРГ-13 — 420 (14 %), акт выполненных работ — 360 (12 %), счёт-фактура — 330 (11 %), платёжное поручение — 270 (9 %), банковская выписка — 240 (8 %), КС-2 и КС-3 — 150 (5 %), прочее — 150 (5 %). Первые три полосы выделены заливкой, справа от них подпись «62 % пачки». Общий заголовок: «3 000 входящих документов в месяц». Чертёжный стиль, подписи по-русски.
Что даёт перепись сразу, ещё до разговора с поставщиками. Во-первых, становится видно, что три верхних типа дают 62 % пачки, и сервис, который берёт только их, закрывает почти две трети работы. Во-вторых, видно проблемный хвост: КС-2, КС-3 и «прочее» — это 10 % документов, которые съедят непропорционально много времени на настройку. В-третьих, появляется база для честного разговора: не «какая у вас точность», а «покажите обработку двухсот наших УПД и сорока наших актов».
Делает перепись не подрядчик, а ваш бухгалтер или делопроизводитель — тот, кто сегодня эти документы вводит. Достаточно таблицы из четырёх колонок: тип документа, поставщик, способ поступления, минуты на ввод. Отдельно отмечаются формы, которые вызывают трудности: у одного поставщика ТОРГ-12 всегда приходит с переставленными колонками, у другого печать перекрывает номер. Этот список потом становится приложением к техническому заданию и защищает вас от предложения, собранного под усреднённую компанию.
Кто какие типы берёт: четыре класса инструментов
На российском рынке 2026 года инструменты распадаются на четыре класса, и различаются они не столько качеством чтения, сколько тем, что вы получаете вместе с ним: движок, платформу, документооборот или готовую обработку внутри учётной системы. От класса зависит объём обвязки, которую придётся строить вокруг.
| Класс инструмента | Кто в классе | Сильная сторона | Где ограничения |
|---|---|---|---|
| Специализированный движок распознавания | Smart Engines | Заявленная специализация на бухгалтерских формах: УПД, УКД, счета-фактуры, акты, КС-2 и КС-3, ТОРГ-12 и ТОРГ-13, банковские выписки, платёжные поручения, ГТД | Поставляется как компонент: маршруты, очередь проверки и связку с учётной системой строите вы или интегратор |
| Универсальная платформа захвата | Content AI — российский преемник ABBYY: ContentCapture вместо FlexiCapture, ContentReader PDF вместо FineReader | Настраивается под собственные и нестандартные формы, включая внутренние бланки | Настройка под каждую нестандартную форму — проектная работа, а не галочка |
| Документооборот со встроенным распознаванием | Directum | Документ сразу попадает в маршрут согласования, распознавание — часть общего процесса | Имеет смысл, когда вы внедряете документооборот целиком, а не только ввод первички |
| Обработка внутри учётной системы | 1С:Распознавание первичных документов | Не нужен отдельный контур: документ создаётся сразу в базе, где с ним работает бухгалтерия | Охват ограничен перечнем поддерживаемых форм — уточняйте актуальный список на дату |
Практическое правило выбора между классами простое. Если пачка однородная и на 90 % состоит из форм, которые заявлены как поддерживаемые, — берите то, что ближе к вашей учётной системе, и не стройте лишних контуров. Если в пачке много собственных и нестандартных форм — нужна платформа с настраиваемыми шаблонами, и это будет проект, а не подключение. Если задача шире ввода и включает согласование договоров и приказов, разговор идёт уже про документооборот, и распознавание в нём — один из модулей.
Отдельно про смешанные конфигурации, которые встречаются чаще, чем чистые. Типичная рабочая схема выглядит так: документы от постоянных поставщиков идут через ЭДО и в распознавание вообще не попадают, основная масса сканов обрабатывается движком или платформой, а нестандартный хвост — собственные бланки, акты от разовых подрядчиков, бумаги без шаблона — вводится руками. Считать окупаемость надо по этой схеме целиком, а не по одной её части, иначе экономия на бумаге окажется вдвое выше фактической.
Почему заявленная точность не переносится на вашу пачку
Заявленная точность измеряется на эталонных сканах ровных документов стандартных форм. Ваша пачка выглядит иначе, и разрыв возникает по четырём причинам, ни одна из которых не связана с качеством алгоритма: сканы сняты на 200 dpi вместо 300, синяя печать легла поверх номера и суммы, на полях от руки написан номер заказа, а половина поставщиков печатает ТОРГ-12 по собственному шаблону с переставленными колонками.
Отдельный источник расхождения — арифметика самой метрики. Точность по символам, точность по полю и точность по документу — три разных числа, и разрыв между ними кратный: документ считается прочитанным правильно, только если правильно прочитаны все его значимые поля. Как это устроено и как измерить на своих документах за три дня, мы разбирали в отдельном материале про реальную точность распознавания. Здесь важен только вывод для выбора: сравнивать поставщиков по их собственным цифрам бессмысленно, сравнивать надо по одной и той же вашей выборке.
Это две независимые характеристики, и подмена одной другой — самая частая уловка в предложениях. Сервис с точностью 96 % на охвате 60 % пачки хуже, чем сервис с точностью 89 % на охвате 95 %: в первом случае 40 % документов вводятся руками целиком, во втором — 11 % полей проверяются. Спрашивайте оба числа и требуйте их на своей выборке.
Контур проверки человеком: 35 % на старте, 12 % на режиме
Проверка человеком — не признак неудачного внедрения, а обязательная часть конструкции. Вопрос только в её объёме и в том, как он меняется. В модельном проекте на первом месяце на ручную проверку уходит 35 % документов: система ещё не видела формы конкретных поставщиков, а правила проверки настроены строго. К третьему месяцу доля падает до 18 %, к полугоду — до 12 % и дальше почти не снижается.
Снижение происходит не само по себе. Оно даётся тремя вещами: добавлением шаблонов под формы постоянных поставщиков, наведением порядка в справочнике номенклатуры, чтобы сопоставление строк перестало быть угадыванием, и настройкой автоматических проверок — сходится ли сумма со строками, существует ли такой ИНН, не пришёл ли документ с этим номером дважды. Если этой работой никто не занимается, доля ручной проверки застревает на уровне первого месяца, и экономия из расчёта не появляется.
Линейный график за шесть месяцев. Ось Y — доля документов на ручной проверке в процентах, ось X — месяцы. Линия начинается в точке 35 % на первом месяце, идёт вниз до 18 % на третьем и до 12 % на шестом, дальше выходит на плато. Под точками перегиба три подписи-причины: «шаблоны форм постоянных поставщиков», «порядок в справочнике номенклатуры», «автоматические проверки: сумма, ИНН, дубль номера». Пунктиром показана вторая линия, застрявшая на 35 % с подписью «если этим никто не занимается». Подписи по-русски.
Сумма, ИНН контрагента, номер и дата документа проверяются на 100 % независимо от того, насколько хорошо работает система. Стоит это недорого — эти четыре поля видны в одном экране, — а цена ошибки в них выше стоимости всей проверки: неверный ИНН уводит документ не тому контрагенту, неверная сумма уходит в декларацию.
Из этого следует требование к интерфейсу проверки, которое стоит проговорить до покупки. Проверяющий должен видеть распознанные поля и изображение документа на одном экране, а не переключаться между окнами: разница в скорости — примерно втрое, и именно она превращает 3 минуты на документ в 9. Спрашивайте не «есть ли контроль качества», а «покажите экран, на котором бухгалтер проверяет документ», и засекайте время на десяти своих документах.
Способ подачи меняет экономику сильнее, чем выбор вендора
Перед тем как выбирать инструмент, стоит посмотреть, откуда документы вообще берутся. Часть потока лучше не распознавать: документ, полученный через оператора ЭДО, приходит уже структурой, и читать его картинку — всё равно что печатать письмо, чтобы отсканировать обратно.
| Способ подачи | Что приходит | Нужно ли распознавание | Что определяет стоимость |
|---|---|---|---|
| ЭДО: Контур.Диадок, Saby ЭДО, 1С-ЭДО | Структурированный документ с полями | Нет — поля уже есть | Тарификация у операторов строится на исходящих документах; условия по входящим уточняйте у оператора на дату подключения |
| Скан с МФУ, 300 dpi | Ровное изображение известного качества | Да, это базовый сценарий | Часы на сканирование и раскладку по пачкам |
| Фото с телефона | Изображение с перспективой, бликами и тенью | Да, с предварительной обработкой | Доля брака выше; закрывает случай «привезли бумагу в цех» |
| PDF во вложении почты | Либо текстовый PDF, либо тот же скан внутри | Только для сканов | Разделение потока: у текстовых PDF поля берутся напрямую и почти бесплатно |
| Бумага без сканера | Ничего, пока кто-то не отсканирует | Да, плюс отдельная операция | Сканирование — отдельные часы, которые забывают в расчётах |
Практический вывод: перевод постоянных поставщиков в ЭДО почти всегда дешевле распознавания их сканов и даёт лучший результат — там нечему ошибаться. Если в модельной пачке 40 % документов удастся получать структурой, распознавать останется 1 800 штук вместо 3 000, и внедрение можно брать в меньшей конфигурации. Как устроен ЭДО и что нужно для старта, мы разбирали отдельно; здесь достаточно правила: сначала ЭДО там, где он возможен, распознавание — на остаток.
Схема из двух горизонтальных маршрутов. Верхний: «Поставщик» → «Оператор ЭДО: Диадок, Saby ЭДО, 1С-ЭДО» → «Учётная система», подпись «поля уже есть, 1 200 документов из 3 000». Нижний: «Поставщик» → «Скан или фото» → «Распознавание» → «Проверка человеком, 12 %» → «Учётная система», подпись «1 800 документов из 3 000». Между маршрутами вертикальная стрелка снизу вверх с подписью «перевод поставщиков в ЭДО». Чертёжный стиль, подписи по-русски.
Расчёт на 500, 3 000 и 15 000 документов в месяц
Вводные для всех трёх объёмов одинаковые. Оператор вводит документ в среднем за 6 минут: у платёжного поручения быстрее, у УПД с двадцатью строками номенклатуры — дольше. Полная стоимость часа оператора с налогами и накладными — 620 ₽. После выхода на режим на ручную проверку уходит 12 % документов по 3 минуты. Внедрение и ежемесячные расходы взяты по середине рыночных вилок и включают настройку шаблонов, связку с учётной системой и поддержку.
Что стоит за строкой «внедрение 320 000 ₽», чтобы её можно было проверить в чужой смете. Примерно треть суммы уходит на настройку шаблонов под формы постоянных поставщиков и на прогон обучающей выборки из 200 документов. Ещё треть — связка с учётной системой: создание документа, подстановка контрагента, сопоставление строк со справочником номенклатуры. Оставшееся — интерфейс проверки, автоматические контроли и обучение сотрудников. Если в предложении есть только первая треть, оно дешевле не потому, что подрядчик эффективнее.
| Объём в месяц | Ручной ввод сейчас | Сервис + проверка | Экономия | Внедрение | Окупаемость |
|---|---|---|---|---|---|
| 500 документов | 31 000 ₽ | 14 000 + 1 860 ₽ | 15 140 ₽/мес | 180 000 ₽ | 11,9 месяца |
| 3 000 документов | 186 000 ₽ | 42 000 + 11 160 ₽ | 132 840 ₽/мес | 320 000 ₽ | 2,4 месяца |
| 15 000 документов | 930 000 ₽ | 140 000 + 55 800 ₽ | 734 200 ₽/мес | 620 000 ₽ | меньше месяца |
Теперь честная часть. Расчёт выше предполагает, что сервис берёт всю пачку. Если охват форм составляет 60 %, картина на малом объёме разваливается. При 500 документах распознаются 300, остальные 200 вводятся руками как раньше: экономия падает до 3 484 ₽ в месяц, и внедрение за 180 000 ₽ окупается за 52 месяца. Это и есть отрицательный ответ, который надо получить до оплаты, а не после: на пачке до 500 документов с разнородными формами распознавание не окупается.
Столбчатая диаграмма из четырёх столбцов по оси «срок окупаемости в месяцах»: «500 документов, охват 95 %» — 11,9 месяца, «3 000 документов» — 2,4 месяца, «15 000 документов» — меньше месяца, и отдельно стоящий высокий столбец «500 документов, охват 60 %» — 52 месяца, выделенный штриховкой и подписью «не окупается». Горизонтальная линия на отметке 12 месяцев подписана «разумный горизонт решения». Оси и подписи по-русски.
Персональные данные в документах
Пока в пачке только накладные и счета от юридических лиц, вопрос стоит в плоскости удобства. Как только в потоке появляются паспорта, договоры с физическими лицами, заявления сотрудников и анкеты, выбор переходит в плоскость 152-ФЗ, и техническое решение начинает зависеть от юридического.
- Где обрабатывается изображение. Облачный сервис означает передачу документа с персональными данными во внешний контур — это допустимо, но требует оформленного поручения обработки и проверки, что данные размещены на серверах в России.
- Что остаётся после обработки. Задайте прямой вопрос: хранится ли исходное изображение у поставщика, сколько времени и как удаляется. Ответ должен быть в договоре, а не в переписке.
- Кто оператор. Оператором персональных данных остаётесь вы, даже если распознаёт подрядчик. Значит, ваша ответственность — сроки хранения, ограничение доступа и журнал того, кто открывал документы.
- Разделение потока. Часто самое дешёвое решение — не выбирать между облаком и своим контуром, а разделить: накладные и счета уходят в облачный сервис, документы с персональными данными обрабатываются внутри периметра или вводятся руками, если их немного.
Последний пункт стоит проверять первым: в модельной пачке документы с персональными данными — это единицы процентов, и городить ради них локальный контур дороже, чем ввести их руками. Обратная ситуация — кадровые и медицинские документы в потоке — меняет всё: там локальная обработка становится требованием, а не предпочтением, и это отдельный разговор про размещение модели в своём контуре.
Когда распознавание не окупается
Четыре ситуации, в которых честный ответ — «не надо», и их лучше отработать до подписания договора.
- Пачка меньше 500 документов в месяц и при этом разнородная. В расчёте выше такой сценарий даёт окупаемость 52 месяца. Дешевле оператор на неполный день; вернуться к вопросу стоит при росте потока или при унификации форм поставщиков.
- Большинство поставщиков готовы перейти в ЭДО. Тогда распознавание решает не ту задачу: сначала переводите поток в структуру, потом смотрите на остаток. Иначе вы автоматизируете работу, которую можно просто не делать.
- Справочник номенклатуры в беспорядке. Если одна и та же позиция записана в пяти вариантах, сопоставление строк УПД с карточками не заработает ни у одного вендора, и весь эффект уйдёт в ручное сопоставление. Это отдельный подготовительный проект, и его стоимость надо считать до, а не после.
- Некому проверять. Схема без человека в контуре не запускается: 12 % документов на проверке — это 18 часов в месяц при 3 000 документов. Если этих часов нет ни у кого, ошибки поедут в учёт, и проект закончится откатом.
И общее замечание к любому расчёту в этой теме. Все числа выше — модельные, на середине рыночных вилок и на состоянии рынка в сентябре 2026 года. Свои цифры вы получаете за три дня: перепись пачки по типам, замер времени ввода на двадцати документах каждого типа и прогон двухсот документов через выбранный инструмент. Это дешевле любой презентации и точнее любого рейтинга.
