OCR (optical character recognition, оптическое распознавание символов) — это превращение картинки в текст. Система смотрит на скан или фотографию и говорит, какие символы на ней нарисованы. На этом её работа заканчивается: где в этом тексте сумма, где ИНН поставщика, а где номер платёжного поручения — вопрос уже к другому механизму.
Ближайшая офисная аналогия — стажёр, который умеет быстро печатать, но первый день в компании. Дайте ему пачку счетов, и он безошибочно перепечатает всё, что видит. Попросите вбить из этой пачки суммы без НДС в учётную систему — и он остановится, потому что не знает, какая из четырёх цифр внизу документа нужная. Печатает он хорошо. Понимает — пока нет.
Различать эти две работы важно не из любви к терминам, а потому что в коммерческом предложении они превращаются в разные строки с разной ценой и разными рисками. Дальше — модельный расчёт на потоке 1 200 документов в месяц по состоянию на сентябрь 2026 года, ставка инженера 3 000 ₽/час, полная стоимость часа сотрудника 700 ₽.
Два разных действия: прочитать символы и найти поле
Первое действие — распознавание. На выходе получается текст: набор строк с координатами на листе. Второе действие — извлечение полей: понять, что строка «7 340,00» рядом со словом «Итого с НДС» и есть сумма документа, а «7712345678» — это ИНН, потому что в нём десять цифр и он стоит в шапке. Второе действие сложнее первого и ошибается чаще, потому что формы у всех поставщиков разные.
Превращение изображения документа в текст. Бизнесу даёт возможность искать по сканам и не перепечатывать буквы руками. В смете — обычно небольшая строка или вовсе часть лицензии платформы, потому что технология зрелая. Проверочный вопрос: что именно вы называете распознаванием — только текст или заполненные поля в учётной системе.
Определение того, какое значение в тексте является какой реквизитом, и проверка его справочником или контрольным разрядом. Бизнесу даёт готовую строку в учётной системе, а не картинку. В смете — основная работа: разбор форм поставщиков, правила проверки, интеграция с 1С, очередь на ручную доработку. Проверочный вопрос: сколько форм поставщиков вы разбираете в базовой цене и что стоит форма сверх этого.
Отсюда типичная путаница в переговорах. Подрядчик честно говорит «точность распознавания 99 %» — и имеет в виду символы. Заказчик слышит «99 % документов пройдут сами» — и планирует бюджет от этой цифры. Разрыв между этими двумя утверждениями арифметический, а не риторический: мы разбирали его по слоям в материале про реальную точность распознавания и в разборе того, как машина читает документ.
Горизонтальная схема из четырёх блоков со стрелками. Блок 1 «Скан или фото», блок 2 «OCR: символы и координаты», блок 3 «Извлечение полей: сумма, ИНН, дата, номер», блок 4 «Запись в учётную систему». Между блоком 3 и 4 — ромб «уверенность выше порога?», ветка «нет» уходит вниз в блок «Очередь оператора». Под блоком 4 подпись «960 документов из 1 200», под очередью — «240 документов, 3 минуты каждый». Тонкие чертёжные линии, подписи по-русски.
Метрика, по которой считают деньги
Единственный показатель, который напрямую переводится в рубли, — доля документов, обработанных без участия человека. Не процент верных символов, не точность по полям, а именно доля пачки, к которой никто не прикоснулся: документ приехал, разобрался, проверился, лёг в учётную систему, и оператор его не открывал.
Причина простая. Экономия возникает не там, где машина угадала символ, а там, где сотрудник не открыл документ. Если из ста счетов оператор смотрит двадцать, вы платите за двадцать открытий вне зависимости от того, сколько процентов символов система прочитала верно в остальных восьмидесяти.
Модель для счёта: 1 200 счетов и актов от поставщиков в месяц, ручной ввод одного документа — 5 минут, то есть 100 часов и 70 000 ₽ ежемесячно. Документ, попавший в очередь на проверку, обходится в 3 минуты: открыть, сверить подсвеченные поля, поправить одно-два. Эксплуатация системы вместе с лицензией и сопровождением — 14 000 ₽/мес, внедрение — 110 часов работы, то есть 330 000 ₽.
| Доля документов без человека | В очередь попадает | Часов проверки в месяц | Экономия труда | Чистая экономия | Окупаемость 330 000 ₽ |
|---|---|---|---|---|---|
| 0 % — как есть сейчас | 1 200 (полный ввод) | 100 ч | — | — | — |
| 60 % | 480 документов | 24 ч | 53 200 ₽/мес | 39 200 ₽/мес | 8,4 месяца |
| 80 % | 240 документов | 12 ч | 61 600 ₽/мес | 47 600 ₽/мес | 6,9 месяца |
| 95 % | 60 документов | 3 ч | 67 900 ₽/мес | 53 900 ₽/мес | 6,1 месяца |
Обратите внимание на форму этой таблицы. Первый шаг — от нуля до шестидесяти процентов — снимает 53 200 ₽ из 70 000 ₽, то есть три четверти всей возможной экономии. Весь оставшийся путь от 60 % до 95 % добавляет 14 700 ₽/мес. Основные деньги приносит сам факт запуска, а не качество настройки — и это меняет то, за что стоит торговаться в договоре.
Почему последние проценты стоят дороже, чем экономят
Подъём доли автообработки — это не настройка ползунка, а работа с конкретными причинами отказов: новые формы поставщиков, правила проверки сумм, пополнение справочника номенклатуры, обработка многостраничных документов. Каждая следующая причина встречается реже предыдущей, а разбирается примерно так же долго.
Проверить порог легко на калькуляторе: 15 % от 3 800 документов — это 570 документов по 3 минуты, то есть 28,5 часа и 19 950 ₽ в месяц, что примерно и есть 240 000 ₽ за двенадцать месяцев. Ниже этого объёма правильный инженерный ответ — остановиться на восьмидесяти процентах и не платить за остальное. Подробную смету на больший поток мы разбирали отдельно в статье про то, сколько стоит распознавание документов.
Что на самом деле роняет долю автообработки
Ни одна из перечисленных ниже причин не связана с качеством алгоритма. Все они — про то, в каком виде документ приезжает в систему, и почти все чинятся организационно, а не технически.
| Что приходит | Что происходит | Чем лечится |
|---|---|---|
| Фотография с телефона под углом, тень от руки | Строки таблицы съезжают, часть цифр читается как буквы | Требование к поставщикам присылать PDF; для полевых сотрудников — рамка съёмки в приложении |
| Печать или подпись поверх суммы | Поле распознаётся частично и уходит в очередь | Не лечится со стороны системы, закладывается в норму отказов |
| Рукописная правка цены поверх печатного текста | Система читает исходную цифру, а верна зачёркнутая | Правило: документ с рукописной правкой всегда идёт оператору |
| Форма поставщика, которой нет в шаблонах | Поля ищутся по смыслу, точность падает на десятки процентов | Разбор формы, 4–8 часов на поставщика; окупается от 20–30 документов в месяц от него |
| Несколько документов, склеенных в один файл | Второй и третий документ теряются целиком | Автоматическое разделение пачки, отдельная строка сметы |
| Скан второй стороны листа наоборот или вверх ногами | Документ уходит в отказ без разбора | Автоповорот и определение ориентации — стандартная функция, надо проверить, что включена |
Спросите, что происходит с документом, который не распознался. Правильный ответ — он попадает в именованную очередь с указанием причины и ответственного, и по ней есть срок. Ответ «попадёт в лог» означает, что через месяц у вас будет сто документов, о которых никто не знает, и бухгалтерия найдёт их при закрытии периода. Очередь разбора входит в приёмку, а не в пожелания.
Две колонки. Левая «Проходит сам»: один ровный лист PDF с подписями «300 dpi», «известная форма», «поля не перекрыты», внизу пометка «960 из 1 200». Правая «Уходит оператору»: шесть небольших карточек с подписями «фото под углом», «печать на сумме», «рукописная правка», «незнакомая форма поставщика», «два документа в одном файле», «страница вверх ногами», внизу пометка «240 из 1 200, по 3 минуты». Между колонками вертикальная разделительная линия. Тонкие чертёжные линии, подписи по-русски.
Российский стек и сроки на 2026 год
Живой выбор по состоянию на сентябрь 2026 года: Content AI — российский преемник ABBYY, продукты ContentReader PDF и ContentCapture; Smart Engines с сильной специализацией на первичке — УПД, счета-фактуры, акты, КС-2 и КС-3, ТОРГ-12, банковские выписки; Directum там, где распознавание нужно внутри документооборота; 1С:Распознавание первичных документов как самый короткий путь для компании, у которой всё и так живёт в 1С.
Выбор между ними почти никогда не решается заявленной точностью — все четыре на типовой первичке ведут себя сопоставимо. Решают три вещи: попадают ли ваши формы в набор, который система знает из коробки; куда система кладёт результат; и сколько стоит разбор формы, которой в наборе нет. Прикладной срез по типам документов мы делали в подборке про распознавание первички по типам документов.
По срокам ориентир такой: пилот на своей пачке — 3–4 недели, промышленный запуск с интеграцией в учёт и очередью проверки — 6–10 недель. Пилот здесь не формальность: это единственный способ узнать долю автообработки на ваших документах до того, как она станет строкой в договоре. Всё, что обещано до пилота, — это цифра с чужой пачки.
Три вопроса подрядчику
- 1На каких документах вы замеряли точность и сколько их было? Нужны два числа: тип документов и размер выборки. Ответ «97 % по нашим данным» без указания, что это были за документы, не значит ничего — на эталонном наборе вендора такая цифра получается всегда.
- 2Что происходит с документом, который не распознался? Ответ должен описывать маршрут: очередь, причина отказа, ответственный, срок разбора. Если маршрута нет, экономия из расчёта не появится — она просто переедет в другое место и станет незаметной.
- 3Сколько форм поставщиков входит в базовую цену и сколько стоит форма сверх? Это самая частая причина, по которой смета вырастает после подписания. Цифра должна быть в договоре: столько-то форм включено, каждая следующая — по такой-то ставке. Как читать остальные строки такой сметы, разобрано в словаре терминов автоматизации.
Столбчатая диаграмма из трёх столбцов. Ось Y — чистая экономия в рублях в месяц. Столбец «60 %» высотой 39 200 ₽, «80 %» — 47 600 ₽, «95 %» — 53 900 ₽. Под каждым подпись окупаемости: 8,4 / 6,9 / 6,1 месяца. Слева пунктирная отметка «ручной ввод 70 000 ₽/мес». Между вторым и третьим столбцом фигурная скобка с подписью «+6 300 ₽/мес за 240 000 ₽ работ». Тонкие чертёжные линии, подписи по-русски.
Когда распознавание ставить не надо
Три ситуации, в которых 330 000 ₽ не вернутся, и все три считаются до разговора с подрядчиком.
- Меньше 300 документов в месяц. При 5 минутах на документ это 25 часов и 17 500 ₽ ручного труда. После запуска на доле 80 % останется 60 документов проверки, то есть 3 часа и 2 100 ₽, плюс 14 000 ₽ эксплуатации. Чистая экономия — 1 400 ₽ в месяц, внедрение не вернётся никогда. Порог, на котором те же 330 000 ₽ возвращаются хотя бы за год, — около 800 документов в месяц.
- Пачка состоит из уникальных форм. Если сорок поставщиков присылают сорок разных бланков и от каждого приходит два документа в месяц, разбор форм стоит дороже всего потока. Здесь дешевле обработка электронной почты с ручным вводом остатка или переход на электронный документооборот.
- Документы и так приходят электронными. Если поставщики уже в ЭДО, распознавать нечего: данные приезжают структурированными. Тратить бюджет на распознавание того, что можно просто принять по ЭДО, — самый обидный вариант расхода, и проверяется он за один час выборки по контрагентам.
И обратный признак. Если поток больше восьмисот документов в месяц, десять-пятнадцать поставщиков дают три четверти объёма, формы у них стабильные, а сканы делает не курьер на телефон, а офисный аппарат — доля автообработки уйдёт за 80 % на второй месяц, а внедрение вернётся за 7–12 месяцев. Это узкая, но абсолютно рабочая ниша, и признавать её узость честнее, чем продавать распознавание как универсальное средство от ручного ввода.
Точность распознавания — характеристика алгоритма. Доля документов, которых никто не открывал, — характеристика вашего процесса. Платить имеет смысл только за вторую.
