OCR (optical character recognition, оптическое распознавание символов) — это превращение картинки в текст. Система смотрит на скан или фотографию и говорит, какие символы на ней нарисованы. На этом её работа заканчивается: где в этом тексте сумма, где ИНН поставщика, а где номер платёжного поручения — вопрос уже к другому механизму.

Ближайшая офисная аналогия — стажёр, который умеет быстро печатать, но первый день в компании. Дайте ему пачку счетов, и он безошибочно перепечатает всё, что видит. Попросите вбить из этой пачки суммы без НДС в учётную систему — и он остановится, потому что не знает, какая из четырёх цифр внизу документа нужная. Печатает он хорошо. Понимает — пока нет.

Различать эти две работы важно не из любви к терминам, а потому что в коммерческом предложении они превращаются в разные строки с разной ценой и разными рисками. Дальше — модельный расчёт на потоке 1 200 документов в месяц по состоянию на сентябрь 2026 года, ставка инженера 3 000 ₽/час, полная стоимость часа сотрудника 700 ₽.

Два разных действия: прочитать символы и найти поле

Первое действие — распознавание. На выходе получается текст: набор строк с координатами на листе. Второе действие — извлечение полей: понять, что строка «7 340,00» рядом со словом «Итого с НДС» и есть сумма документа, а «7712345678» — это ИНН, потому что в нём десять цифр и он стоит в шапке. Второе действие сложнее первого и ошибается чаще, потому что формы у всех поставщиков разные.

Что это значитOCR

Превращение изображения документа в текст. Бизнесу даёт возможность искать по сканам и не перепечатывать буквы руками. В смете — обычно небольшая строка или вовсе часть лицензии платформы, потому что технология зрелая. Проверочный вопрос: что именно вы называете распознаванием — только текст или заполненные поля в учётной системе.

Что это значитИзвлечение полей (IDP)

Определение того, какое значение в тексте является какой реквизитом, и проверка его справочником или контрольным разрядом. Бизнесу даёт готовую строку в учётной системе, а не картинку. В смете — основная работа: разбор форм поставщиков, правила проверки, интеграция с 1С, очередь на ручную доработку. Проверочный вопрос: сколько форм поставщиков вы разбираете в базовой цене и что стоит форма сверх этого.

Отсюда типичная путаница в переговорах. Подрядчик честно говорит «точность распознавания 99 %» — и имеет в виду символы. Заказчик слышит «99 % документов пройдут сами» — и планирует бюджет от этой цифры. Разрыв между этими двумя утверждениями арифметический, а не риторический: мы разбирали его по слоям в материале про реальную точность распознавания и в разборе того, как машина читает документ.

схема процессаchto-takoe-ocr-prostymi-slovami--01
Схема: скан превращается в текст, из текста извлекаются поля, часть документов уходит в очередь на проверку

Горизонтальная схема из четырёх блоков со стрелками. Блок 1 «Скан или фото», блок 2 «OCR: символы и координаты», блок 3 «Извлечение полей: сумма, ИНН, дата, номер», блок 4 «Запись в учётную систему». Между блоком 3 и 4 — ромб «уверенность выше порога?», ветка «нет» уходит вниз в блок «Очередь оператора». Под блоком 4 подпись «960 документов из 1 200», под очередью — «240 документов, 3 минуты каждый». Тонкие чертёжные линии, подписи по-русски.

Между сканом и строкой в учётной системе три шага, и ломаются они по-разному

Метрика, по которой считают деньги

Единственный показатель, который напрямую переводится в рубли, — доля документов, обработанных без участия человека. Не процент верных символов, не точность по полям, а именно доля пачки, к которой никто не прикоснулся: документ приехал, разобрался, проверился, лёг в учётную систему, и оператор его не открывал.

Причина простая. Экономия возникает не там, где машина угадала символ, а там, где сотрудник не открыл документ. Если из ста счетов оператор смотрит двадцать, вы платите за двадцать открытий вне зависимости от того, сколько процентов символов система прочитала верно в остальных восьмидесяти.

Модель для счёта: 1 200 счетов и актов от поставщиков в месяц, ручной ввод одного документа — 5 минут, то есть 100 часов и 70 000 ₽ ежемесячно. Документ, попавший в очередь на проверку, обходится в 3 минуты: открыть, сверить подсвеченные поля, поправить одно-два. Эксплуатация системы вместе с лицензией и сопровождением — 14 000 ₽/мес, внедрение — 110 часов работы, то есть 330 000 ₽.

Доля документов без человекаВ очередь попадаетЧасов проверки в месяцЭкономия трудаЧистая экономияОкупаемость 330 000 ₽
0 % — как есть сейчас1 200 (полный ввод)100 ч
60 %480 документов24 ч53 200 ₽/мес39 200 ₽/мес8,4 месяца
80 %240 документов12 ч61 600 ₽/мес47 600 ₽/мес6,9 месяца
95 %60 документов3 ч67 900 ₽/мес53 900 ₽/мес6,1 месяца

Обратите внимание на форму этой таблицы. Первый шаг — от нуля до шестидесяти процентов — снимает 53 200 ₽ из 70 000 ₽, то есть три четверти всей возможной экономии. Весь оставшийся путь от 60 % до 95 % добавляет 14 700 ₽/мес. Основные деньги приносит сам факт запуска, а не качество настройки — и это меняет то, за что стоит торговаться в договоре.

Почему последние проценты стоят дороже, чем экономят

Подъём доли автообработки — это не настройка ползунка, а работа с конкретными причинами отказов: новые формы поставщиков, правила проверки сумм, пополнение справочника номенклатуры, обработка многостраничных документов. Каждая следующая причина встречается реже предыдущей, а разбирается примерно так же долго.

Что стоит подъём доли автообработки на потоке 1 200 документов в месяц
Первый запуск: одна форма, интеграция с учётом, очередь проверки — 110 часов330 000 ₽ разово, даёт 60 %
Подъём с 60 % до 80 %: формы поставщиков и справочник номенклатуры, 40 часов120 000 ₽, добавляет 8 400 ₽/мес
Подъём с 80 % до 95 %: редкие формы, рукописные правки, сложные случаи, 80 часов240 000 ₽, добавляет 6 300 ₽/мес
Окупаемость первого шага14,3 месяца
Окупаемость второго шага38,1 месяца
ИтогоПорог: чтобы подъём с 80 % до 95 % вернулся за год, поток должен быть около 3 800 документов в месяц

Проверить порог легко на калькуляторе: 15 % от 3 800 документов — это 570 документов по 3 минуты, то есть 28,5 часа и 19 950 ₽ в месяц, что примерно и есть 240 000 ₽ за двенадцать месяцев. Ниже этого объёма правильный инженерный ответ — остановиться на восьмидесяти процентах и не платить за остальное. Подробную смету на больший поток мы разбирали отдельно в статье про то, сколько стоит распознавание документов.

Что на самом деле роняет долю автообработки

Ни одна из перечисленных ниже причин не связана с качеством алгоритма. Все они — про то, в каком виде документ приезжает в систему, и почти все чинятся организационно, а не технически.

Что приходитЧто происходитЧем лечится
Фотография с телефона под углом, тень от рукиСтроки таблицы съезжают, часть цифр читается как буквыТребование к поставщикам присылать PDF; для полевых сотрудников — рамка съёмки в приложении
Печать или подпись поверх суммыПоле распознаётся частично и уходит в очередьНе лечится со стороны системы, закладывается в норму отказов
Рукописная правка цены поверх печатного текстаСистема читает исходную цифру, а верна зачёркнутаяПравило: документ с рукописной правкой всегда идёт оператору
Форма поставщика, которой нет в шаблонахПоля ищутся по смыслу, точность падает на десятки процентовРазбор формы, 4–8 часов на поставщика; окупается от 20–30 документов в месяц от него
Несколько документов, склеенных в один файлВторой и третий документ теряются целикомАвтоматическое разделение пачки, отдельная строка сметы
Скан второй стороны листа наоборот или вверх ногамиДокумент уходит в отказ без разбораАвтоповорот и определение ориентации — стандартная функция, надо проверить, что включена
Отказ, который никуда не приводит, — самый дорогой сценарий

Спросите, что происходит с документом, который не распознался. Правильный ответ — он попадает в именованную очередь с указанием причины и ответственного, и по ней есть срок. Ответ «попадёт в лог» означает, что через месяц у вас будет сто документов, о которых никто не знает, и бухгалтерия найдёт их при закрытии периода. Очередь разбора входит в приёмку, а не в пожелания.

сравнениеchto-takoe-ocr-prostymi-slovami--02
Слева документ, который проходит без человека, справа шесть случаев, из-за которых он уходит оператору

Две колонки. Левая «Проходит сам»: один ровный лист PDF с подписями «300 dpi», «известная форма», «поля не перекрыты», внизу пометка «960 из 1 200». Правая «Уходит оператору»: шесть небольших карточек с подписями «фото под углом», «печать на сумме», «рукописная правка», «незнакомая форма поставщика», «два документа в одном файле», «страница вверх ногами», внизу пометка «240 из 1 200, по 3 минуты». Между колонками вертикальная разделительная линия. Тонкие чертёжные линии, подписи по-русски.

Долю автообработки роняет не алгоритм, а то, в каком виде документ приезжает

Российский стек и сроки на 2026 год

Живой выбор по состоянию на сентябрь 2026 года: Content AI — российский преемник ABBYY, продукты ContentReader PDF и ContentCapture; Smart Engines с сильной специализацией на первичке — УПД, счета-фактуры, акты, КС-2 и КС-3, ТОРГ-12, банковские выписки; Directum там, где распознавание нужно внутри документооборота; 1С:Распознавание первичных документов как самый короткий путь для компании, у которой всё и так живёт в 1С.

Выбор между ними почти никогда не решается заявленной точностью — все четыре на типовой первичке ведут себя сопоставимо. Решают три вещи: попадают ли ваши формы в набор, который система знает из коробки; куда система кладёт результат; и сколько стоит разбор формы, которой в наборе нет. Прикладной срез по типам документов мы делали в подборке про распознавание первички по типам документов.

По срокам ориентир такой: пилот на своей пачке — 3–4 недели, промышленный запуск с интеграцией в учёт и очередью проверки — 6–10 недель. Пилот здесь не формальность: это единственный способ узнать долю автообработки на ваших документах до того, как она станет строкой в договоре. Всё, что обещано до пилота, — это цифра с чужой пачки.

Три вопроса подрядчику

  1. 1На каких документах вы замеряли точность и сколько их было? Нужны два числа: тип документов и размер выборки. Ответ «97 % по нашим данным» без указания, что это были за документы, не значит ничего — на эталонном наборе вендора такая цифра получается всегда.
  2. 2Что происходит с документом, который не распознался? Ответ должен описывать маршрут: очередь, причина отказа, ответственный, срок разбора. Если маршрута нет, экономия из расчёта не появится — она просто переедет в другое место и станет незаметной.
  3. 3Сколько форм поставщиков входит в базовую цену и сколько стоит форма сверх? Это самая частая причина, по которой смета вырастает после подписания. Цифра должна быть в договоре: столько-то форм включено, каждая следующая — по такой-то ставке. Как читать остальные строки такой сметы, разобрано в словаре терминов автоматизации.
графикchto-takoe-ocr-prostymi-slovami--03
Столбики чистой экономии при доле автообработки 60, 80 и 95 процентов с окупаемостью под каждым

Столбчатая диаграмма из трёх столбцов. Ось Y — чистая экономия в рублях в месяц. Столбец «60 %» высотой 39 200 ₽, «80 %» — 47 600 ₽, «95 %» — 53 900 ₽. Под каждым подпись окупаемости: 8,4 / 6,9 / 6,1 месяца. Слева пунктирная отметка «ручной ввод 70 000 ₽/мес». Между вторым и третьим столбцом фигурная скобка с подписью «+6 300 ₽/мес за 240 000 ₽ работ». Тонкие чертёжные линии, подписи по-русски.

Первый шаг снимает три четверти экономии, весь остальной путь — оставшуюся четверть

Когда распознавание ставить не надо

Три ситуации, в которых 330 000 ₽ не вернутся, и все три считаются до разговора с подрядчиком.

  • Меньше 300 документов в месяц. При 5 минутах на документ это 25 часов и 17 500 ₽ ручного труда. После запуска на доле 80 % останется 60 документов проверки, то есть 3 часа и 2 100 ₽, плюс 14 000 ₽ эксплуатации. Чистая экономия — 1 400 ₽ в месяц, внедрение не вернётся никогда. Порог, на котором те же 330 000 ₽ возвращаются хотя бы за год, — около 800 документов в месяц.
  • Пачка состоит из уникальных форм. Если сорок поставщиков присылают сорок разных бланков и от каждого приходит два документа в месяц, разбор форм стоит дороже всего потока. Здесь дешевле обработка электронной почты с ручным вводом остатка или переход на электронный документооборот.
  • Документы и так приходят электронными. Если поставщики уже в ЭДО, распознавать нечего: данные приезжают структурированными. Тратить бюджет на распознавание того, что можно просто принять по ЭДО, — самый обидный вариант расхода, и проверяется он за один час выборки по контрагентам.

И обратный признак. Если поток больше восьмисот документов в месяц, десять-пятнадцать поставщиков дают три четверти объёма, формы у них стабильные, а сканы делает не курьер на телефон, а офисный аппарат — доля автообработки уйдёт за 80 % на второй месяц, а внедрение вернётся за 7–12 месяцев. Это узкая, но абсолютно рабочая ниша, и признавать её узость честнее, чем продавать распознавание как универсальное средство от ручного ввода.

Точность распознавания — характеристика алгоритма. Доля документов, которых никто не открывал, — характеристика вашего процесса. Платить имеет смысл только за вторую.