Оператор дешевле распознавания в трёх случаях: поток меньше тысячи документов в месяц, типов документов много, а каждого из них мало, или данные всё равно придётся сверять руками с договором. Во всех трёх случаях внедрение не окупается никогда — не «долго окупается», а именно никогда, потому что постоянные расходы контура не зависят от объёма и просто не с чего покрываться.
Расчёт ниже намеренно сделан против нас же. Мы строим такие контуры и берём за это деньги, поэтому имеет смысл честно показать границу, за которой заказчику выгоднее нанять человека или отдать ввод на сторону. В соседнем материале мы считали окупаемость OCR на объёмах 500, 3 000 и 20 000 документов и получили порог в 790 документов в месяц при ставке бухгалтера. Здесь считается другая ситуация: документы вводит не бухгалтер, а оператор ввода данных с полной стоимостью часа 700 ₽ — и порог от этого сдвигается.
Дальше — формула сравнения, три модельных примера с полной арифметикой, отдельный разбор разнообразия форм, аутсорсинг как промежуточный вариант и условия, при которых внедрять не надо даже на большом потоке.
Формула, в которую всё упирается
Сравнение состоит из пяти величин, и все пять берутся из вашей практики, а не из презентации подрядчика. Ошибка обычно в одной — четвёртой.
- 1Объём — сколько документов в месяц реально проходит через ручной ввод. Считать надо по факту за три месяца, а не по ощущению «ну, штук тысяча».
- 2Минуты на документ — сколько занимает ввод одного документа целиком, вместе с поиском контрагента в справочнике и сверкой позиций. В модели это 6 минут на типовой счёт.
- 3Ставка — полная стоимость часа сотрудника: оклад, взносы, отпуск, рабочее место, делённые на реально доступные часы. Для оператора ввода данных — 700 ₽/час, то есть 11,67 ₽ за минуту.
- 4Коэффициент реализации часов — какая доля снятого времени превращается в деньги. Если человек не уволен и не переведён на другую работу, экономия остаётся бумажной. В модели берём 0,6: это осторожная и проверяемая величина.
- 5Расходы контура — постоянные (лицензия, сопровождение, сервер) и переменные (распознавание и извлечение полей, проверка, хранение). В модели постоянные 31 376 ₽ в месяц и переменные 7,15 ₽ на документ.
Вклад одного документа считается так: из 6 минут ручного ввода после внедрения остаётся 0,42 минуты на проверку, снимается 5,58 минуты. Это 65,10 ₽ по ставке оператора; при коэффициенте 0,6 деньгами становится 39,06 ₽; минус переменные 7,15 ₽ — остаётся 31,91 ₽ с документа. Делим на этот вклад постоянные 31 376 ₽ и получаем порог в 983 документа в месяц, ниже которого контур не покрывает даже собственную эксплуатацию.
Тот же контур при ставке бухгалтера 844 ₽/час выходит в ноль на 790 документах, а при ставке оператора 700 ₽/час — только на 983. Это неочевидно, но логично: экономия считается в часах человека, а расходы контура — в рублях, и они одинаковы независимо от того, кто раньше делал работу. Поэтому вопрос «кого именно мы освобождаем» надо задавать до расчёта, а не после.
Три примера по одной методике
Все три считаются одинаково, отличаются только вводными. Внедрение во всех случаях берём в 420 000 ₽ — типовой контур на один-два вида документов со связкой с учётной системой.
600 счетов — это два с половиной часа работы в день. Такой объём закрывает половина ставки оператора, и контур здесь проигрывает не на десять процентов, а в разы. Компании в этой ситуации регулярно покупают распознавание, потому что считают только строку «сэкономим 55,8 часа» и не вычитают из неё ни коэффициент реализации, ни постоянные расходы.
Здесь машина выигрывает, и выигрывает уверенно. Обратите внимание, что дело не только в объёме: 2 400 накладных — это однотипный поток, где одна настройка извлечения полей работает на всём массиве. Как только в этот поток попадают сорок разных форм, картина меняется, даже если общее количество документов остаётся тем же.
Сравнение в три колонки-карточки: «А. 600 однотипных счетов», «Б. 2 400 однотипных накладных», «В. 800 документов в 40 формах». В каждой карточке четыре строки: снятые часы (55,8 / 223,2 / 74,7), реализуется деньгами (23 436 ₽ / 93 744 ₽ / 31 360 ₽), расходы контура (31 376 ₽ постоянных плюс 4 290 ₽ / 17 160 ₽ / 5 720 ₽ переменных), итог месяца (−12 230 ₽ / +45 208 ₽ / −5 736 ₽). Карточка Б выделена рамкой с подписью «окупается за 9,3 месяца», карточки А и В помечены серым с подписью «дешевле человек». Чертёжный стиль, подписи по-русски.
Почему 40 форм по 20 штук хуже, чем 800 одинаковых
Разнообразие форм — самый недооценённый параметр в расчётах. Считают объём и не считают номенклатуру, а между тем стоимость контура растёт не с числом документов, а с числом типов, для каждого из которых надо настроить извлечение полей, отладить его и потом поддерживать.
Арифметика простая. Настройка одного типа документа — примерно 18 000 ₽. На потоке в 800 одинаковых накладных это 22,50 ₽ настройки на каждый документ месячного потока. На 40 типах по 20 штук — 720 000 ₽ на те же 800 документов, то есть 900 ₽ на документ. Разница в сорок раз, и никакая скидка вендора её не покрывает.
Вторая, менее очевидная проблема — примеры для отладки. Чтобы настроить извлечение и увидеть, что оно ломается, нужен поток однотипных документов: на двадцати штуках в месяц вы не отладите правила и не заметите деградацию, когда контрагент поменяет вёрстку бланка. Точность на редких формах падает не потому, что технология плохая, а потому, что ей не на чем учиться и не на чем проверяться; мы разбирали это в материале про плохие сканы, печати и рукописный текст.
Отдельный тип имеет смысл заводить в контур примерно от 150 штук в месяц. При вкладе 31,91 ₽ с документа это 4 787 ₽ ежемесячно, и настройка в 18 000 ₽ возвращается за 3,8 месяца. Всё, что приходит реже, отправляется в общую очередь ручного ввода: так контур остаётся дешёвым, а редкие формы не тянут за собой поддержку.
Аутсорсинг ввода: третий вариант, о котором забывают
Между «нанять своего оператора» и «построить контур» есть промежуточный вариант — отдать ввод подрядчику. Он не про технологии и потому не попадает в сравнения, которые делают вендоры, хотя на средних объёмах выигрывает у обоих.
Ориентир по рынку — 25–60 ₽ за типовой документ в зависимости от числа полей и требований к сверке; в расчёте берём 40 ₽. У подрядчика вы покупаете результат, а не часы: нет простоя, нет отпусков, нет обучения нового человека после увольнения. Расходы полностью переменные, поэтому вариант хорошо переносит сезонность.
| Поток в месяц | Свой оператор | Аутсорсинг по 40 ₽ | Свой контур распознавания |
|---|---|---|---|
| 600 документов | 42 000 ₽ | 24 000 ₽ | 38 606 ₽ |
| 1 120 документов | 78 400 ₽ | 44 800 ₽ | 44 872 ₽ — точка равенства |
| 2 400 документов | 168 000 ₽ | 96 000 ₽ | 60 296 ₽ |
| Природа расходов | Постоянные, растут ступенями по ставкам | Переменные, линейные | Постоянные плюс переменная часть 12,05 ₽ на документ |
| Что нужно от вас | Найм, обучение, замена при увольнении | Договор и поручение обработки данных | Владелец справочников и очередь проверки |
Одна оговорка, без которой таблица вводит в заблуждение. В колонке «свой оператор» стоит полная стоимость его часов, а не деньги, которые вы перестанете платить: уволить половину человека нельзя. Именно поэтому в расчётах выше стоял коэффициент реализации 0,6 — и именно поэтому на 600 документах контур формально дешевле оператора по строке расходов (38 606 ₽ против 42 000 ₽), но всё равно даёт минус 12 230 ₽ по фактическому эффекту. Аутсорсинг в этом смысле честнее любой из двух колонок: там вы платите ровно за сделанную работу.
Точка равенства между аутсорсингом и собственным контуром — примерно 1 120 документов в месяц: дальше постоянные расходы контура размазываются по объёму, и он начинает выигрывать линейно. До этой отметки платить подрядчику дешевле, и это не временное решение, а нормальный рабочий режим на годы, если объём не растёт.
Подрядчик, который вводит ваши документы, видит суммы, контрагентов и условия сделок. Значит, нужны договор с условием о конфиденциальности и поручение обработки персональных данных, если в документах есть фамилии. Второй риск — качество: у внешнего оператора нет контекста, он не заметит, что накладная от поставщика, с которым вы месяц назад расторгли договор. Поэтому сверка остаётся у вас в любом случае.
Горизонтальная шкала объёма от 0 до 3 000 документов в месяц, разделённая двумя вертикальными линиями на три зоны. Первая линия на отметке 983 подписана «операционный ноль контура», вторая на 1 120 — «равенство с аутсорсингом по 40 ₽». Зоны подписаны: «Свой оператор или аутсорсинг», «Аутсорсинг дешевле контура», «Свой контур распознавания». На шкале отмечены три модельных примера точками: 600 (−12 230 ₽), 800 в 40 формах (−5 736 ₽, точка вынесена ниже шкалы с пометкой «разнообразие форм ломает правило объёма»), 2 400 (+45 208 ₽). Подписи по-русски.
Когда не внедряем даже на большом объёме
Объём — необходимое условие, но не достаточное. Есть четыре ситуации, в которых мы отказываемся строить контур даже при потоке в несколько тысяч документов в месяц.
- Источник документа можно перевести на обмен данными. Если поставщик присылает счета в PDF, а может присылать по ЭДО, правильный ответ — не читать картинку, а настроить обмен. Распознавание здесь автоматизирует существование проблемы. Подключение обмена разбирается в материале про способы обмена с 1С и ЭДО, и почти всегда это дешевле контура распознавания.
- Главная работа — не ввод, а сверка. Если оператор тратит 2 минуты на набор и 8 минут на сверку позиций со спецификацией и договором, распознавание снимает пятую часть работы. Экономия считается по снятым минутам, а не по документам, и в такой пропорции она не покрывает постоянных расходов.
- Вход — фотографии с бликами и рукопись. На ровном фото без правки проходит около 58 % документов, при блике — 30 %, на рукописном тексте — от нуля до 15 %. Проверять придётся почти всё, а очередь проверки стоит человеко-часов; экономика превращается в перекладывание работы из одного кабинета в другой.
- Некому владеть справочниками. Контур распознавания подставляет контрагента и номенклатуру из ваших справочников. Если справочники ведут пятеро и в них три версии одного поставщика, машина будет ошибаться в подстановке чаще, чем человек, и каждую ошибку придётся ловить вручную.
И последнее наблюдение из практики. Заказчики, у которых распознавание не окупилось, почти никогда не жалуются на технологию: она обычно работала. Жалуются на то, что после внедрения количество людей не изменилось, а к их работе добавилась очередь проверки — то есть на невыполненный четвёртый пункт формулы. Прежде чем считать эффект, стоит ответить на неудобный вопрос: что именно эти освобождённые 55 или 223 часа будут делать в следующем месяце. Если ответа нет, экономия останется на бумаге, и никакая точность распознавания этого не изменит. Общую методику счёта ручной работы мы разбирали в материале про то, сколько стоит ручная работа.
Машина побеждает человека не точностью, а повторяемостью. Нет повторяемости — нет и победы.
