Документы — та область, где ИИ-агент ведёт себя предсказуемее всего, и причина простая: у правильного ответа всегда есть источник. Номер счёта, дата, сумма, ИНН контрагента лежат в самом документе, поэтому любое утверждение системы можно проверить, сопоставив с изображением. В диалоге с клиентом такой опоры нет, и там ошибка звучит так же уверенно, как правильный ответ.
Из этого следует и главное ограничение. Агент хорошо делает то, что сводится к «найти в документе и сверить с системой», и плохо — то, что требует знания договорённостей вне текста. Он не знает, что с этим поставщиком вы договорились об отсрочке устно, что позиция «крепёж монтажный» в его прайсе — это ваш артикул 3-105, и что акт подписан задним числом по просьбе прораба. Всё это остаётся людям, и именно здесь проходит граница проекта.
Ниже — четыре действия, из которых складывается работа агента с документами, честные цифры качества по типам полей, российские инструменты, которыми это делают, и расчёт на потоке 1 200 документов в месяц с разбивкой по часам и рублям.
Четыре действия, из которых состоит работа
«Агент для документов» — это не одна функция, а четыре, и они разные по надёжности и по цене. Полезно понимать, за что именно вы платите в смете: первые два действия делает практически любой инструмент распознавания, третье и четвёртое — то, ради чего вообще нужен агент.
- 11. Классификация: что это за бумага
Система определяет тип документа до того, как что-то извлекать: счёт, акт, товарная накладная, УПД, счёт-фактура, договор, приложение к договору, банковская выписка. На типовых формах это работает с точностью 97–99 %, и это самая дешёвая часть контура. Ошибки классификации дорогие: неверно определённый тип уводит документ в чужой маршрут согласования, поэтому спорные случаи всегда отправляются человеку, а не угадываются.
- 22. Извлечение полей: шапка и таблица
Из шапки берутся номер, дата, стороны, ИНН, суммы и ставки НДС; из табличной части — позиции, количество, цена, сумма по строке. У каждого поля есть оценка уверенности, и она важнее среднего процента точности: поле с низкой уверенностью подсвечивается человеку, а не подставляется молча.
- 33. Сверка с учётной системой: превращение чужих данных в ваши
Извлечённые данные сопоставляются с тем, что уже есть: контрагент ищется по ИНН, документ привязывается к заказу или договору, суммы и количества сверяются с ожидаемыми. Здесь агент приносит основную пользу — он находит расхождения, которые человек при ручном вводе просто не заметит, потому что не будет открывать заказ ради проверки трёх цифр.
- 44. Поиск по архиву со ссылкой на источник
Ответ на вопрос «какая у нас отсрочка по этому поставщику» с указанием документа, страницы и пункта. Ответ без ссылки принимать нельзя: он не проверяем и потому бесполезен в любом споре. Три способа устроить такой поиск и цену каждого мы разбирали в статье про поиск по архиву договоров.
Горизонтальная схема из четырёх блоков со стрелками слева направо: «1. Классификация типа — 97–99 %», «2. Извлечение полей — шапка 95–99 %, таблица 90–97 %», «3. Сверка с учётной системой — контрагент по ИНН, привязка к заказу, сверка сумм», «4. Поиск по архиву — ответ со ссылкой на документ и пункт». От блоков 1 и 2 вниз отходят ответвления в общий лоток «на подтверждение человеку», от блока 3 — ответвление «расхождение: решает человек». Под схемой полоса «источник ответа всегда один — сам документ». Все подписи по-русски.
Число, которое система выставляет каждому извлечённому значению отдельно: насколько она уверена именно в этой дате, именно в этой сумме. Порог задаётся вами: всё, что ниже, подсвечивается на проверку. Средняя точность по документу без этих оценок бесполезна — она не говорит, какое из тридцати полей проверять.
Реалистичное качество: что надёжно, а что нет
Цифры ниже — ориентиры для типовых форм нормального качества: электронный PDF или ровный скан 300 точек на дюйм. На фотографии с телефона, на копии третьего поколения и на форме с рукописными правками они падают, и падают сильно. Заявленная вендором точность к вашей пачке не относится, пока не сделан замер на вашей выборке — методика замера за три дня описана в статье про реальную точность распознавания.
| Задача | Насколько надёжно | Что остаётся человеку |
|---|---|---|
| Определить тип документа | 97–99 % на типовых формах | Разбор неопознанных — обычно 1–3 % пачки |
| Извлечь шапку: номер, дата, контрагент, сумма, НДС | 95–99 % по полю | Подтверждение подсвеченных полей, 15–20 секунд на документ |
| Извлечь табличную часть: позиции, количество, цены | 90–97 %, ниже на многостраничных и мелком шрифте | Проверка итога и расхождений по сумме |
| Сопоставить контрагента со справочником | Надёжно по ИНН, ненадёжно по названию | Решение по новым контрагентам — всегда человек |
| Сопоставить номенклатуру поставщика с вашей | 60–85 % без ручного справочника соответствий | Заведение новых позиций — только человеком |
| Сверить документ с заказом и договором | Надёжно: это сравнение чисел, а не интерпретация | Решение, что делать с найденным расхождением |
| Найти документ и пункт в архиве со ссылкой | Надёжно, если архив подготовлен и размечен | Юридическая оценка найденного |
| Прочитать рукописную пометку на полях | Практически нет | Всё: такие документы идут отдельным маршрутом |
Самая проблемная строка — предпоследняя по важности и первая по числу сорванных проектов: сопоставление номенклатуры. «Труба стальная ВГП 25х3.2» у поставщика и «Труба ВГП Ду25» у вас — это одна позиция, но об этом знает кладовщик, а не система. Без ручного справочника соответствий, который наполняется первые два-три месяца, точность здесь остаётся низкой при любом инструменте. Механику разбирали отдельно — в статье про обработку первички без ручного ввода.
Если система подсвечивает половину полей в каждом документе, человек через неделю перестаёт их читать и нажимает подтверждение не глядя. Формально контроль есть, фактически его нет, а ошибки уходят в учёт с вашей подписью. Порог уверенности настраивается так, чтобы на проверку попадало 2–4 поля на документ, а не двенадцать; если система не умеет так, это не контроль качества, а его имитация.
Шаг подтверждения: 18 секунд вместо 8 минут
Ключевая экономия возникает не там, где её обычно ищут. Ручной ввод шапки и строк — это только 3 минуты из 8, которые уходят на документ на самом деле. Остальные 5 минут — сверка с заказом, поиск позиции в справочнике номенклатуры и раскладка в архив. Агент снимает почти всю эту часть, а не только набор цифр.
| Операция | Вручную | С агентом |
|---|---|---|
| Ввод шапки и строк документа | 3 минуты | 0: подставлено, подсвечено 2–4 поля |
| Сверка с заказом и договором, разбор расхождений | 2,5 минуты | 0 на совпадающих, 3 минуты на 12 % расхождений |
| Поиск и сопоставление номенклатуры | 1,5 минуты | 0 на известных позициях, новые — человеку |
| Раскладка в архив, переименование, привязка к контрагенту | 1 минута | 0: делается автоматически при проведении |
| Подтверждение подсвеченных полей | — | 18 секунд |
| Итого на документ в среднем по пачке | 8 минут | 1,2 минуты |
1,2 минуты — это средняя по всей пачке, а не время «хорошего» документа. Она складывается из трёх слагаемых: 18 секунд подтверждения на каждом документе, 6 минут ручного разбора на тех 9 %, которые система вернула как непригодные, и 3 минуты на тех 12 %, где нашлось расхождение с заказом и решение принимает человек. Проверить арифметику можно на месячном объёме — что и сделано ниже.
Сравнение двух горизонтальных полос одинакового масштаба, ось в минутах. Верхняя полоса «Вручную — 8 минут» с четырьмя подписанными сегментами: ввод шапки и строк 3, сверка с заказом 2,5, сопоставление номенклатуры 1,5, раскладка в архив 1. Нижняя полоса «С агентом — 1,2 минуты в среднем по пачке» с тремя сегментами: подтверждение 18 секунд на каждом документе, ручной разбор 6 минут на 9 % пачки, разбор расхождений 3 минуты на 12 % пачки. Справа подпись «на 1 200 документов: 160 часов против 24 часов».
Расчёт на 1 200 документов в месяц
Модельная компания: оптовая торговля, 1 200 входящих документов в месяц — счета, акты, товарные накладные и УПД от 90 поставщиков. Половина приходит в PDF по почте, остальные сканируются. Полная ставка бухгалтера на первичке — 900 ₽/час. Считаем два блока: сколько труда снимается и во что обходится эксплуатация.
Внедрение такого контура в модельном проекте — 420 000 ₽: подключение источников документов, настройка типов и шаблонов, интеграция с учётной системой, справочник соответствий, интерфейс подтверждения и приёмка на вашей выборке. При чистой экономии 80 000 ₽ в месяц вложение возвращается за 5,3 месяца, что попадает в типичную для верно выбранного процесса вилку 3–6 месяцев.
Двухосевой график на 12 месяцев. Сплошная линия — накопленная чистая экономия по 80 000 ₽ в месяц: 80 000, 160 000, 240 000, 320 000, 400 000, 480 000 и далее. Горизонтальная штриховая линия на отметке 420 000 ₽ подписана «внедрение». Точка пересечения между пятым и шестым месяцем выделена и подписана «окупаемость — 5,3 месяца». Ось X — месяцы, ось Y — рубли. Отдельной подписью в углу: «после окупаемости 80 000 ₽/мес, или 960 000 ₽ в год».
Чем это делают в России
Стек сложился и на сентябрь 2026 года выглядит так. Выбор между инструментами почти всегда сводится не к точности, а к тому, где документ живёт дальше: если конечная точка — 1С, выигрывает то, что встроено в 1С; если поток разнородный и большой, выигрывают специализированные платформы.
| Инструмент | Что берёт | На что смотреть |
|---|---|---|
| 1С:Распознавание первичных документов | Счета, акты, накладные, УПД сразу в конфигурацию 1С | Плюс в интеграции, минус в гибкости на нестандартных формах поставщиков |
| Content AI: ContentReader PDF, ContentCapture | Поточный ввод, гибкие шаблоны, большие объёмы | Российский преемник ABBYY; цена считается от объёма страниц — считать по своей пачке |
| Smart Engines | УПД, УКД, счета-фактуры, акты, КС-2 и КС-3, ТОРГ-12 и 13, банковские выписки, платёжки, ГТД | Сильная сторона — отраслевые формы и документы плохого качества |
| Directum | Документооборот с распознаванием и маршрутами согласования | Это прежде всего система документооборота, распознавание — часть контура |
Отдельно стоит разобраться с моделью оплаты, потому что она сильнее влияет на итоговую сумму, чем разница в точности между инструментами. Платить можно за страницы, за документы, за рабочие места или за поток в месяц, и на одной и той же пачке разброс между этими схемами доходит до полутора раз. Практический совет один: считать не по прайсу, а по своей переписи — 1 200 документов при среднем объёме 1,4 страницы дают 1 680 страниц в месяц, и именно это число надо подставлять во все предложения. Заодно проверьте, входят ли в цену повторные прогоны: при отладке шаблонов одну и ту же пачку прогоняют по пять-шесть раз, и в постраничной модели это внезапно превращается в отдельную статью расходов.
Документ, пришедший по электронному документообороту, уже структурирован: поля известны, подпись проверена, распознавать нечего. Поэтому правильный порядок работ — сначала перевести на ЭДО тех поставщиков, кто на это готов, и только оставшуюся часть пачки отдавать распознаванию. Что нужно для старта ЭДО и сколько это занимает, разобрано в статье о том, как устроен ЭДО. Сравнение инструментов по типам документов — в подборке по распознаванию первички.
Абстрактный нарисованный экран без реальных интерфейсов и брендов, разделён пополам. Слева — образ товарной накладной с выделенными рамками областей. Справа — список извлечённых полей: номер, дата, поставщик, ИНН, сумма без НДС, НДС, итого, позиции. Три поля обведены и помечены как требующие подтверждения: «дата», «сумма по строке 4», «новая позиция номенклатуры». Внизу панель с кнопками «подтвердить», «исправить», «вернуть на разбор» и счётчиком «18 секунд на документ». Сбоку колонка «сверка с заказом: расхождение по количеству — 2 шт». Все подписи по-русски.
Сроки: пять этапов за 8–10 недель
Порядок этапов важнее их содержания. Проекты, которые начинают с настройки шаблонов, к шестой неделе обнаруживают, что треть документов вообще не доезжает до системы: они лежат в личной почте снабженца или приходят фотографией в мессенджере прораба. Поэтому приём документов настраивается раньше, чем извлечение полей.
- 1Недели 1–2. Перепись пачки и замер точности
Считаем шесть цифр: сколько документов в месяц, каких типов, от скольких поставщиков, в каком виде приходят, сколько минут занимает один и какая доля уже идёт по ЭДО. Параллельно делается замер на выборке в 200 своих документов. Результат этапа — таблица, из которой видно, какие типы берутся в первую очередь, а какие не берутся вообще.
- 2Недели 2–4. Приём и классификация
Настраиваются источники: отдельный почтовый ящик, папка сканера, выгрузка из системы ЭДО, приём из мессенджера. Документ регистрируется, получает тип и попадает в очередь. Результат — поток доезжает до системы сам, без ручного перекладывания файлов, и уже видно реальное распределение типов.
- 3Недели 3–6. Извлечение полей и справочники
Шаблоны на основные формы, пороги уверенности по каждому полю, справочник контрагентов по ИНН и начало справочника соответствий номенклатуры. Это самый долгий этап, и он же самый недооценённый в сметах: справочник соответствий наполняется по фактическим документам и живёт потом постоянно.
- 4Недели 5–8. Сверка и проведение
Привязка документа к заказу и договору, сверка сумм и количеств, маршрут для расхождений, проведение в учётной системе. Результат — документ проходит путь от приёма до проводки, а спорные случаи попадают человеку с уже подсвеченным расхождением.
- 5Недели 8–10. Приёмка и параллельный период
Две-три недели поток идёт и через систему, и через прежний порядок; результаты сравниваются, считаются доля возвратов и фактическое время на документ. Переход происходит по метрике, а не по календарю: пока доля возвратов выше согласованной, старый порядок не отключается.
Что потребуется от вас
Половина сорванных сроков в таких проектах приходится не на разработку, а на ожидание того, что должен дать заказчик. Список короткий, и его лучше собрать до подписания договора, чем на третьей неделе.
- Выборка в 200 документов — сплошная, за две-три подряд идущие недели, а не отобранные «хорошие» экземпляры. Именно на ней измеряется точность и фиксируется критерий приёмки; выборка, собранная исполнителем после разработки, всегда подстраивается под то, что получилось.
- Доступ к учётной системе через методы, а не полный. Нужны чтение справочников и заказов, создание документа и добавление комментария. Плюс тестовый контур с обезличенными данными: отлаживать проведение документов на боевой базе нельзя.
- Порядок в справочнике контрагентов. Дубли и записи без ИНН — самая частая причина, по которой сопоставление не работает. Чистка справочника занимает от нескольких дней до пары недель и делается раньше, чем настраиваются шаблоны.
- Владелец процесса на вашей стороне. Бухгалтер или руководитель учёта, который решает спорные случаи и принимает решение, что считать корректным заполнением. Проекты без такого человека останавливаются на этапе сверки: некому сказать, кто прав, когда документ и заказ расходятся.
- Регламент приёма на полстраницы. Кто, куда и в каком виде кладёт документ. Это самый дешёвый пункт списка и один из самых результативных: он сокращает долю возвратов на ручной разбор сильнее, чем смена инструмента распознавания.
Где агент не помогает
Экономия из расчёта выше держится на трёх условиях: документы типовые, их много, и они существуют в электронном виде. Стоит убрать любое из трёх — арифметика ломается, причём чаще всего необратимо.
- Единичные нетиповые формы. Пять актов в месяц по индивидуальному шаблону каждого заказчика — это не задача для распознавания. Настройка шаблона под форму стоит дороже, чем годовой ручной ввод по ней, и окупается примерно от 60–80 документов одной формы в месяц.
- Документов нет в электронном виде. Если бумага приходит почтой, лежит в папках и никем не сканируется, первым проектом должен быть не агент, а сканер и полстраницы регламента: кто, когда и куда кладёт файл. Без этого шага автоматизировать нечего, а разговор о моделях преждевременен.
- Решение зависит от договорённостей вне текста. Принять акт с расхождением по количеству, потому что «остаток довезут в четверг», подписать закрывающие раньше факта, зачесть аванс не по тому договору — всё это решения, у которых нет источника в документе. Агент может только подсветить расхождение, решает человек, и это не временное ограничение.
- Маленький поток. Постоянная часть эксплуатации — лицензии, сопровождение, ведение справочников — почти не зависит от объёма. В нашей модели это 35 800 ₽ из 42 400 ₽ в месяц. На потоке 200 документов вместо 1 200 экономия труда падает в шесть раз, а эта часть расходов остаётся прежней, и проект уходит в минус.
И последнее. Порядок работ здесь важнее выбора инструмента. Сначала — перепись пачки: сколько документов, каких типов, от скольких поставщиков, в каком виде приходят, сколько минут занимает один. Потом — перевод на ЭДО всех, кто готов. И только оставшийся поток отдаётся распознаванию и агенту. Проекты, начатые с выбора вендора, а не с переписи, обычно заканчиваются тем, что купленная система обрабатывает треть пачки, а бухгалтер продолжает вводить остальное руками — как и до внедрения.
У ответа по документу всегда есть источник. Если система не может показать, откуда взяла число, она не обрабатывает документ, а пересказывает его.
