Документы — та область, где ИИ-агент ведёт себя предсказуемее всего, и причина простая: у правильного ответа всегда есть источник. Номер счёта, дата, сумма, ИНН контрагента лежат в самом документе, поэтому любое утверждение системы можно проверить, сопоставив с изображением. В диалоге с клиентом такой опоры нет, и там ошибка звучит так же уверенно, как правильный ответ.

Из этого следует и главное ограничение. Агент хорошо делает то, что сводится к «найти в документе и сверить с системой», и плохо — то, что требует знания договорённостей вне текста. Он не знает, что с этим поставщиком вы договорились об отсрочке устно, что позиция «крепёж монтажный» в его прайсе — это ваш артикул 3-105, и что акт подписан задним числом по просьбе прораба. Всё это остаётся людям, и именно здесь проходит граница проекта.

Ниже — четыре действия, из которых складывается работа агента с документами, честные цифры качества по типам полей, российские инструменты, которыми это делают, и расчёт на потоке 1 200 документов в месяц с разбивкой по часам и рублям.

Четыре действия, из которых состоит работа

«Агент для документов» — это не одна функция, а четыре, и они разные по надёжности и по цене. Полезно понимать, за что именно вы платите в смете: первые два действия делает практически любой инструмент распознавания, третье и четвёртое — то, ради чего вообще нужен агент.

  1. 1
    1. Классификация: что это за бумага

    Система определяет тип документа до того, как что-то извлекать: счёт, акт, товарная накладная, УПД, счёт-фактура, договор, приложение к договору, банковская выписка. На типовых формах это работает с точностью 97–99 %, и это самая дешёвая часть контура. Ошибки классификации дорогие: неверно определённый тип уводит документ в чужой маршрут согласования, поэтому спорные случаи всегда отправляются человеку, а не угадываются.

  2. 2
    2. Извлечение полей: шапка и таблица

    Из шапки берутся номер, дата, стороны, ИНН, суммы и ставки НДС; из табличной части — позиции, количество, цена, сумма по строке. У каждого поля есть оценка уверенности, и она важнее среднего процента точности: поле с низкой уверенностью подсвечивается человеку, а не подставляется молча.

  3. 3
    3. Сверка с учётной системой: превращение чужих данных в ваши

    Извлечённые данные сопоставляются с тем, что уже есть: контрагент ищется по ИНН, документ привязывается к заказу или договору, суммы и количества сверяются с ожидаемыми. Здесь агент приносит основную пользу — он находит расхождения, которые человек при ручном вводе просто не заметит, потому что не будет открывать заказ ради проверки трёх цифр.

  4. 4
    4. Поиск по архиву со ссылкой на источник

    Ответ на вопрос «какая у нас отсрочка по этому поставщику» с указанием документа, страницы и пункта. Ответ без ссылки принимать нельзя: он не проверяем и потому бесполезен в любом споре. Три способа устроить такой поиск и цену каждого мы разбирали в статье про поиск по архиву договоров.

схема процессаii-agent-dlya-raboty-s-dokumentami--01
Схема четырёх действий агента: классификация, извлечение, сверка с учётом, поиск по архиву

Горизонтальная схема из четырёх блоков со стрелками слева направо: «1. Классификация типа — 97–99 %», «2. Извлечение полей — шапка 95–99 %, таблица 90–97 %», «3. Сверка с учётной системой — контрагент по ИНН, привязка к заказу, сверка сумм», «4. Поиск по архиву — ответ со ссылкой на документ и пункт». От блоков 1 и 2 вниз отходят ответвления в общий лоток «на подтверждение человеку», от блока 3 — ответвление «расхождение: решает человек». Под схемой полоса «источник ответа всегда один — сам документ». Все подписи по-русски.

Первые два действия делает любое распознавание, третье и четвёртое — то, ради чего нужен агент
Что это значитОценка уверенности по полю

Число, которое система выставляет каждому извлечённому значению отдельно: насколько она уверена именно в этой дате, именно в этой сумме. Порог задаётся вами: всё, что ниже, подсвечивается на проверку. Средняя точность по документу без этих оценок бесполезна — она не говорит, какое из тридцати полей проверять.

Реалистичное качество: что надёжно, а что нет

Цифры ниже — ориентиры для типовых форм нормального качества: электронный PDF или ровный скан 300 точек на дюйм. На фотографии с телефона, на копии третьего поколения и на форме с рукописными правками они падают, и падают сильно. Заявленная вендором точность к вашей пачке не относится, пока не сделан замер на вашей выборке — методика замера за три дня описана в статье про реальную точность распознавания.

ЗадачаНасколько надёжноЧто остаётся человеку
Определить тип документа97–99 % на типовых формахРазбор неопознанных — обычно 1–3 % пачки
Извлечь шапку: номер, дата, контрагент, сумма, НДС95–99 % по полюПодтверждение подсвеченных полей, 15–20 секунд на документ
Извлечь табличную часть: позиции, количество, цены90–97 %, ниже на многостраничных и мелком шрифтеПроверка итога и расхождений по сумме
Сопоставить контрагента со справочникомНадёжно по ИНН, ненадёжно по названиюРешение по новым контрагентам — всегда человек
Сопоставить номенклатуру поставщика с вашей60–85 % без ручного справочника соответствийЗаведение новых позиций — только человеком
Сверить документ с заказом и договоромНадёжно: это сравнение чисел, а не интерпретацияРешение, что делать с найденным расхождением
Найти документ и пункт в архиве со ссылкойНадёжно, если архив подготовлен и размеченЮридическая оценка найденного
Прочитать рукописную пометку на поляхПрактически нетВсё: такие документы идут отдельным маршрутом

Самая проблемная строка — предпоследняя по важности и первая по числу сорванных проектов: сопоставление номенклатуры. «Труба стальная ВГП 25х3.2» у поставщика и «Труба ВГП Ду25» у вас — это одна позиция, но об этом знает кладовщик, а не система. Без ручного справочника соответствий, который наполняется первые два-три месяца, точность здесь остаётся низкой при любом инструменте. Механику разбирали отдельно — в статье про обработку первички без ручного ввода.

Подтверждение не должно превращаться в кнопку «ОК»

Если система подсвечивает половину полей в каждом документе, человек через неделю перестаёт их читать и нажимает подтверждение не глядя. Формально контроль есть, фактически его нет, а ошибки уходят в учёт с вашей подписью. Порог уверенности настраивается так, чтобы на проверку попадало 2–4 поля на документ, а не двенадцать; если система не умеет так, это не контроль качества, а его имитация.

Шаг подтверждения: 18 секунд вместо 8 минут

Ключевая экономия возникает не там, где её обычно ищут. Ручной ввод шапки и строк — это только 3 минуты из 8, которые уходят на документ на самом деле. Остальные 5 минут — сверка с заказом, поиск позиции в справочнике номенклатуры и раскладка в архив. Агент снимает почти всю эту часть, а не только набор цифр.

ОперацияВручнуюС агентом
Ввод шапки и строк документа3 минуты0: подставлено, подсвечено 2–4 поля
Сверка с заказом и договором, разбор расхождений2,5 минуты0 на совпадающих, 3 минуты на 12 % расхождений
Поиск и сопоставление номенклатуры1,5 минуты0 на известных позициях, новые — человеку
Раскладка в архив, переименование, привязка к контрагенту1 минута0: делается автоматически при проведении
Подтверждение подсвеченных полей18 секунд
Итого на документ в среднем по пачке8 минут1,2 минуты

1,2 минуты — это средняя по всей пачке, а не время «хорошего» документа. Она складывается из трёх слагаемых: 18 секунд подтверждения на каждом документе, 6 минут ручного разбора на тех 9 %, которые система вернула как непригодные, и 3 минуты на тех 12 %, где нашлось расхождение с заказом и решение принимает человек. Проверить арифметику можно на месячном объёме — что и сделано ниже.

сравнениеii-agent-dlya-raboty-s-dokumentami--02
Сравнение времени на документ: 8 минут вручную против 1,2 минуты с агентом

Сравнение двух горизонтальных полос одинакового масштаба, ось в минутах. Верхняя полоса «Вручную — 8 минут» с четырьмя подписанными сегментами: ввод шапки и строк 3, сверка с заказом 2,5, сопоставление номенклатуры 1,5, раскладка в архив 1. Нижняя полоса «С агентом — 1,2 минуты в среднем по пачке» с тремя сегментами: подтверждение 18 секунд на каждом документе, ручной разбор 6 минут на 9 % пачки, разбор расхождений 3 минуты на 12 % пачки. Справа подпись «на 1 200 документов: 160 часов против 24 часов».

Ввод цифр — только 3 минуты из 8; остальное снимает сверка, а не распознавание

Расчёт на 1 200 документов в месяц

Модельная компания: оптовая торговля, 1 200 входящих документов в месяц — счета, акты, товарные накладные и УПД от 90 поставщиков. Половина приходит в PDF по почте, остальные сканируются. Полная ставка бухгалтера на первичке — 900 ₽/час. Считаем два блока: сколько труда снимается и во что обходится эксплуатация.

Труд: до и после, 1 200 документов в месяц
Вручную: 1 200 документов × 8 минут160 часов/мес
То же в деньгах по ставке 900 ₽/час144 000 ₽/мес
С агентом — подтверждение: 1 200 × 18 секунд6 часов/мес
С агентом — ручной разбор возвратов: 9 % — 108 документов × 6 минут10,8 часа/мес
С агентом — разбор расхождений: 12 % — 144 документа × 3 минуты7,2 часа/мес
Итого с агентом: 24 часа × 900 ₽/час21 600 ₽/мес
ИтогоСнимается 136 часов работы в месяц, или 122 400 ₽ по полной ставке
Эксплуатация: во что обходится тот же поток
Распознавание: 1 200 документов × 1,4 страницы × 2,5 ₽4 200 ₽/мес
Извлечение полей моделью и сверка с учётной системой: 1 200 × 2 ₽2 400 ₽/мес
Лицензии, инфраструктура, хранение образов документов12 000 ₽/мес
Сопровождение подрядчиком: правки шаблонов, разбор сбоев20 000 ₽/мес
Выборочный контроль: 36 документов × 2 минуты × 900 ₽/час1 100 ₽/мес
Ведение справочника контрагентов и соответствий номенклатуры: 3 часа2 700 ₽/мес
Итого42 400 ₽/мес. Чистая экономия — 122 400 − 42 400 = 80 000 ₽/мес

Внедрение такого контура в модельном проекте — 420 000 ₽: подключение источников документов, настройка типов и шаблонов, интеграция с учётной системой, справочник соответствий, интерфейс подтверждения и приёмка на вашей выборке. При чистой экономии 80 000 ₽ в месяц вложение возвращается за 5,3 месяца, что попадает в типичную для верно выбранного процесса вилку 3–6 месяцев.

графикii-agent-dlya-raboty-s-dokumentami--03
График накопленной экономии: точка окупаемости 420 000 ₽ на 5,3 месяца

Двухосевой график на 12 месяцев. Сплошная линия — накопленная чистая экономия по 80 000 ₽ в месяц: 80 000, 160 000, 240 000, 320 000, 400 000, 480 000 и далее. Горизонтальная штриховая линия на отметке 420 000 ₽ подписана «внедрение». Точка пересечения между пятым и шестым месяцем выделена и подписана «окупаемость — 5,3 месяца». Ось X — месяцы, ось Y — рубли. Отдельной подписью в углу: «после окупаемости 80 000 ₽/мес, или 960 000 ₽ в год».

Вложение разовое, экономия накапливается по 80 000 ₽ в месяц

Чем это делают в России

Стек сложился и на сентябрь 2026 года выглядит так. Выбор между инструментами почти всегда сводится не к точности, а к тому, где документ живёт дальше: если конечная точка — 1С, выигрывает то, что встроено в 1С; если поток разнородный и большой, выигрывают специализированные платформы.

ИнструментЧто берётНа что смотреть
1С:Распознавание первичных документовСчета, акты, накладные, УПД сразу в конфигурацию 1СПлюс в интеграции, минус в гибкости на нестандартных формах поставщиков
Content AI: ContentReader PDF, ContentCaptureПоточный ввод, гибкие шаблоны, большие объёмыРоссийский преемник ABBYY; цена считается от объёма страниц — считать по своей пачке
Smart EnginesУПД, УКД, счета-фактуры, акты, КС-2 и КС-3, ТОРГ-12 и 13, банковские выписки, платёжки, ГТДСильная сторона — отраслевые формы и документы плохого качества
DirectumДокументооборот с распознаванием и маршрутами согласованияЭто прежде всего система документооборота, распознавание — часть контура

Отдельно стоит разобраться с моделью оплаты, потому что она сильнее влияет на итоговую сумму, чем разница в точности между инструментами. Платить можно за страницы, за документы, за рабочие места или за поток в месяц, и на одной и той же пачке разброс между этими схемами доходит до полутора раз. Практический совет один: считать не по прайсу, а по своей переписи — 1 200 документов при среднем объёме 1,4 страницы дают 1 680 страниц в месяц, и именно это число надо подставлять во все предложения. Заодно проверьте, входят ли в цену повторные прогоны: при отладке шаблонов одну и ту же пачку прогоняют по пять-шесть раз, и в постраничной модели это внезапно превращается в отдельную статью расходов.

Самый дешёвый документ — тот, который не надо распознавать

Документ, пришедший по электронному документообороту, уже структурирован: поля известны, подпись проверена, распознавать нечего. Поэтому правильный порядок работ — сначала перевести на ЭДО тех поставщиков, кто на это готов, и только оставшуюся часть пачки отдавать распознаванию. Что нужно для старта ЭДО и сколько это занимает, разобрано в статье о том, как устроен ЭДО. Сравнение инструментов по типам документов — в подборке по распознаванию первички.

разбор экранаii-agent-dlya-raboty-s-dokumentami--04
Нарисованный экран проверки документа: слева образ, справа поля, три подсвечены

Абстрактный нарисованный экран без реальных интерфейсов и брендов, разделён пополам. Слева — образ товарной накладной с выделенными рамками областей. Справа — список извлечённых полей: номер, дата, поставщик, ИНН, сумма без НДС, НДС, итого, позиции. Три поля обведены и помечены как требующие подтверждения: «дата», «сумма по строке 4», «новая позиция номенклатуры». Внизу панель с кнопками «подтвердить», «исправить», «вернуть на разбор» и счётчиком «18 секунд на документ». Сбоку колонка «сверка с заказом: расхождение по количеству — 2 шт». Все подписи по-русски.

На проверку выносится 2–4 поля, а не весь документ — иначе контроль превращается в формальность

Сроки: пять этапов за 8–10 недель

Порядок этапов важнее их содержания. Проекты, которые начинают с настройки шаблонов, к шестой неделе обнаруживают, что треть документов вообще не доезжает до системы: они лежат в личной почте снабженца или приходят фотографией в мессенджере прораба. Поэтому приём документов настраивается раньше, чем извлечение полей.

  1. 1
    Недели 1–2. Перепись пачки и замер точности

    Считаем шесть цифр: сколько документов в месяц, каких типов, от скольких поставщиков, в каком виде приходят, сколько минут занимает один и какая доля уже идёт по ЭДО. Параллельно делается замер на выборке в 200 своих документов. Результат этапа — таблица, из которой видно, какие типы берутся в первую очередь, а какие не берутся вообще.

  2. 2
    Недели 2–4. Приём и классификация

    Настраиваются источники: отдельный почтовый ящик, папка сканера, выгрузка из системы ЭДО, приём из мессенджера. Документ регистрируется, получает тип и попадает в очередь. Результат — поток доезжает до системы сам, без ручного перекладывания файлов, и уже видно реальное распределение типов.

  3. 3
    Недели 3–6. Извлечение полей и справочники

    Шаблоны на основные формы, пороги уверенности по каждому полю, справочник контрагентов по ИНН и начало справочника соответствий номенклатуры. Это самый долгий этап, и он же самый недооценённый в сметах: справочник соответствий наполняется по фактическим документам и живёт потом постоянно.

  4. 4
    Недели 5–8. Сверка и проведение

    Привязка документа к заказу и договору, сверка сумм и количеств, маршрут для расхождений, проведение в учётной системе. Результат — документ проходит путь от приёма до проводки, а спорные случаи попадают человеку с уже подсвеченным расхождением.

  5. 5
    Недели 8–10. Приёмка и параллельный период

    Две-три недели поток идёт и через систему, и через прежний порядок; результаты сравниваются, считаются доля возвратов и фактическое время на документ. Переход происходит по метрике, а не по календарю: пока доля возвратов выше согласованной, старый порядок не отключается.

Что потребуется от вас

Половина сорванных сроков в таких проектах приходится не на разработку, а на ожидание того, что должен дать заказчик. Список короткий, и его лучше собрать до подписания договора, чем на третьей неделе.

  • Выборка в 200 документов — сплошная, за две-три подряд идущие недели, а не отобранные «хорошие» экземпляры. Именно на ней измеряется точность и фиксируется критерий приёмки; выборка, собранная исполнителем после разработки, всегда подстраивается под то, что получилось.
  • Доступ к учётной системе через методы, а не полный. Нужны чтение справочников и заказов, создание документа и добавление комментария. Плюс тестовый контур с обезличенными данными: отлаживать проведение документов на боевой базе нельзя.
  • Порядок в справочнике контрагентов. Дубли и записи без ИНН — самая частая причина, по которой сопоставление не работает. Чистка справочника занимает от нескольких дней до пары недель и делается раньше, чем настраиваются шаблоны.
  • Владелец процесса на вашей стороне. Бухгалтер или руководитель учёта, который решает спорные случаи и принимает решение, что считать корректным заполнением. Проекты без такого человека останавливаются на этапе сверки: некому сказать, кто прав, когда документ и заказ расходятся.
  • Регламент приёма на полстраницы. Кто, куда и в каком виде кладёт документ. Это самый дешёвый пункт списка и один из самых результативных: он сокращает долю возвратов на ручной разбор сильнее, чем смена инструмента распознавания.

Где агент не помогает

Экономия из расчёта выше держится на трёх условиях: документы типовые, их много, и они существуют в электронном виде. Стоит убрать любое из трёх — арифметика ломается, причём чаще всего необратимо.

  • Единичные нетиповые формы. Пять актов в месяц по индивидуальному шаблону каждого заказчика — это не задача для распознавания. Настройка шаблона под форму стоит дороже, чем годовой ручной ввод по ней, и окупается примерно от 60–80 документов одной формы в месяц.
  • Документов нет в электронном виде. Если бумага приходит почтой, лежит в папках и никем не сканируется, первым проектом должен быть не агент, а сканер и полстраницы регламента: кто, когда и куда кладёт файл. Без этого шага автоматизировать нечего, а разговор о моделях преждевременен.
  • Решение зависит от договорённостей вне текста. Принять акт с расхождением по количеству, потому что «остаток довезут в четверг», подписать закрывающие раньше факта, зачесть аванс не по тому договору — всё это решения, у которых нет источника в документе. Агент может только подсветить расхождение, решает человек, и это не временное ограничение.
  • Маленький поток. Постоянная часть эксплуатации — лицензии, сопровождение, ведение справочников — почти не зависит от объёма. В нашей модели это 35 800 ₽ из 42 400 ₽ в месяц. На потоке 200 документов вместо 1 200 экономия труда падает в шесть раз, а эта часть расходов остаётся прежней, и проект уходит в минус.

И последнее. Порядок работ здесь важнее выбора инструмента. Сначала — перепись пачки: сколько документов, каких типов, от скольких поставщиков, в каком виде приходят, сколько минут занимает один. Потом — перевод на ЭДО всех, кто готов. И только оставшийся поток отдаётся распознаванию и агенту. Проекты, начатые с выбора вендора, а не с переписи, обычно заканчиваются тем, что купленная система обрабатывает треть пачки, а бухгалтер продолжает вводить остальное руками — как и до внедрения.

У ответа по документу всегда есть источник. Если система не может показать, откуда взяла число, она не обрабатывает документ, а пересказывает его.