Живых решений для распознавания российской первички на сентябрь 2026 года четыре, и выбирают между ними не по точности. Content AI — преемник линейки ABBYY: ContentReader PDF занял место FineReader, ContentCapture — место FlexiCapture. Smart Engines — движок под встраивание, с готовыми моделями под УПД, счета-фактуры, ТОРГ-12 и ТОРГ-13, КС-2 и КС-3, банковские выписки и ГТД, работающий без облака. Directum — интеллектуальный ввод внутри документооборота с маршрутами согласования. 1С:Распознавание первичных документов — штатный сервис для тех, у кого учёт и так в 1С.

Разница между ними лежит в трёх плоскостях, и точность в этот список не входит: что именно вы покупаете — продукт или движок; как оно поставляется — коробкой, на ваш сервер или из облака; и по какой модели считается цена. Дальше — матрица «тип документа — решение», разбор моделей поставки с точки зрения 152-ФЗ, расчёт года владения на потоке 3 000 документов и три профиля компаний с готовым ответом для каждого.

Все расчёты модельные, арифметика открытая. Ставки одни во всей статье: бухгалтер 844 ₽/час — полная стоимость часа с взносами, надбавками и рабочим местом, посчитанная по методике полной стоимости часа сотрудника, — и инженер 3 000 ₽/час. Прайсы вендоров публично не раскрываются и зависят от объёма, числа рабочих мест и способа лицензирования, поэтому все цены даны порядком величин и требуют запроса под ваш поток.

Что стало с ABBYY и кто её преемник

Это первый вопрос почти на каждой встрече, и путаница вокруг него дорого обходится. ABBYY прекратила работу в России в 2022 году. Её продуктовую линейку продолжил Content AI, и соответствие прямое: ContentReader PDF — на месте FineReader, для чтения и преобразования документов на рабочем месте; ContentCapture — на месте FlexiCapture, то есть потоковый ввод с классификацией типов, шаблонами и очередью проверки.

Что это значитПродукт против движка

Продукт — это приложение с интерфейсом: рабочее место оператора, конструктор типов документов, готовая очередь проверки. Новый тип заводит аналитик, чинит администратор. Движок — библиотека, которую встраивают в вашу систему по программному интерфейсу: он отдаёт структурированный ответ и не рисует ни одного экрана. Новый тип заводит разработчик. Это разный предмет покупки, а не разные галочки в сравнительной таблице.

Практический смысл различия виден в смете. Движковая поставка сама по себе дешевле, но требует интеграции: кто-то должен принять ответ, сопоставить со справочниками, положить документ в учётную систему и нарисовать экран проверки. Это минимум 180 000 ₽ работы интегратора. Продуктовая поставка дороже в лицензии, но часть этой работы уже сделана. Если своего разработчика нет и подрядчика брать не планируете — продукт окажется дешевле в эксплуатации, несмотря на более высокий ценник.

сравнениеsravnenie-rossiyskih-ocr-resheniy--01
Четыре решения по четырём признакам: что покупаете, поставка, модель цены, кому подходит

Таблица-сравнение из четырёх колонок и четырёх строк. Колонки: «Content AI», «Smart Engines», «Directum», «1С:Распознавание первичных». Строки: «Что покупаете — продукт с рабочим местом / движок под встраивание / модуль документооборота / штатный сервис учётной системы»; «Поставка — свой сервер или коробка / свой сервер, вплоть до офлайна и устройства / свой сервер или облако / сервис 1С»; «Модель цены — лицензия с пакетом страниц / лицензия движка по числу распознаваний / лицензии платформы на пользователя / пакеты документов»; «Интеграция с 1С — через обвязку / через разработчика / через коннектор ECM / нулевая». Внизу общая подпись: «Точность на типовых формах у всех сопоставима — различия начинаются на нетиповых». Чертёжная графика, подписи по-русски.

Сравнивать надо предмет покупки и модель цены. Точность у всех четырёх на типовых формах сопоставима

Матрица «тип документа — решение»

Стандартный набор российской бухгалтерской первички закрывают все четыре: УПД и УКД, счета-фактуры, счета на оплату, акты выполненных работ, ТОРГ-12 и ТОРГ-13, банковские выписки и платёжные поручения. Различия начинаются там, где документ перестаёт быть типовым, — и это ровно та часть потока, которая съедает время бухгалтерии.

Тип документа1С:Распознавание первичныхContent AI ContentCaptureSmart EnginesDirectum
Счета на оплату, актыИз коробкиИз коробки плюс шаблоны под формыИз коробки, через программный интерфейсВ составе маршрута согласования
УПД, УКД, счета-фактурыИз коробкиИз коробкиИз коробки, готовая модельЕсть
ТОРГ-12 и ТОРГ-13Есть, чувствительно к качеству сканаЕстьИз коробки, готовая модельЕсть
КС-2 и КС-3Обычно нетНастраивается шаблономИз коробки, готовая модельНастраивается
Банковские выписки и платёжкиЕсть, но чаще берут выгрузку из клиент-банкаЕстьИз коробкиЕсть
ГТДНетНастраиваетсяИз коробкиНет
Паспорта и удостоверения личностиНетЕсть в отдельной поставкеЕсть, работает офлайн и на устройствеНет
Договоры и приложения к нимНетЧастично, шаблоном не решаетсяЧастичноИзвлечение условий отдельным модулем

Матрицу надо читать как рамку разговора, а не как спецификацию: состав готовых моделей у вендоров меняется, и перед выбором его нужно подтвердить актуальным описанием продукта и проверить на своих формах. Демонстрация на наборе вендора не говорит о вашем потоке ничего: разброс между двумя компаниями внутри одного типа документа больше, чем разброс между двумя вендорами на одной компании.

Отдельно про две нижние строки. Паспорта и другие удостоверения личности — это персональные данные специальной чувствительности, и здесь модель поставки важнее точности: распознавание в собственном контуре снимает вопрос передачи изображения наружу целиком. Мы разбирали это как отдельную задачу в материале про распознавание паспортов и 152-ФЗ. Договоры шаблоном не решаются ни у кого: у них нет устойчивой структуры, поля разбросаны по тексту, а приложения меняют условия основного документа — доля ручной доработки доходит до 45 %. Это задача языковой модели поверх текста, и мы вынесли её в отдельное решение извлечение данных из договоров.

Общая слабость всех четырёх, о которой не пишут в описаниях

Ни одно решение не читает связный рукописный текст в бухгалтерском качестве: там 40–70 % по полю и 0–15 % документов без единой правки. И ни одно не подставит правильную номенклатуру, если в вашем справочнике «Болт М8» лежит в четырёх вариантах написания. Сопоставление позиций живёт в справочниках, а не в распознавании — это отдельная строка сметы и отдельный человек, который справочники ведёт. Проект без такого человека деградирует независимо от выбранного вендора.

Модель поставки: коробка, свой сервер, облако

Первичка содержит фамилии подписантов, иногда данные представителей и паспортные реквизиты. Значит, отправка сканов во внешнее облако — это передача персональных данных обработчику со всеми требованиями 152-ФЗ. Модель поставки определяет, насколько тяжёлым получится этот разговор с юристом.

Модель поставкиЧто это значит на практикеЧто требуется по 152-ФЗЦена вопроса
Коробка на рабочем местеПриложение стоит у оператора, документы не покидают компьютер. Потокового ввода нет, каждый документ открывают рукамиНичего сверх обычного режима обработки внутри компанииДёшево, но не масштабируется: подходит для десятков документов, не для тысяч
Установка на своём сервереКонвейер целиком внутри вашего периметра, возможна работа вообще без выхода в интернетОбработка внутри компании: поручение обработки подрядчику нужно только на время внедрения и поддержкиДороже в лицензии и в железе, зато самый короткий разговор с юристом
Российское облако вендораИзображения уходят провайдеру, обратно приходят поля. Ничего не нужно администрироватьПоручение на обработку, локализация баз в России, перечень мер защиты у обработчикаДешевле на старте, требует договорной работы и ежегодной проверки
Зарубежное облакоТрансграничная передача персональных данныхОтдельный режим и уведомление; для большинства компаний нерабочий вариантНе рассматриваем

Практическое правило: если в потоке есть документы с персональными данными сверх фамилии подписанта — а это почти всегда так, — начинайте разговор с модели поставки, а не с точности. Договорную часть облачного варианта мы разобрали отдельно в материале про поручение обработки данных подрядчику. И отдельно уточняйте у вендора наличие продукта в реестре отечественного ПО: из российского происхождения это не следует автоматически, а для госзаказчика отсутствие в реестре — блокер.

Проверьте телеметрию и механизм обновлений

Установка «на своём сервере» не означает автоматически отсутствие внешнего трафика. Проверка лицензии, отправка статистики использования и загрузка обновлений моделей регулярно ходят наружу — и обнаруживается это обычно на аудите, через год после запуска. Спрашивайте на этапе выбора: какие исходящие соединения делает система, можно ли их отключить и что при этом перестанет работать. Ответ «мы уточним» на этот вопрос — сам по себе информация.

карта связейsravnenie-rossiyskih-ocr-resheniy--02
Три модели поставки: коробка, свой сервер и российское облако, с требованиями 152-ФЗ

Карта из трёх горизонтальных дорожек. Верхняя «Коробка на рабочем месте»: узлы «Документ» → «Компьютер оператора» → «Учётная система», периметр компании нарисован сплошной рамкой вокруг всех узлов, подпись «данные не выходят». Средняя «Свой сервер»: «Документ» → «Сервер распознавания» → «Учётная система», та же сплошная рамка, сбоку пунктирная стрелка наружу с подписью «проверка лицензии и обновления — уточнить и при необходимости отключить». Нижняя «Российское облако»: «Документ» → пунктирная стрелка за рамку периметра в узел «Облако вендора в РФ» → обратно «Поля» → «Учётная система», у стрелки подпись «поручение на обработку, локализация в РФ, меры защиты». Подписи по-русски, чертёжная графика.

Модель поставки определяет не только цену, но и объём договорной работы вокруг персональных данных

1С: что даёт штатный сервис и где он кончается

Если учёт целиком в 1С, самый короткий путь — штатный сервис 1С:Распознавание первичных документов: документ создаётся прямо в базе, без отдельного конвейера, без интеграции и без второго интерфейса для бухгалтера. Это его главное и недооценённое преимущество: нулевая стоимость интеграции, которая в отдельном конвейере стоит от 160 000 ₽ и половину срока проекта.

  • Что даёт: типовые счета, акты, УПД и счета-фактуры создаются документами базы, реквизиты подставляются из справочников, очередь проверки живёт внутри привычного интерфейса 1С.
  • Где кончается: ограниченный набор типов, невысокая терпимость к плохим сканам и фотографиям, слабое место — сопоставление номенклатуры при большом и неаккуратном справочнике.
  • Чего не умеет: КС-2 и КС-3, ГТД, паспорта, договоры, а также собственные правила проверки сложнее типовых — например, сверка суммы с заказом поставщику по вашему регламенту.
  • Что проверить до решения: прогнать свои худшие документы, а не лучшие. Ограничения вылезают именно на плохих сканах, редких формах и на номенклатуре — на аккуратной выборке их не видно.
  • Что учесть при доработанной конфигурации: если ваша 1С сильно кастомизирована, штатный сервис может конфликтовать с доработками — этот риск разобран в материале о том, дорабатывать 1С или делать внешнюю интеграцию.

Отдельный конвейер, наоборот, силён там, где типов документов много, юрлиц несколько, часть потока приходит фотографиями и нужны свои правила проверки. Способы связать его с учётом — обмен через типовые механизмы, внешняя обработка или прямой программный интерфейс — мы разобрали в материале про способы обмена с 1С; от выбранного способа зависит и цена интеграции, и то, кто будет её сопровождать.

Модель цены важнее прайса

Четыре решения считают деньги четырьмя разными способами, и на одном и том же потоке это даёт кратную разницу. Ниже — модели и объёмы, при которых каждая становится выгодной.

Модель ценыКто так считаетКогда выгоднаЧем опасна
Пакеты документов1С:Распознавание первичных документовМалые и средние объёмы: платите ровно за то, что обработалиНа большом потоке переменная часть растёт линейно и обгоняет фиксированную подписку
Лицензия с пакетом страницContent AIСтабильный предсказуемый поток, близкий к объёму пакетаНедобор пакета — переплата, перебор — доплата по повышенной ставке. Считайте по годовому потоку, а не по пиковому месяцу
Лицензия движка по числу распознаваний или по серверуSmart EnginesБольшие объёмы и закрытый контур: цена документа падает с ростом потокаНе включает интеграцию: работа разработчика от 180 000 ₽ идёт сверху
Лицензии платформы на пользователяDirectumКогда вы и так внедряете документооборот с маршрутами согласованияПокупать платформу ради одного распознавания дорого: вы платите за ECM, а нужен был ввод

Сравним две крайние стратегии на конкретных числах: штатный сервис 1С против отдельного конвейера. Модельная компания — оптовая торговля, 3 000 входящих документов в месяц, 1,5 страницы на документ, учёт в 1С:Управление торговлей. Проверка одного документа в очереди — полторы минуты, то есть 21,10 ₽ по ставке 844 ₽/час. Подписку на распознавание берём 30 000 ₽ в месяц — середину вилки 12 000–45 000 ₽ с запасом на рост потока.

Первый год владения на потоке 3 000 документов в месяц
Штатный сервис 1С: пакеты распознавания, 36 000 документов по 6 ₽216 000 ₽
Штатный сервис 1С: настройка силами своего специалиста, 30 часов × 3 000 ₽/час90 000 ₽
Штатный сервис 1С: очередь проверки 22 % — 660 док/мес × 21,10 ₽ × 12167 112 ₽
Отдельный конвейер: подписка на распознавание, 30 000 ₽/мес360 000 ₽
Отдельный конвейер: внедрение, настройка типов и интеграция с 1С350 000 ₽
Отдельный конвейер: поддержка 25 000 ₽/мес300 000 ₽
Отдельный конвейер: очередь проверки 15 % — 450 док/мес × 21,10 ₽ × 12113 940 ₽
Итого473 112 ₽ у штатного сервиса против 1 123 940 ₽ у конвейера в первый год. Во второй — 383 112 ₽ против 773 940 ₽

Точка равенства считается прямо. У штатного сервиса постоянные расходы 3 750 ₽ в месяц и переменные 10,64 ₽ на документ. У конвейера постоянные 69 583 ₽ в месяц и переменные 3,17 ₽. Равенство наступает при 8 813 документах в месяц — и это главный неочевидный вывод статьи: по деньгам штатный сервис выигрывает почти всегда. На отдельный конвейер переходят не из-за цены, а из-за того, что штатный сервис перестаёт справляться: типов документов больше, чем он умеет, юрлиц несколько, треть потока приходит фотографиями или нужны свои правила проверки. Если ни одного из этих условий нет — считайте вопрос закрытым и не покупайте конвейер.

графикsravnenie-rossiyskih-ocr-resheniy--03
Две прямые расходов пересекаются на 8813 документах в месяц: штатный сервис и конвейер

Линейный график. Ось X — документов в месяц от 0 до 15 000, ось Y — расходы в рублях в месяц от 0 до 160 000. Первая прямая «Штатный сервис 1С» стартует с 3 750 ₽ и растёт круто, наклон 10,64 ₽ на документ. Вторая прямая «Отдельный конвейер» стартует с 69 583 ₽ и растёт полого, наклон 3,17 ₽ на документ. Точка пересечения отмечена и подписана «8 813 документов в месяц». Слева от точки закрашена область с подписью «дешевле штатный сервис», справа — «дешевле конвейер». Внизу ремарка: «переходят обычно раньше и не из-за денег: типы документов, юрлица, качество входа». Подписи по-русски.

По деньгам штатный сервис выигрывает до 8 800 документов в месяц. Переходят раньше и по другим причинам

Три профиля компаний и готовый ответ для каждого

Сведём всё сказанное в три профиля по объёму и сложности потока. Это не жёсткая классификация, а способ быстро понять, в каком разговоре вы находитесь.

  1. 1
    До 800 документов в месяц, 2–3 типа, весь учёт в 1С

    Ответ — штатный сервис 1С:Распознавание первичных документов. Нулевая интеграция, привычный интерфейс, оплата по факту обработанного. Обязательное условие: прогнать свои худшие документы до решения. Если на них результат приемлемый, отдельный конвейер вам не нужен ни при каких обещаниях подрядчика.

  2. 2
    800–5 000 документов, 4–8 типов, несколько юрлиц, часть потока фотографиями

    Здесь начинается настоящий выбор: Content AI ContentCapture как продукт с рабочим местом оператора либо Smart Engines как движок плюс своя обвязка. Внедрение 350 000–1 200 000 ₽ в зависимости от числа типов и состояния справочников. Детальное сравнение этих двух вариантов между собой мы вынесли в отдельный материал — Content AI или Smart Engines.

  3. 3
    Больше 8 000 документов или закрытый контур

    Движковая поставка в своём периметре, вплоть до работы без выхода в интернет. Здесь окупается всё: и лицензия по числу распознаваний, и собственная прослойка «файл на входе, поля на выходе», которая делает распознавание сменяемым узлом. Порядок вложений — от 900 000 ₽ вместе с обвязкой и экраном проверки.

  4. 4
    Отдельный случай: вы и так внедряете документооборот

    Directum разумен, когда распознавание нужно внутри маршрутов согласования: договор пришёл, распознался, поехал по визам, вернулся подписанным. Покупать платформу ради одного ввода дорого — вы заплатите за ECM, а нужен был ввод. Но если ECM в планах и так, отдельный конвейер рядом с ним будет вторым интерфейсом и вторым источником правды.

схема процессаsravnenie-rossiyskih-ocr-resheniy--04
Дерево выбора решения по объёму потока, числу типов документов и требованиям к контуру

Дерево решений сверху вниз. Корень «Весь учёт в 1С?». Ветка «нет» уходит вправо к блоку «Продукт или движок по числу типов». Ветка «да» → ромб «Больше 800 документов в месяц или больше трёх типов?». Ветка «нет» → блок «1С:Распознавание первичных документов, интеграция нулевая». Ветка «да» → ромб «Данные должны остаться в периметре?». Ветка «да» → блок «Движок на своём сервере, прослойка файл-поля». Ветка «нет» → блок «Продукт с рабочим местом оператора». Сбоку отдельный блок «Внедряете документооборот с маршрутами? — ввод внутри ECM». Внизу подпись: «Ни одна ветка не начинается с вопроса о точности». Подписи по-русски, чертёжная графика.

Три вопроса подряд — и вариантов остаётся один. Точность в этом дереве не встречается ни разу

Как сравнивать честно: одна выборка, одна метрика

Сравнение по описаниям продуктов не работает: все четыре решения на типовых формах показывают сопоставимый результат, а различия живут на вашем хвосте нетиповых документов. Единственный честный способ — прогнать через кандидатов одну и ту же выборку своих документов и посчитать одну метрику: долю документов, прошедших от приёма до записи в учётную систему без единой правки человеком.

Считать при этом полезно не в документах, а в строках и правках — так цифра сразу переводится в деньги. На потоке 3 000 документов с восемью позициями в табличной части это 24 000 строк в месяц. Разница в один процентный пункт по строкам — 240 правок, 100 минут работы и около 1 400 ₽ в месяц. Разница в семь пунктов по документам, как между 22 % и 15 % очереди в расчёте выше, — это уже 53 172 ₽ в год. Методика замера и то, какие четыре числа надо считать, разобраны в материале про реальную точность распознавания.

И архитектурная предосторожность, которая стоит недорого и окупается при первой же смене вендора: обращайтесь к распознаванию через собственный внутренний контракт «отдать файл — получить набор полей», а не разбрасывайте вызовы конкретного продукта по десятку мест. Такая прослойка добавляет к интеграции 40 000–60 000 ₽ и превращает будущий переезд из проекта на 690 000 ₽ в замену одного адаптера.

Когда не нужно ни одно из четырёх

Самое дешёвое распознавание — то, которого не было. Прежде чем выбирать между вендорами, разложите месячный поток и посмотрите, сколько в нём остаётся настоящих картинок.

  • Контрагент уже в ЭДО. Контур.Диадок, Saby ЭДО и 1С-ЭДО отдают структурированный файл с подписью — его загружают, а не читают картинкой. Если вы сканируете бумагу от контрагента, который и так в обмене, правильный ответ звучит как «настройте обмен», а не «купите распознавание»; порядок подключения разобран в материале как устроен ЭДО и что нужно для старта.
  • У поставщика есть выгрузка. Один контрагент на 400 документов в месяц — это неделя переписки о выгрузке реестра файлом против строки в смете на весь срок жизни системы. Спросить стоит всегда: у большинства оптовых поставщиков такая выгрузка есть и не стоит ничего.
  • PDF со встроенным текстовым слоем. Проверяется за секунду: если текст в файле выделяется мышью, распознавать нечего. В обычной оптовой компании ЭДО и текстовые PDF вместе дают 30–50 % входящего потока.
  • Поток меньше 300 документов в месяц. Лицензии и поддержка любой конфигурации съедают экономию целиком. Здесь честный ответ — оператор на неполный день, и мы говорим это до договора.
  • Документы заполнены от руки целиком. Доля документов без правки 0–15 %, человек всё равно перечитает каждый. Дешевле убрать почерк из процесса — планшет с выбором позиции из справочника на приёмке, — чем учиться читать почерк.

И последнее, что стоит держать в голове при любом выборе: распознавание никогда не бывает стопроцентным, поэтому проект без контура проверки — не проект. Вопрос к вендору звучит не «какая у вас точность», а «какая доля ваших ошибок попадает в очередь, а не в проводку». Ответ на него отличает работающее решение от красивой презентации сильнее, чем любые десятые доли процента.

Выбор вендора двигает итоговую цену на 15–20 %. Качество исходников и порядок в справочниках двигают её в разы.