Живых решений для распознавания российской первички на сентябрь 2026 года четыре, и выбирают между ними не по точности. Content AI — преемник линейки ABBYY: ContentReader PDF занял место FineReader, ContentCapture — место FlexiCapture. Smart Engines — движок под встраивание, с готовыми моделями под УПД, счета-фактуры, ТОРГ-12 и ТОРГ-13, КС-2 и КС-3, банковские выписки и ГТД, работающий без облака. Directum — интеллектуальный ввод внутри документооборота с маршрутами согласования. 1С:Распознавание первичных документов — штатный сервис для тех, у кого учёт и так в 1С.
Разница между ними лежит в трёх плоскостях, и точность в этот список не входит: что именно вы покупаете — продукт или движок; как оно поставляется — коробкой, на ваш сервер или из облака; и по какой модели считается цена. Дальше — матрица «тип документа — решение», разбор моделей поставки с точки зрения 152-ФЗ, расчёт года владения на потоке 3 000 документов и три профиля компаний с готовым ответом для каждого.
Все расчёты модельные, арифметика открытая. Ставки одни во всей статье: бухгалтер 844 ₽/час — полная стоимость часа с взносами, надбавками и рабочим местом, посчитанная по методике полной стоимости часа сотрудника, — и инженер 3 000 ₽/час. Прайсы вендоров публично не раскрываются и зависят от объёма, числа рабочих мест и способа лицензирования, поэтому все цены даны порядком величин и требуют запроса под ваш поток.
Что стало с ABBYY и кто её преемник
Это первый вопрос почти на каждой встрече, и путаница вокруг него дорого обходится. ABBYY прекратила работу в России в 2022 году. Её продуктовую линейку продолжил Content AI, и соответствие прямое: ContentReader PDF — на месте FineReader, для чтения и преобразования документов на рабочем месте; ContentCapture — на месте FlexiCapture, то есть потоковый ввод с классификацией типов, шаблонами и очередью проверки.
Продукт — это приложение с интерфейсом: рабочее место оператора, конструктор типов документов, готовая очередь проверки. Новый тип заводит аналитик, чинит администратор. Движок — библиотека, которую встраивают в вашу систему по программному интерфейсу: он отдаёт структурированный ответ и не рисует ни одного экрана. Новый тип заводит разработчик. Это разный предмет покупки, а не разные галочки в сравнительной таблице.
Практический смысл различия виден в смете. Движковая поставка сама по себе дешевле, но требует интеграции: кто-то должен принять ответ, сопоставить со справочниками, положить документ в учётную систему и нарисовать экран проверки. Это минимум 180 000 ₽ работы интегратора. Продуктовая поставка дороже в лицензии, но часть этой работы уже сделана. Если своего разработчика нет и подрядчика брать не планируете — продукт окажется дешевле в эксплуатации, несмотря на более высокий ценник.
Таблица-сравнение из четырёх колонок и четырёх строк. Колонки: «Content AI», «Smart Engines», «Directum», «1С:Распознавание первичных». Строки: «Что покупаете — продукт с рабочим местом / движок под встраивание / модуль документооборота / штатный сервис учётной системы»; «Поставка — свой сервер или коробка / свой сервер, вплоть до офлайна и устройства / свой сервер или облако / сервис 1С»; «Модель цены — лицензия с пакетом страниц / лицензия движка по числу распознаваний / лицензии платформы на пользователя / пакеты документов»; «Интеграция с 1С — через обвязку / через разработчика / через коннектор ECM / нулевая». Внизу общая подпись: «Точность на типовых формах у всех сопоставима — различия начинаются на нетиповых». Чертёжная графика, подписи по-русски.
Матрица «тип документа — решение»
Стандартный набор российской бухгалтерской первички закрывают все четыре: УПД и УКД, счета-фактуры, счета на оплату, акты выполненных работ, ТОРГ-12 и ТОРГ-13, банковские выписки и платёжные поручения. Различия начинаются там, где документ перестаёт быть типовым, — и это ровно та часть потока, которая съедает время бухгалтерии.
| Тип документа | 1С:Распознавание первичных | Content AI ContentCapture | Smart Engines | Directum |
|---|---|---|---|---|
| Счета на оплату, акты | Из коробки | Из коробки плюс шаблоны под формы | Из коробки, через программный интерфейс | В составе маршрута согласования |
| УПД, УКД, счета-фактуры | Из коробки | Из коробки | Из коробки, готовая модель | Есть |
| ТОРГ-12 и ТОРГ-13 | Есть, чувствительно к качеству скана | Есть | Из коробки, готовая модель | Есть |
| КС-2 и КС-3 | Обычно нет | Настраивается шаблоном | Из коробки, готовая модель | Настраивается |
| Банковские выписки и платёжки | Есть, но чаще берут выгрузку из клиент-банка | Есть | Из коробки | Есть |
| ГТД | Нет | Настраивается | Из коробки | Нет |
| Паспорта и удостоверения личности | Нет | Есть в отдельной поставке | Есть, работает офлайн и на устройстве | Нет |
| Договоры и приложения к ним | Нет | Частично, шаблоном не решается | Частично | Извлечение условий отдельным модулем |
Матрицу надо читать как рамку разговора, а не как спецификацию: состав готовых моделей у вендоров меняется, и перед выбором его нужно подтвердить актуальным описанием продукта и проверить на своих формах. Демонстрация на наборе вендора не говорит о вашем потоке ничего: разброс между двумя компаниями внутри одного типа документа больше, чем разброс между двумя вендорами на одной компании.
Отдельно про две нижние строки. Паспорта и другие удостоверения личности — это персональные данные специальной чувствительности, и здесь модель поставки важнее точности: распознавание в собственном контуре снимает вопрос передачи изображения наружу целиком. Мы разбирали это как отдельную задачу в материале про распознавание паспортов и 152-ФЗ. Договоры шаблоном не решаются ни у кого: у них нет устойчивой структуры, поля разбросаны по тексту, а приложения меняют условия основного документа — доля ручной доработки доходит до 45 %. Это задача языковой модели поверх текста, и мы вынесли её в отдельное решение извлечение данных из договоров.
Ни одно решение не читает связный рукописный текст в бухгалтерском качестве: там 40–70 % по полю и 0–15 % документов без единой правки. И ни одно не подставит правильную номенклатуру, если в вашем справочнике «Болт М8» лежит в четырёх вариантах написания. Сопоставление позиций живёт в справочниках, а не в распознавании — это отдельная строка сметы и отдельный человек, который справочники ведёт. Проект без такого человека деградирует независимо от выбранного вендора.
Модель поставки: коробка, свой сервер, облако
Первичка содержит фамилии подписантов, иногда данные представителей и паспортные реквизиты. Значит, отправка сканов во внешнее облако — это передача персональных данных обработчику со всеми требованиями 152-ФЗ. Модель поставки определяет, насколько тяжёлым получится этот разговор с юристом.
| Модель поставки | Что это значит на практике | Что требуется по 152-ФЗ | Цена вопроса |
|---|---|---|---|
| Коробка на рабочем месте | Приложение стоит у оператора, документы не покидают компьютер. Потокового ввода нет, каждый документ открывают руками | Ничего сверх обычного режима обработки внутри компании | Дёшево, но не масштабируется: подходит для десятков документов, не для тысяч |
| Установка на своём сервере | Конвейер целиком внутри вашего периметра, возможна работа вообще без выхода в интернет | Обработка внутри компании: поручение обработки подрядчику нужно только на время внедрения и поддержки | Дороже в лицензии и в железе, зато самый короткий разговор с юристом |
| Российское облако вендора | Изображения уходят провайдеру, обратно приходят поля. Ничего не нужно администрировать | Поручение на обработку, локализация баз в России, перечень мер защиты у обработчика | Дешевле на старте, требует договорной работы и ежегодной проверки |
| Зарубежное облако | Трансграничная передача персональных данных | Отдельный режим и уведомление; для большинства компаний нерабочий вариант | Не рассматриваем |
Практическое правило: если в потоке есть документы с персональными данными сверх фамилии подписанта — а это почти всегда так, — начинайте разговор с модели поставки, а не с точности. Договорную часть облачного варианта мы разобрали отдельно в материале про поручение обработки данных подрядчику. И отдельно уточняйте у вендора наличие продукта в реестре отечественного ПО: из российского происхождения это не следует автоматически, а для госзаказчика отсутствие в реестре — блокер.
Установка «на своём сервере» не означает автоматически отсутствие внешнего трафика. Проверка лицензии, отправка статистики использования и загрузка обновлений моделей регулярно ходят наружу — и обнаруживается это обычно на аудите, через год после запуска. Спрашивайте на этапе выбора: какие исходящие соединения делает система, можно ли их отключить и что при этом перестанет работать. Ответ «мы уточним» на этот вопрос — сам по себе информация.
Карта из трёх горизонтальных дорожек. Верхняя «Коробка на рабочем месте»: узлы «Документ» → «Компьютер оператора» → «Учётная система», периметр компании нарисован сплошной рамкой вокруг всех узлов, подпись «данные не выходят». Средняя «Свой сервер»: «Документ» → «Сервер распознавания» → «Учётная система», та же сплошная рамка, сбоку пунктирная стрелка наружу с подписью «проверка лицензии и обновления — уточнить и при необходимости отключить». Нижняя «Российское облако»: «Документ» → пунктирная стрелка за рамку периметра в узел «Облако вендора в РФ» → обратно «Поля» → «Учётная система», у стрелки подпись «поручение на обработку, локализация в РФ, меры защиты». Подписи по-русски, чертёжная графика.
1С: что даёт штатный сервис и где он кончается
Если учёт целиком в 1С, самый короткий путь — штатный сервис 1С:Распознавание первичных документов: документ создаётся прямо в базе, без отдельного конвейера, без интеграции и без второго интерфейса для бухгалтера. Это его главное и недооценённое преимущество: нулевая стоимость интеграции, которая в отдельном конвейере стоит от 160 000 ₽ и половину срока проекта.
- Что даёт: типовые счета, акты, УПД и счета-фактуры создаются документами базы, реквизиты подставляются из справочников, очередь проверки живёт внутри привычного интерфейса 1С.
- Где кончается: ограниченный набор типов, невысокая терпимость к плохим сканам и фотографиям, слабое место — сопоставление номенклатуры при большом и неаккуратном справочнике.
- Чего не умеет: КС-2 и КС-3, ГТД, паспорта, договоры, а также собственные правила проверки сложнее типовых — например, сверка суммы с заказом поставщику по вашему регламенту.
- Что проверить до решения: прогнать свои худшие документы, а не лучшие. Ограничения вылезают именно на плохих сканах, редких формах и на номенклатуре — на аккуратной выборке их не видно.
- Что учесть при доработанной конфигурации: если ваша 1С сильно кастомизирована, штатный сервис может конфликтовать с доработками — этот риск разобран в материале о том, дорабатывать 1С или делать внешнюю интеграцию.
Отдельный конвейер, наоборот, силён там, где типов документов много, юрлиц несколько, часть потока приходит фотографиями и нужны свои правила проверки. Способы связать его с учётом — обмен через типовые механизмы, внешняя обработка или прямой программный интерфейс — мы разобрали в материале про способы обмена с 1С; от выбранного способа зависит и цена интеграции, и то, кто будет её сопровождать.
Модель цены важнее прайса
Четыре решения считают деньги четырьмя разными способами, и на одном и том же потоке это даёт кратную разницу. Ниже — модели и объёмы, при которых каждая становится выгодной.
| Модель цены | Кто так считает | Когда выгодна | Чем опасна |
|---|---|---|---|
| Пакеты документов | 1С:Распознавание первичных документов | Малые и средние объёмы: платите ровно за то, что обработали | На большом потоке переменная часть растёт линейно и обгоняет фиксированную подписку |
| Лицензия с пакетом страниц | Content AI | Стабильный предсказуемый поток, близкий к объёму пакета | Недобор пакета — переплата, перебор — доплата по повышенной ставке. Считайте по годовому потоку, а не по пиковому месяцу |
| Лицензия движка по числу распознаваний или по серверу | Smart Engines | Большие объёмы и закрытый контур: цена документа падает с ростом потока | Не включает интеграцию: работа разработчика от 180 000 ₽ идёт сверху |
| Лицензии платформы на пользователя | Directum | Когда вы и так внедряете документооборот с маршрутами согласования | Покупать платформу ради одного распознавания дорого: вы платите за ECM, а нужен был ввод |
Сравним две крайние стратегии на конкретных числах: штатный сервис 1С против отдельного конвейера. Модельная компания — оптовая торговля, 3 000 входящих документов в месяц, 1,5 страницы на документ, учёт в 1С:Управление торговлей. Проверка одного документа в очереди — полторы минуты, то есть 21,10 ₽ по ставке 844 ₽/час. Подписку на распознавание берём 30 000 ₽ в месяц — середину вилки 12 000–45 000 ₽ с запасом на рост потока.
Точка равенства считается прямо. У штатного сервиса постоянные расходы 3 750 ₽ в месяц и переменные 10,64 ₽ на документ. У конвейера постоянные 69 583 ₽ в месяц и переменные 3,17 ₽. Равенство наступает при 8 813 документах в месяц — и это главный неочевидный вывод статьи: по деньгам штатный сервис выигрывает почти всегда. На отдельный конвейер переходят не из-за цены, а из-за того, что штатный сервис перестаёт справляться: типов документов больше, чем он умеет, юрлиц несколько, треть потока приходит фотографиями или нужны свои правила проверки. Если ни одного из этих условий нет — считайте вопрос закрытым и не покупайте конвейер.
Линейный график. Ось X — документов в месяц от 0 до 15 000, ось Y — расходы в рублях в месяц от 0 до 160 000. Первая прямая «Штатный сервис 1С» стартует с 3 750 ₽ и растёт круто, наклон 10,64 ₽ на документ. Вторая прямая «Отдельный конвейер» стартует с 69 583 ₽ и растёт полого, наклон 3,17 ₽ на документ. Точка пересечения отмечена и подписана «8 813 документов в месяц». Слева от точки закрашена область с подписью «дешевле штатный сервис», справа — «дешевле конвейер». Внизу ремарка: «переходят обычно раньше и не из-за денег: типы документов, юрлица, качество входа». Подписи по-русски.
Три профиля компаний и готовый ответ для каждого
Сведём всё сказанное в три профиля по объёму и сложности потока. Это не жёсткая классификация, а способ быстро понять, в каком разговоре вы находитесь.
- 1До 800 документов в месяц, 2–3 типа, весь учёт в 1С
Ответ — штатный сервис 1С:Распознавание первичных документов. Нулевая интеграция, привычный интерфейс, оплата по факту обработанного. Обязательное условие: прогнать свои худшие документы до решения. Если на них результат приемлемый, отдельный конвейер вам не нужен ни при каких обещаниях подрядчика.
- 2800–5 000 документов, 4–8 типов, несколько юрлиц, часть потока фотографиями
Здесь начинается настоящий выбор: Content AI ContentCapture как продукт с рабочим местом оператора либо Smart Engines как движок плюс своя обвязка. Внедрение 350 000–1 200 000 ₽ в зависимости от числа типов и состояния справочников. Детальное сравнение этих двух вариантов между собой мы вынесли в отдельный материал — Content AI или Smart Engines.
- 3Больше 8 000 документов или закрытый контур
Движковая поставка в своём периметре, вплоть до работы без выхода в интернет. Здесь окупается всё: и лицензия по числу распознаваний, и собственная прослойка «файл на входе, поля на выходе», которая делает распознавание сменяемым узлом. Порядок вложений — от 900 000 ₽ вместе с обвязкой и экраном проверки.
- 4Отдельный случай: вы и так внедряете документооборот
Directum разумен, когда распознавание нужно внутри маршрутов согласования: договор пришёл, распознался, поехал по визам, вернулся подписанным. Покупать платформу ради одного ввода дорого — вы заплатите за ECM, а нужен был ввод. Но если ECM в планах и так, отдельный конвейер рядом с ним будет вторым интерфейсом и вторым источником правды.
Дерево решений сверху вниз. Корень «Весь учёт в 1С?». Ветка «нет» уходит вправо к блоку «Продукт или движок по числу типов». Ветка «да» → ромб «Больше 800 документов в месяц или больше трёх типов?». Ветка «нет» → блок «1С:Распознавание первичных документов, интеграция нулевая». Ветка «да» → ромб «Данные должны остаться в периметре?». Ветка «да» → блок «Движок на своём сервере, прослойка файл-поля». Ветка «нет» → блок «Продукт с рабочим местом оператора». Сбоку отдельный блок «Внедряете документооборот с маршрутами? — ввод внутри ECM». Внизу подпись: «Ни одна ветка не начинается с вопроса о точности». Подписи по-русски, чертёжная графика.
Как сравнивать честно: одна выборка, одна метрика
Сравнение по описаниям продуктов не работает: все четыре решения на типовых формах показывают сопоставимый результат, а различия живут на вашем хвосте нетиповых документов. Единственный честный способ — прогнать через кандидатов одну и ту же выборку своих документов и посчитать одну метрику: долю документов, прошедших от приёма до записи в учётную систему без единой правки человеком.
Считать при этом полезно не в документах, а в строках и правках — так цифра сразу переводится в деньги. На потоке 3 000 документов с восемью позициями в табличной части это 24 000 строк в месяц. Разница в один процентный пункт по строкам — 240 правок, 100 минут работы и около 1 400 ₽ в месяц. Разница в семь пунктов по документам, как между 22 % и 15 % очереди в расчёте выше, — это уже 53 172 ₽ в год. Методика замера и то, какие четыре числа надо считать, разобраны в материале про реальную точность распознавания.
И архитектурная предосторожность, которая стоит недорого и окупается при первой же смене вендора: обращайтесь к распознаванию через собственный внутренний контракт «отдать файл — получить набор полей», а не разбрасывайте вызовы конкретного продукта по десятку мест. Такая прослойка добавляет к интеграции 40 000–60 000 ₽ и превращает будущий переезд из проекта на 690 000 ₽ в замену одного адаптера.
Когда не нужно ни одно из четырёх
Самое дешёвое распознавание — то, которого не было. Прежде чем выбирать между вендорами, разложите месячный поток и посмотрите, сколько в нём остаётся настоящих картинок.
- Контрагент уже в ЭДО. Контур.Диадок, Saby ЭДО и 1С-ЭДО отдают структурированный файл с подписью — его загружают, а не читают картинкой. Если вы сканируете бумагу от контрагента, который и так в обмене, правильный ответ звучит как «настройте обмен», а не «купите распознавание»; порядок подключения разобран в материале как устроен ЭДО и что нужно для старта.
- У поставщика есть выгрузка. Один контрагент на 400 документов в месяц — это неделя переписки о выгрузке реестра файлом против строки в смете на весь срок жизни системы. Спросить стоит всегда: у большинства оптовых поставщиков такая выгрузка есть и не стоит ничего.
- PDF со встроенным текстовым слоем. Проверяется за секунду: если текст в файле выделяется мышью, распознавать нечего. В обычной оптовой компании ЭДО и текстовые PDF вместе дают 30–50 % входящего потока.
- Поток меньше 300 документов в месяц. Лицензии и поддержка любой конфигурации съедают экономию целиком. Здесь честный ответ — оператор на неполный день, и мы говорим это до договора.
- Документы заполнены от руки целиком. Доля документов без правки 0–15 %, человек всё равно перечитает каждый. Дешевле убрать почерк из процесса — планшет с выбором позиции из справочника на приёмке, — чем учиться читать почерк.
И последнее, что стоит держать в голове при любом выборе: распознавание никогда не бывает стопроцентным, поэтому проект без контура проверки — не проект. Вопрос к вендору звучит не «какая у вас точность», а «какая доля ваших ошибок попадает в очередь, а не в проводку». Ответ на него отличает работающее решение от красивой презентации сильнее, чем любые десятые доли процента.
Выбор вендора двигает итоговую цену на 15–20 %. Качество исходников и порядок в справочниках двигают её в разы.
