За прошедший год в агентном ИИ изменились три вещи, и ни одна из них не про то, что модели стали умнее. Вызов внешних инструментов стал устойчивым настолько, что на нём можно строить регулярный процесс, а не демонстрацию. Многошаговые сценарии перестали разваливаться на третьем шаге. Способ описывать инструменты для модели начал стандартизироваться, и адаптер под конкретную модель перестал быть половиной проекта. Всё три изменения удешевили не саму разработку, а её повторение внутри одной компании.
Это важное различие, потому что продают обычно обратное. В презентациях агентный ИИ выглядит как скачок возможностей: раньше система отвечала, теперь работает. В сметах картина другая — первый агент стоит примерно столько же, сколько стоил год назад, а вот второй, третий и четвёртый в той же компании обходятся заметно дешевле, если первый строили с расчётом на них. Ниже мы показываем эту арифметику построчно.
Сразу оговорка о доказательности. Публичной статистики, где одни и те же задачи прогнали бы на прошлогодних и нынешних системах по одинаковой методике, по российскому рынку нет. Всё, что можно честно сказать про «стало лучше», опирается на публичные заявления вендоров и на изменения в структуре проектов, которые видно в собственных сметах. Поэтому дальше мы говорим о том, что изменилось в инженерной практике и в деньгах, а не о процентах роста качества, которые никто не может проверить.
Три изменения, которые видно в смете
Проверяемый признак изменения простой: из проекта исчезла или сильно ужалась какая-то строка работ. Если строка на месте и часы те же — изменение произошло в маркетинге, а не в технологии. По этому признаку набирается ровно три пункта.
- 1Вызов инструментов стал предсказуемым
Модель, которой дали набор функций — «найди клиента по телефону», «создай сделку», «проверь остаток», — теперь заметно реже промахивается мимо формата вызова и мимо самого выбора функции. Практическое следствие: исчезла строка «страховочный разбор ответа модели», в которой раньше писали код, вылавливающий полусломанный результат. В модельной смете это 10–15 часов, которые просто перестали быть нужны.
- 2Многошаговые сценарии доживают до конца
Цепочка «прочитал письмо → нашёл контрагента → сверил условия → создал задачу → ответил отправителю» год назад требовала жёсткого внешнего каркаса: каждый шаг задавался кодом, модель отвечала за отдельный кусочек. Сейчас часть таких цепочек выдерживает передачу решения о следующем шаге самой системе. Строка «разбор сценария на жёсткие шаги» из сметы не исчезла, но для повторяющихся процессов сократилась примерно вдвое.
- 3Подключение инструментов стандартизируется
Появился общий способ описывать инструменты и данные для моделей — в российском контуре это видно, например, по MCP Hub в Yandex AI Studio. Раньше набор инструментов писался под конкретную модель и при её смене переписывался. Теперь переписывается адаптер, а не набор. Именно это изменение и делает повторение дешёвым.
Обратите внимание, что все три пункта — про инженерную рутину, а не про интеллект. Ни один из них не отвечает на вопрос «стал ли агент лучше понимать клиента». Зато все три отвечают на вопрос «сколько часов уйдёт на второй такой же проект», и владельцу бизнеса второй вопрос интереснее.
Сравнение в две колонки. Левая «Изменилось за год»: «устойчивый вызов инструментов — минус 10–15 часов на страховочный разбор», «многошаговые сценарии — жёсткая разбивка сократилась примерно вдвое», «стандартизация подключения инструментов — переписывается адаптер, а не набор». Правая «Не изменилось»: «ответственность за действие остаётся на компании», «процесс всё так же должен быть описан», «качество справочников определяет качество работы». Под колонками общая подпись: «Подешевела повторяемость, а не разработка». Чертёжный стиль, подписи по-русски.
Почему подешевело повторение, а не первый проект
Разберём на модельной компании: оптовая торговля, 60 сотрудников, amoCRM и 1С:УНФ, ставка подрядчика 3 000 ₽/час. Первый агент разбирает входящие заявки: читает письмо или сообщение, находит контрагента, заводит сделку, прикладывает вложения, задаёт уточняющий вопрос, если данных не хватает.
Через полгода та же компания заводит второго агента — на напоминания по дебиторской задолженности: смотрит просроченные счета, готовит письмо, при отсутствии реакции ставит задачу менеджеру. Процесс другой, компания та же. Смотрим, какие строки повторяются целиком, а какие переиспользуются.
Экономия набирается не в модели, а в трёх строках: инструменты, журнал с откатом и тестовый контур. Это ровно та часть проекта, которая не видна в демонстрации и которую заказчик обычно считает накладными расходами. Её и стоит проектировать как общую инфраструктуру, а не как деталь конкретного агента.
Второй агент дешевле первого лишь тогда, когда первый строился с расчётом на второго: инструменты вынесены в общий слой, права и журнал не вшиты в сценарий, тестовый контур не одноразовый. Если каждого агента делает другой подрядчик на своём стеке, второй проект стоит столько же, сколько первый, а иногда дороже — потому что к нему добавляется стыковка двух несовместимых контуров. Вопрос «что из этой работы останется вам и переиспользуется в следующем проекте» задаётся до подписания договора, а не после.
Столбчатая диаграмма из двух столбцов в рублях. Левый «Первый агент — 420 000 ₽» разбит на пять сегментов с подписями и суммами: процесс и правила 90 000 ₽, база знаний 75 000 ₽, инструменты 120 000 ₽, права и журнал 81 000 ₽, тестовый контур 54 000 ₽. Правый «Второй агент — 183 000 ₽» с теми же пятью сегментами: 66 000 ₽, 24 000 ₽, 48 000 ₽, 18 000 ₽, 27 000 ₽. Переиспользованные части трёх нижних сегментов правого столбца показаны штриховкой с подписью «уже есть». Между столбцами вынос: «−237 000 ₽». Ось Y — рубли.
Что не изменилось ни на грамм
Список короткий, и он полностью совпадает со списком причин, по которым проекты останавливаются на пилоте. Это неслучайно: технология двигалась там, где её двигают инженеры, и не двигалась там, где решение принимает компания.
- Ответственность за действие. Агент, создавший неверный заказ или отправивший письмо не тому контрагенту, не несёт ответственности — её несёт компания. Ни один вендор за прошедший год не взял на себя последствия действий системы, и это не изменится: договор с подрядчиком описывает ответственность за работоспособность, а не за коммерческий результат каждого действия.
- Требование к описанному процессу. Агенту нужно знать, что считается заявкой, когда сделка переходит в следующий статус, какая скидка допустима без согласования. Если этих правил нет на бумаге, они не появятся от того, что модель научилась вызывать функции. Автоматизация неописанного процесса даёт быстрый и уверенный хаос вместо медленного и понятного.
- Качество данных. Справочник с тремя карточками одного контрагента даёт три разных ответа на один вопрос. Модель не чинит справочники — она их читает. Подготовка данных как была работой заказчика, так и осталась, и в цену подрядчика она почти никогда не входит.
- Порог потока. Агент имеет смысл там, где однотипных случаев много. При двадцати заявках в месяц вложение в 420 000 ₽ не отобьётся ни на каком уровне автономности, потому что стоимость системы почти не зависит от объёма, а экономия зависит целиком.
Мы разбирали эти причины отдельно — в материале о том, почему ИИ-проекты не доходят до эксплуатации, там же есть чек-лист на старте и формулировки для договора. Здесь важен один вывод: изменения года лежат в другой плоскости и ни одну из этих причин не устраняют.
Цена самостоятельности: три уровня и три сметы
«Агентность» — не переключатель, а шкала. Один и тот же процесс можно автоматизировать так, что система только подсказывает, так, что она готовит действие и ждёт подтверждения, и так, что она действует сама в очерченном коридоре. Разница в цене — не в разы на внедрении, а в разы на эксплуатации.
| Уровень | Кто нажимает кнопку | Внедрение по рынку | Эксплуатация | Что добавляется к предыдущему уровню |
|---|---|---|---|---|
| 1. Подсказка человеку | Сотрудник: система готовит черновик, отправляет человек | 120 000–180 000 ₽ | 15 000 ₽/мес | Ничего: это базовый контур с базой знаний |
| 2. Действие с подтверждением | Сотрудник подтверждает готовое изменение одной кнопкой | 200 000–300 000 ₽ | 28 000 ₽/мес | Очередь подтверждений, права на запись, журнал действий, регламент «кто подтверждает» |
| 3. Автономное действие в коридоре | Никто: система действует сама, человек разбирает исключения | 450 000–700 000 ₽ | 45 000 ₽/мес | Откат операций, лимиты сумм и количества, стоп-условия, дежурный и выборочный контроль журнала |
Между вторым и третьим уровнем на рынке есть промежуточный — действие с откатом, когда система работает сама, но любая операция отменяется одной командой; по рынку это 300 000–450 000 ₽. Мы разбирали все четыре ступени подробно в статье чем ИИ-агент отличается от бота, а вилки по остальным типам проектов собраны в обзоре сколько стоят ИИ-проекты в 2026 году. Здесь важнее другое: посчитать не внедрение, а два года владения.
Последняя строка — главный практический вывод раздела. Смету на агента нельзя читать одной цифрой внедрения: чем самостоятельнее система, тем большая часть денег уходит после запуска. В 45 000 ₽/мес третьего уровня входит не только поддержка подрядчика, но и оплата модели с сервером, и время сотрудника, который выборочно смотрит журнал. Убрать последнюю статью нельзя — без неё вы узнаете об ошибке от клиента, а не из отчёта.
Три столбца с накоплением, ось Y — рубли за 24 месяца. Столбец «Подсказка»: внедрение 150 000 ₽ + эксплуатация 360 000 ₽, итого 510 000 ₽. Столбец «Действие с подтверждением»: 250 000 ₽ + 672 000 ₽, итого 922 000 ₽. Столбец «Автономное действие»: 575 000 ₽ + 1 080 000 ₽, итого 1 655 000 ₽. Нижний сегмент каждого столбца подписан «внедрение», верхний — «эксплуатация за 24 месяца». У третьего столбца вынос: «эксплуатация дороже внедрения». Между первым и третьим — подпись «в 3,2 раза».
Российский контур на сентябрь 2026 года
Вопрос «на чём собирать» для российской компании упирается не в рейтинг моделей, а в то, где физически лежат данные и чем вы будете платить. Прямая оплата зарубежных API из России невозможна, доступ идёт через посредников — это рабочий обход, но в проекте, где через систему проходят персональные данные клиентов, он подаётся как риск, а не как рекомендация.
| Платформа | Что даёт для агентов | Размещение | Что уточнять до старта |
|---|---|---|---|
| GigaChat Enterprise | Корпоративная платформа для сборки агентов на базе GigaChat, представлена в марте 2026 года | Облако, on-premise или гибрид | Требования к железу для on-premise и что входит в поставку кроме модели |
| Yandex AI Studio | Конструктор агентов, хранилище векторов, поиск по данным, MCP Hub для подключения инструментов | Облако Яндекса, серверы в РФ | Как считается стоимость обращений и что происходит при росте потока |
| Nodul | Российская платформа ИИ-агентов и интеграций: сценарии, подключение внешних систем | Облако платформы | Перечень готовых коннекторов к вашим системам и цена доработки недостающих |
| Локальная модель на своём сервере | Qwen, Llama, DeepSeek, Mistral через Ollama, векторное хранилище на pgvector | Ваш сервер в РФ | Стоимость видеокарт и администрирования: экономия на обращениях уходит в железо |
Публичных прайсов на агентные возможности этих платформ, сопоставимых между собой, нет: цена считается по обращениям, по узлам или по договору, и сравнить их таблицей честно не получится. Поэтому единственный работающий способ выбора — посчитать свой месячный объём обращений и запросить расчёт под него у двух-трёх поставщиков. Если данные не должны покидать периметр, разговор начинается с локальной модели под 152-ФЗ — её экономику и требования к железу мы разбирали отдельно.
Карта связей. В центре блок «Агент: выбор следующего шага». Слева к нему подключён сменный блок «Модель» с вариантами подписей: GigaChat Enterprise, YandexGPT 5 в AI Studio, локальная модель на своём сервере. Справа — блок «Инструменты» с четырьмя ответвлениями: amoCRM, 1С:УНФ, почта, склад; на стрелках пометки «читает» и «меняет». Снизу два обязательных блока: «Журнал действий» и «Стоп-условия и лимиты». Сверху — «База знаний со ссылками на источник». У блока «Модель» подпись «сменная часть», у остальных — «строится под компанию».
Где агентность уже работает, а где остаётся демонстрацией
Разделение проходит не по сложности задачи, а по двум признакам: есть ли у результата объективная проверка и что происходит при ошибке. Там, где ошибку видно сразу и она дёшево откатывается, самостоятельность окупается. Там, где ошибка обнаруживается через месяц в отчёте, самостоятельность — дорогая игрушка.
| Тип процесса | Состояние на сентябрь 2026 | Что должно быть верно, чтобы окупилось |
|---|---|---|
| Разбор входящих обращений и заведение их в систему | Работает в эксплуатации | От 300–400 однотипных обращений в месяц и справочник контрагентов без дублей |
| Извлечение данных из типовых документов и проводка | Работает с выборочным контролем | Проверка сумм по контрольным равенствам и очередь спорных документов человеку |
| Ведение сделки по регламенту: статусы, напоминания, задачи | Работает при описанном регламенте | Регламент на бумаге и лимиты на изменение суммы и скидки |
| Подбор поставщика и сравнение предложений | Работает как подготовка решения, не как решение | Итоговый выбор остаётся за человеком, агент собирает и сводит |
| Планирование загрузки и распределение ресурсов | Пока чаще демонстрация | Ограничения производства должны быть описаны формально, иначе план красив и невыполним |
| Переговоры, претензии, спорные суммы | Не отдаётся агенту | Цена ошибки выше стоимости всей автоматизации: агент готовит материалы, говорит человек |
Строка про обращения — самая частая точка входа: единый поток из мессенджеров, почты и форм собирается в одну ленту, а агент разбирает типовое и передаёт остальное человеку. Состав такой системы, сроки и вилку цены мы вынесли на страницу омниканального ИИ-ассистента; для документов та же логика описана в разборе распознавания счетов и актов.
Когда агентность не нужна и как это проверить за час
Самостоятельность системы — это расход, а не свойство. Платить за неё имеет смысл ровно тогда, когда человек в середине процесса действительно является узким местом. Проверяется это четырьмя вопросами, и ни на один из них не нужен подрядчик.
- 1Сколько раз в месяц выполняется процесс. Меньше 100 однотипных случаев — берите подсказку человеку за 120 000–180 000 ₽ и не платите за автономность: экономия на подтверждениях не покроет 30 000 ₽/мес разницы в эксплуатации.
- 2Сколько времени занимает подтверждение. Если сотрудник тратит на проверку готового действия 20 секунд, а самих действий 30 в день, то весь выигрыш третьего уровня — 10 минут в день. За 20 рабочих дней это 3 часа 20 минут, то есть 3 333 ₽ в месяц при ставке 1 000 ₽/час — против разницы в эксплуатации 17 000 ₽/мес между вторым и третьим уровнем.
- 3Что происходит при ошибке. Если неверное действие откатывается одной операцией и видно в тот же день — можно идти вверх по шкале. Если оно всплывает при закрытии месяца, оставайтесь на подтверждении независимо от объёма.
- 4Есть ли описанный регламент. Нет регламента — нет коридора, а без коридора автономность превращается в набор уверенных решений неизвестного качества. Сначала регламент, потом уровень.
Отдельно про то, чего не стоит ждать. Агентность не заменяет описание процесса, не чинит справочники и не переносит на подрядчика ответственность за результат. Она сокращает участие человека там, где его участие механическое. Если в вашем процессе человек нужен для суждения, а не для нажатия кнопок, автоматизировать надо подготовку суждения, а не само суждение — и это дешевле на всю разницу между первым и третьим уровнем.
И последняя оговорка, без которой статья про тренды не имеет ценности. Всё описанное — состояние на сентябрь 2026 года. Сравнение с прошлым годом сделано по публичным заявлениям вендоров и по изменению структуры собственных смет, а не по замерам на одинаковых задачах: сопоставимой независимой статистики по российскому рынку агентных систем не существует. Поэтому единственный устойчивый вывод здесь — не «пора внедрять агентов», а «стройте так, чтобы второй агент стоил дешевле первого». Эта величина зависит от вас, а не от вендора.
Изменилась не цена разработки, а цена повторения. Считайте второй проект, а не первый.
