Загрузить договор на 200 страниц целиком и спросить „есть ли тут риски“ — самый частый сценарий работы с длинным документом и самый бесполезный. Модель ответит общими словами про ответственность сторон и порядок расторжения, потому что открытый вопрос по стостраничному тексту не имеет одного правильного ответа. Рабочих схем три, и все три начинаются с того, что документ режется на части, а вопрос — на пункты.

Разница между схемами измеряется в рублях и минутах, и она заметная. Модельный документ дальше один и тот же: договор подряда с приложениями на 200 страниц, это около 100 000 слов и примерно 250 000 токенов. Наивный вариант «весь документ и тридцать вопросов подряд» стоит 1 509 ₽ и занимает 45 минут машинного времени. Чек-лист из тридцати пунктов с адресным поиском — 167,60 ₽ и 11 минут. При этом чек-лист находит больше, и его результат можно принять построчно.

Ниже — почему большое контекстное окно задачу не закрывает, три схемы с ценой и временем каждой, устройство чек-листа как основного рабочего формата и честная граница между машиной и человеком. Ставки в расчётах — 0,20 ₽ за 1 000 входных токенов и 0,60 ₽ за 1 000 выходных, полная стоимость часа штатного юриста 1 400 ₽, всё по состоянию на сентябрь 2026 года.

Почему целый документ в запросе работает плохо

Формально текст помещается: 250 000 токенов влезают в современное окно с запасом. Проблема не в объёме, а в том, что происходит с вниманием модели внутри длинного запроса. Точность нахождения конкретного факта выше в начале и в конце текста и проседает в середине — это устойчивое поведение, а не дефект отдельной модели. Для договора это значит, что условие об ответственности из седьмого раздела из четырнадцати находится хуже, чем такое же условие из первого. Что именно складывается в окно на каждом запросе, разобрано в материале про контекстное окно.

Вторая причина — деньги, и она арифметическая. Платят за каждый входной токен на каждом запросе. Один вопрос по всему договору — это 250 000 входных токенов, то есть 50 ₽ только за то, что модель прочитала текст; ответ на 800 токенов добавляет 48 копеек. Пока вопрос один, сумма смешная. Но одним вопросом договор не проверяют: реальная приёмка — это три десятка вопросов, и каждый заново тащит в модель все 200 страниц. Тридцать проходов — 7 500 000 входных токенов и 1 509 ₽ за один документ. Кеширование неизменной части запроса эту сумму снижает, но саму схему не спасает; про его механику есть отдельный разбор.

Самый дешёвый вариант — он же самый бесполезный

Один открытый вопрос по всему договору стоит 50,48 ₽ и полторы минуты. Это дешевле любой рабочей схемы — и именно поэтому его показывают на демонстрациях. Проверить такой ответ нельзя: в нём нет ни ссылок на пункты, ни перечня того, что модель посмотрела и сочла нормальным. Отсутствие замечаний в нём не означает отсутствия проблем.

графикkak-model-rabotaet-s-dlinnymi-dokumentami--01
Стоимость разбора договора на 200 страниц по пяти схемам: от 50,48 ₽ до 1 509 ₽

Пять горизонтальных полос, ось снизу в рублях с разрывом шкалы после 200 ₽. Полосы сверху вниз с подписями значений: «Весь документ, один вопрос — 50,48 ₽», «Весь документ, 30 вопросов — 1 509 ₽», «Поиск разделов под вопрос — 108,20 ₽», «Разбор по частям со сведением — 63,26 ₽», «Чек-лист 30 пунктов и контрольный проход — 167,60 ₽». Первая и вторая полосы даны серым и помечены сноской «результат не проверяется построчно», три остальные — сплошным тоном. Справа второй столбик подписей с машинным временем: 1,5 минуты, 45 минут, 6 минут, 5 минут, 11 минут. Чертёжный стиль, подписи по-русски.

Самая дорогая схема и самая дешёвая одинаково плохи — обе не дают проверяемого результата

Три схемы разбора, которые работают

Все три начинаются с нарезки документа, но дальше расходятся: первая ищет нужное под каждый вопрос, вторая читает всё подряд и сводит, третья проверяет заранее заданный список условий. У каждой своя слепая зона, и знать её важнее, чем знать цену.

  1. 1
    Схема 1. Поиск нужных разделов под каждый вопрос

    Документ режется на фрагменты по 300–800 слов, каждый индексируется, и под каждый вопрос поднимаются пять-семь ближайших фрагментов. Правила нарезки те же, что для базы знаний, они подробно разобраны в подготовке базы под поиск. Сильная сторона — цена и скорость: 108,20 ₽ и 6 минут на тридцать вопросов. Слепая зона одна, но крупная: схема отвечает только на то, о чём спросили, и принципиально не видит отсутствия условия. Если раздела о неустойке в договоре нет, поиск вернёт пустоту, а модель напишет, что условие не обнаружено, — и это легко прочитать как «условие в порядке».

  2. 2
    Схема 2. Последовательный разбор по частям со сведением

    Документ делится на 20 частей по 10 страниц, каждая уходит в модель отдельным запросом с одной и той же инструкцией, на выходе получается структурированный конспект части. Затем 20 конспектов сводятся одним запросом в общий отчёт. Это самая дешёвая рабочая схема — 63,26 ₽ и 5 минут, — и единственная, которая гарантирует, что прочитана каждая страница. Слепая зона: рвутся связи. Пункт 4.2 ссылается на приложение 3, которое попало в другую часть, и при разборе четвёртой части модель этой отсылки не видит.

  3. 3
    Схема 3. Чек-лист по пунктам, каждый проверяется отдельно

    Вместо открытого вопроса берётся список из 20–40 проверяемых условий, и каждое проверяется своим запросом с адресным поиском. Ответ по каждому пункту принимает одно из трёх состояний: условие есть и звучит так-то, условия нет, формулировка спорная. Это дороже и медленнее двух предыдущих схем — 167,60 ₽ и 11 минут, — но на выходе получается таблица из тридцати строк с цитатами и номерами пунктов, которую юрист принимает или отклоняет построчно.

На практике схемы не конкурируют, а складываются. Рабочая конфигурация — третья поверх второй: чек-лист закрывает известные риски адресно, а контрольный проход по частям ловит то, чего в чек-листе не было, и заодно закрывает главную дыру первой схемы — отсутствующие условия. Именно эта пара и посчитана дальше как основной вариант.

Сколько стоит и сколько занимает: договор на 200 страниц

Ниже — все пять вариантов на одном и том же документе. Машинное время считается по рабочему ориентиру: скорость генерации 60 токенов в секунду, короткий запрос с поиском отвечает за 7–8 секунд, запрос с полным документом внутри — около полутора минут. Важно, что это время машины: человек в это время занят другим и не сидит перед экраном.

СхемаОбращений к моделиРасход на модельМашинное времяЧего не находит
Весь документ, один открытый вопрос150,48 ₽1,5 минутыпочти всё, проверить нечем
Весь документ, 30 вопросов подряд301 509 ₽45 минутсередину длинных разделов
Поиск разделов под вопрос30 плюс индексация108,20 ₽6 минутотсутствующие условия
Разбор по частям со сведением2163,26 ₽5 минутсвязи между частями и приложениями
Чек-лист 30 пунктов и контрольный проход51167,60 ₽11 минутриски, которых нет в чек-листе

Разброс между самой дешёвой и самой дорогой рабочей схемой — 104 ₽ на документе. На фоне часа юриста это ничто, поэтому выбирать схему по цене модели бессмысленно: выбирают по тому, какую слепую зону вы готовы оставить. Единственный вариант, который стоит вычеркнуть по деньгам, — тридцать проходов по всему тексту: он в девять раз дороже и в четыре раза медленнее чек-листа при худшем результате.

Чек-лист вместо открытого вопроса о рисках

Чек-лист — это перевод расплывчатой задачи «найди риски» в набор конкретных проверок, каждая из которых имеет ответ. Его составляет юрист один раз под свой тип договоров, дальше он живёт годами и правится по итогам разбирательств. Двадцать пунктов — минимум, при котором чек-лист имеет смысл; сорок — потолок, за которым он перестаёт помещаться в голову и начинает заполняться формально.

схема процессаkak-model-rabotaet-s-dlinnymi-dokumentami--02
Схема разбора: нарезка на 200 фрагментов, 30 пунктов чек-листа, контрольный проход по 20 частям

Схема из семи блоков со стрелками. Верхняя ветка слева направо: «Договор, 200 страниц» → «Нарезка: 200 фрагментов по 500 слов» → «Индексация». Отдельно слева блок «Чек-лист юриста: 30 пунктов», стрелка от него сходится с индексацией в блок «По каждому пункту: поиск 6 фрагментов, ответ с цитатой». Из него стрелка в блок «Карточка пункта: есть / нет / спорно». Нижняя ветка от блока нарезки: «Контрольный проход: 20 частей по 10 страниц» → та же карточка. Обе ветки сходятся в правый блок «Отчёт юристу: 30 строк с цитатами и номерами пунктов». Под схемой подпись: «51 обращение к модели, 167,60 ₽, 11 минут машинного времени». Чертёжный стиль, тонкие линии, подписи по-русски.

Два прохода: адресный по чек-листу и сплошной по частям — второй ловит то, чего нет в списке
  • Формулируйте пункт так, чтобы на него был ответ „да“ или „нет“. Не «проверить порядок приёмки», а «указан ли срок, в течение которого заказчик обязан подписать акт или дать мотивированный отказ».
  • Требуйте цитату и номер пункта в каждом ответе. Вывод без цитаты нельзя проверить за минуту, а значит, юрист всё равно полезет читать договор целиком — и вся экономия исчезнет.
  • Разделяйте состояния „нет условия“ и „не нашли“. Это разные вещи с разной ценой ошибки, и модель обязана их различать, а не сваливать в одну формулировку.
  • Не поручайте модели считать деньги и сроки. Суммы, проценты и календарные расчёты она выдаёт уверенно и регулярно неверно — почему так, разобрано в материале про арифметику языковых моделей.
Отсутствие условия поиском не находится

Ни одна схема с поиском не отвечает на вопрос «чего в договоре нет»: искать нечего, поэтому фрагментов не будет, а пустой результат легко превращается в спокойный ответ. Это чинится только вторым, сплошным проходом по всему тексту — той самой схемой 2, которая добавляет к счёту 60 ₽ и 5 минут. Экономить на этом проходе нельзя: пропущенное условие о неустойке стоит дороже, чем весь разбор.

Что остаётся человеку

Модель находит и подсвечивает, решает специалист. Граница проходит не по сложности текста, а по типу вопроса: где ответ содержится в документе — работает машина, где ответ зависит от того, чего в документе нет, — работает юрист.

сравнениеkak-model-rabotaet-s-dlinnymi-dokumentami--03
Сравнение: что делает модель на разборе договора и что остаётся юристу

Таблица-сравнение в две колонки «Делает модель» и «Остаётся юристу», пять строк. Строки: «Найти все упоминания темы в 200 страницах» — «Оценить, приемлемо ли условие для этой сделки»; «Свести отсылки между пунктами и приложениями» — «Учесть договорённости, которых в тексте нет»; «Проверить 30 пунктов чек-листа и дать цитату по каждому» — «Расставить приоритет: что блокирует подписание, а что торгуется»; «Показать расхождения с прошлой редакцией» — «Решить, на чём настаивать в переговорах»; «Время на договор — 11 минут» — «Время на договор — 2,5 часа вместо 7». Чертёжный стиль, тонкие линии, подписи по-русски.

Модель сокращает вычитку с 7 часов до 2,5 — но не отменяет её
Один договор на 200 страниц: разбор вручную и разбор с моделью
Сплошная вычитка юристом без модели: 7 часов × 1 400 ₽9 800 ₽
Расход на модель по схеме чек-листа с контрольным проходом167,60 ₽
Разбор отчёта из 30 строк, проверка цитат, оценка приоритета: 2,5 часа × 1 400 ₽3 500 ₽
Итого разбор с моделью3 667,60 ₽
Экономия на одном договоре6 132,40 ₽
При 12 крупных договорах в месяц73 588,80 ₽/мес
Минус сопровождение контура−12 000 ₽/мес
Итого61 588,80 ₽ в месяц чистыми. Вложение 180 000 ₽ возвращается за 2,9 месяца, а строка «модель» — 4,6 % стоимости разбора

Обратите внимание на пропорцию: расходы на модель — 167,60 ₽ из 3 667,60 ₽. Спор о том, какая модель дешевле на тысячу токенов, решает 4,6 % суммы, а решение о том, сколько часов юриста остаётся в процессе, — остальные 95 %. Поэтому требования к подрядчику формулируются не в токенах, а в формате результата: таблица с цитатами, различение «нет условия» и «не нашли», воспроизводимый чек-лист. Как из этого собирается контур целиком, разобрано в материале про ИИ-агента для работы с документами; извлечение конкретных реквизитов и сумм — отдельная задача, она вынесена в извлечение данных из договоров.

Когда так делать не надо

Схема из этой статьи окупается не всегда, и проверяется это до подписания договора с подрядчиком, а не после. Три случая, в которых мы сами отговариваем.

  1. 1Меньше пяти крупных договоров в месяц. Порог считается из арифметики: контур за 180 000 ₽ с сопровождением 12 000 ₽/мес при пяти договорах даёт 18 662 ₽ чистыми и возвращается за 9,6 месяца, при четырёх — за 14,4 месяца, при трёх — за 28 месяцев. На трёх договорах в месяц дешевле читать руками и не заводить контур вообще.
  2. 2Договоры каждый раз разные по типу. Чек-лист составляется под класс сделок. Если у вас поочерёдно подряд, лицензия, аренда и поставка оборудования, чек-листов нужно четыре, разметка растягивается на месяцы, а до окупаемости не доживает ни один.
  3. 3Цена пропущенного условия сопоставима с ценой разбора. На договорах до 300 000 ₽ строить контур бессмысленно: экономия часов есть, но риск, ради которого всё затевалось, мал. Схему берут туда, где одно пропущенное условие стоит дороже годового бюджета проверки.

Есть и четвёртый случай, который встречается чаще трёх предыдущих вместе: договоры уже читают невнимательно, потому что нет времени. Тогда модель не сокращает 7 часов до 2,5 — она добавляет 2,5 часа к нулю. Это тоже может быть выгодно, но считать надо не экономию, а стоимость предотвращённых проблем, и такой расчёт мы делаем на бесплатной диагностике по вашим договорам.