Загрузить договор на 200 страниц целиком и спросить „есть ли тут риски“ — самый частый сценарий работы с длинным документом и самый бесполезный. Модель ответит общими словами про ответственность сторон и порядок расторжения, потому что открытый вопрос по стостраничному тексту не имеет одного правильного ответа. Рабочих схем три, и все три начинаются с того, что документ режется на части, а вопрос — на пункты.
Разница между схемами измеряется в рублях и минутах, и она заметная. Модельный документ дальше один и тот же: договор подряда с приложениями на 200 страниц, это около 100 000 слов и примерно 250 000 токенов. Наивный вариант «весь документ и тридцать вопросов подряд» стоит 1 509 ₽ и занимает 45 минут машинного времени. Чек-лист из тридцати пунктов с адресным поиском — 167,60 ₽ и 11 минут. При этом чек-лист находит больше, и его результат можно принять построчно.
Ниже — почему большое контекстное окно задачу не закрывает, три схемы с ценой и временем каждой, устройство чек-листа как основного рабочего формата и честная граница между машиной и человеком. Ставки в расчётах — 0,20 ₽ за 1 000 входных токенов и 0,60 ₽ за 1 000 выходных, полная стоимость часа штатного юриста 1 400 ₽, всё по состоянию на сентябрь 2026 года.
Почему целый документ в запросе работает плохо
Формально текст помещается: 250 000 токенов влезают в современное окно с запасом. Проблема не в объёме, а в том, что происходит с вниманием модели внутри длинного запроса. Точность нахождения конкретного факта выше в начале и в конце текста и проседает в середине — это устойчивое поведение, а не дефект отдельной модели. Для договора это значит, что условие об ответственности из седьмого раздела из четырнадцати находится хуже, чем такое же условие из первого. Что именно складывается в окно на каждом запросе, разобрано в материале про контекстное окно.
Вторая причина — деньги, и она арифметическая. Платят за каждый входной токен на каждом запросе. Один вопрос по всему договору — это 250 000 входных токенов, то есть 50 ₽ только за то, что модель прочитала текст; ответ на 800 токенов добавляет 48 копеек. Пока вопрос один, сумма смешная. Но одним вопросом договор не проверяют: реальная приёмка — это три десятка вопросов, и каждый заново тащит в модель все 200 страниц. Тридцать проходов — 7 500 000 входных токенов и 1 509 ₽ за один документ. Кеширование неизменной части запроса эту сумму снижает, но саму схему не спасает; про его механику есть отдельный разбор.
Один открытый вопрос по всему договору стоит 50,48 ₽ и полторы минуты. Это дешевле любой рабочей схемы — и именно поэтому его показывают на демонстрациях. Проверить такой ответ нельзя: в нём нет ни ссылок на пункты, ни перечня того, что модель посмотрела и сочла нормальным. Отсутствие замечаний в нём не означает отсутствия проблем.
Пять горизонтальных полос, ось снизу в рублях с разрывом шкалы после 200 ₽. Полосы сверху вниз с подписями значений: «Весь документ, один вопрос — 50,48 ₽», «Весь документ, 30 вопросов — 1 509 ₽», «Поиск разделов под вопрос — 108,20 ₽», «Разбор по частям со сведением — 63,26 ₽», «Чек-лист 30 пунктов и контрольный проход — 167,60 ₽». Первая и вторая полосы даны серым и помечены сноской «результат не проверяется построчно», три остальные — сплошным тоном. Справа второй столбик подписей с машинным временем: 1,5 минуты, 45 минут, 6 минут, 5 минут, 11 минут. Чертёжный стиль, подписи по-русски.
Три схемы разбора, которые работают
Все три начинаются с нарезки документа, но дальше расходятся: первая ищет нужное под каждый вопрос, вторая читает всё подряд и сводит, третья проверяет заранее заданный список условий. У каждой своя слепая зона, и знать её важнее, чем знать цену.
- 1Схема 1. Поиск нужных разделов под каждый вопрос
Документ режется на фрагменты по 300–800 слов, каждый индексируется, и под каждый вопрос поднимаются пять-семь ближайших фрагментов. Правила нарезки те же, что для базы знаний, они подробно разобраны в подготовке базы под поиск. Сильная сторона — цена и скорость: 108,20 ₽ и 6 минут на тридцать вопросов. Слепая зона одна, но крупная: схема отвечает только на то, о чём спросили, и принципиально не видит отсутствия условия. Если раздела о неустойке в договоре нет, поиск вернёт пустоту, а модель напишет, что условие не обнаружено, — и это легко прочитать как «условие в порядке».
- 2Схема 2. Последовательный разбор по частям со сведением
Документ делится на 20 частей по 10 страниц, каждая уходит в модель отдельным запросом с одной и той же инструкцией, на выходе получается структурированный конспект части. Затем 20 конспектов сводятся одним запросом в общий отчёт. Это самая дешёвая рабочая схема — 63,26 ₽ и 5 минут, — и единственная, которая гарантирует, что прочитана каждая страница. Слепая зона: рвутся связи. Пункт 4.2 ссылается на приложение 3, которое попало в другую часть, и при разборе четвёртой части модель этой отсылки не видит.
- 3Схема 3. Чек-лист по пунктам, каждый проверяется отдельно
Вместо открытого вопроса берётся список из 20–40 проверяемых условий, и каждое проверяется своим запросом с адресным поиском. Ответ по каждому пункту принимает одно из трёх состояний: условие есть и звучит так-то, условия нет, формулировка спорная. Это дороже и медленнее двух предыдущих схем — 167,60 ₽ и 11 минут, — но на выходе получается таблица из тридцати строк с цитатами и номерами пунктов, которую юрист принимает или отклоняет построчно.
На практике схемы не конкурируют, а складываются. Рабочая конфигурация — третья поверх второй: чек-лист закрывает известные риски адресно, а контрольный проход по частям ловит то, чего в чек-листе не было, и заодно закрывает главную дыру первой схемы — отсутствующие условия. Именно эта пара и посчитана дальше как основной вариант.
Сколько стоит и сколько занимает: договор на 200 страниц
Ниже — все пять вариантов на одном и том же документе. Машинное время считается по рабочему ориентиру: скорость генерации 60 токенов в секунду, короткий запрос с поиском отвечает за 7–8 секунд, запрос с полным документом внутри — около полутора минут. Важно, что это время машины: человек в это время занят другим и не сидит перед экраном.
| Схема | Обращений к модели | Расход на модель | Машинное время | Чего не находит |
|---|---|---|---|---|
| Весь документ, один открытый вопрос | 1 | 50,48 ₽ | 1,5 минуты | почти всё, проверить нечем |
| Весь документ, 30 вопросов подряд | 30 | 1 509 ₽ | 45 минут | середину длинных разделов |
| Поиск разделов под вопрос | 30 плюс индексация | 108,20 ₽ | 6 минут | отсутствующие условия |
| Разбор по частям со сведением | 21 | 63,26 ₽ | 5 минут | связи между частями и приложениями |
| Чек-лист 30 пунктов и контрольный проход | 51 | 167,60 ₽ | 11 минут | риски, которых нет в чек-листе |
Разброс между самой дешёвой и самой дорогой рабочей схемой — 104 ₽ на документе. На фоне часа юриста это ничто, поэтому выбирать схему по цене модели бессмысленно: выбирают по тому, какую слепую зону вы готовы оставить. Единственный вариант, который стоит вычеркнуть по деньгам, — тридцать проходов по всему тексту: он в девять раз дороже и в четыре раза медленнее чек-листа при худшем результате.
Чек-лист вместо открытого вопроса о рисках
Чек-лист — это перевод расплывчатой задачи «найди риски» в набор конкретных проверок, каждая из которых имеет ответ. Его составляет юрист один раз под свой тип договоров, дальше он живёт годами и правится по итогам разбирательств. Двадцать пунктов — минимум, при котором чек-лист имеет смысл; сорок — потолок, за которым он перестаёт помещаться в голову и начинает заполняться формально.
Схема из семи блоков со стрелками. Верхняя ветка слева направо: «Договор, 200 страниц» → «Нарезка: 200 фрагментов по 500 слов» → «Индексация». Отдельно слева блок «Чек-лист юриста: 30 пунктов», стрелка от него сходится с индексацией в блок «По каждому пункту: поиск 6 фрагментов, ответ с цитатой». Из него стрелка в блок «Карточка пункта: есть / нет / спорно». Нижняя ветка от блока нарезки: «Контрольный проход: 20 частей по 10 страниц» → та же карточка. Обе ветки сходятся в правый блок «Отчёт юристу: 30 строк с цитатами и номерами пунктов». Под схемой подпись: «51 обращение к модели, 167,60 ₽, 11 минут машинного времени». Чертёжный стиль, тонкие линии, подписи по-русски.
- Формулируйте пункт так, чтобы на него был ответ „да“ или „нет“. Не «проверить порядок приёмки», а «указан ли срок, в течение которого заказчик обязан подписать акт или дать мотивированный отказ».
- Требуйте цитату и номер пункта в каждом ответе. Вывод без цитаты нельзя проверить за минуту, а значит, юрист всё равно полезет читать договор целиком — и вся экономия исчезнет.
- Разделяйте состояния „нет условия“ и „не нашли“. Это разные вещи с разной ценой ошибки, и модель обязана их различать, а не сваливать в одну формулировку.
- Не поручайте модели считать деньги и сроки. Суммы, проценты и календарные расчёты она выдаёт уверенно и регулярно неверно — почему так, разобрано в материале про арифметику языковых моделей.
Ни одна схема с поиском не отвечает на вопрос «чего в договоре нет»: искать нечего, поэтому фрагментов не будет, а пустой результат легко превращается в спокойный ответ. Это чинится только вторым, сплошным проходом по всему тексту — той самой схемой 2, которая добавляет к счёту 60 ₽ и 5 минут. Экономить на этом проходе нельзя: пропущенное условие о неустойке стоит дороже, чем весь разбор.
Что остаётся человеку
Модель находит и подсвечивает, решает специалист. Граница проходит не по сложности текста, а по типу вопроса: где ответ содержится в документе — работает машина, где ответ зависит от того, чего в документе нет, — работает юрист.
Таблица-сравнение в две колонки «Делает модель» и «Остаётся юристу», пять строк. Строки: «Найти все упоминания темы в 200 страницах» — «Оценить, приемлемо ли условие для этой сделки»; «Свести отсылки между пунктами и приложениями» — «Учесть договорённости, которых в тексте нет»; «Проверить 30 пунктов чек-листа и дать цитату по каждому» — «Расставить приоритет: что блокирует подписание, а что торгуется»; «Показать расхождения с прошлой редакцией» — «Решить, на чём настаивать в переговорах»; «Время на договор — 11 минут» — «Время на договор — 2,5 часа вместо 7». Чертёжный стиль, тонкие линии, подписи по-русски.
Обратите внимание на пропорцию: расходы на модель — 167,60 ₽ из 3 667,60 ₽. Спор о том, какая модель дешевле на тысячу токенов, решает 4,6 % суммы, а решение о том, сколько часов юриста остаётся в процессе, — остальные 95 %. Поэтому требования к подрядчику формулируются не в токенах, а в формате результата: таблица с цитатами, различение «нет условия» и «не нашли», воспроизводимый чек-лист. Как из этого собирается контур целиком, разобрано в материале про ИИ-агента для работы с документами; извлечение конкретных реквизитов и сумм — отдельная задача, она вынесена в извлечение данных из договоров.
Когда так делать не надо
Схема из этой статьи окупается не всегда, и проверяется это до подписания договора с подрядчиком, а не после. Три случая, в которых мы сами отговариваем.
- 1Меньше пяти крупных договоров в месяц. Порог считается из арифметики: контур за 180 000 ₽ с сопровождением 12 000 ₽/мес при пяти договорах даёт 18 662 ₽ чистыми и возвращается за 9,6 месяца, при четырёх — за 14,4 месяца, при трёх — за 28 месяцев. На трёх договорах в месяц дешевле читать руками и не заводить контур вообще.
- 2Договоры каждый раз разные по типу. Чек-лист составляется под класс сделок. Если у вас поочерёдно подряд, лицензия, аренда и поставка оборудования, чек-листов нужно четыре, разметка растягивается на месяцы, а до окупаемости не доживает ни один.
- 3Цена пропущенного условия сопоставима с ценой разбора. На договорах до 300 000 ₽ строить контур бессмысленно: экономия часов есть, но риск, ради которого всё затевалось, мал. Схему берут туда, где одно пропущенное условие стоит дороже годового бюджета проверки.
Есть и четвёртый случай, который встречается чаще трёх предыдущих вместе: договоры уже читают невнимательно, потому что нет времени. Тогда модель не сокращает 7 часов до 2,5 — она добавляет 2,5 часа к нулю. Это тоже может быть выгодно, но считать надо не экономию, а стоимость предотвращённых проблем, и такой расчёт мы делаем на бесплатной диагностике по вашим договорам.
