У модели нет памяти — есть окно внимания

Кажется, что ИИ помнит разговор, как помнил бы человек. На самом деле он ничего не запоминает между сообщениями. Каждый раз, когда вы отправляете реплику, ему заново подаётся вся переписка целиком — и он отвечает, глядя на неё как на один длинный текст.

У этого текста есть предел длины, и он жёсткий. Когда переписка перестаёт помещаться, самое старое перестаёт подаваться вовсе. Не «забывается постепенно», а просто исчезает из поля зрения — вместе с требованиями, которые вы проговорили в начале.

Отсюда практическое следствие, неочевидное на первый взгляд: чем длиннее разговор, тем менее надёжен ИИ в отношении его начала. Первые договорённости — самые уязвимые, хотя обычно именно они самые важные.

Как понять, что вы упёрлись в предел

Явного предупреждения обычно нет — ответы просто начинают меняться. Признаки, по которым это узнаётся:

  • Возвращаются отвергнутые варианты. Вы уже сказали, что так не подходит, а модель предлагает это снова — значит, вашего отказа она больше не видит.
  • Теряется формат. В начале договорились об ответе таблицей, а к концу приходит сплошной текст.
  • Появляются переспросы о том, что вы говорили. «Уточните, о какой компании речь» после сорока сообщений о ней же.
  • Ответы становятся общими. Конкретика, которую вы дали вначале, уходит, остаются обтекаемые формулировки.

Заметив это, бессмысленно повторять запрос ещё раз — результат будет тот же. Нужно менять способ подачи.

Четыре приёма, которые решают проблему

  • Главное — в начало запроса. Требования, ограничения и формат ответа ставьте перед данными, а не после. Ключевое в начале и в конце сообщения держится в поле внимания надёжнее, чем спрятанное в середине длинного текста.
  • Дробите большое на части. Договор на сто страниц лучше разобрать по разделам, собрав выводы в конце, чем подавать целиком и получить поверхностный обзор.
  • Повторяйте важное. Раз в десять-пятнадцать сообщений коротко напоминайте условия: «напомню требования: тон деловой, не длиннее страницы, суммы не менять». Это не признак недоверия, а нормальная работа с инструментом.
  • Начинайте новый диалог чаще, чем кажется нужным. Когда тема сменилась, старая переписка не помогает, а мешает: она занимает место и подмешивает неактуальный контекст.

Что делать с длинными документами

Отдельная ситуация — когда предел упирается не в переписку, а в один большой файл. Здесь работают другие приёмы.

ЗадачаКак подавать
Выжимка из отчёта на 200 страницПо разделам, затем отдельный запрос: собрать выводы из полученных выжимок
Поиск конкретного пункта в договореНе весь договор, а раздел — если знаете, где искать. Быстрее и точнее
Сравнение двух версий документаТолько изменившиеся фрагменты, а не оба файла целиком
Разбор большой таблицыСначала структура и несколько строк, потом расчёты по частям
Работа с сотнями документовЗдесь чат не подходит — нужен поиск по базе, подающий модели только нужные куски

Последняя строка — граница применимости обычного чата. Когда документов много и обращаться к ним нужно постоянно, задача решается связкой поиска и модели, о чём мы писали в разборе подключения ИИ к рабочим системам.

Когда начинать заново, а когда продолжать

Частая ошибка — вести один бесконечный диалог обо всём подряд, потому что «там уже есть контекст». На деле полезный контекст быстро тонет в неактуальном.

  • Продолжайте, пока работаете над одной задачей и предыдущие ответы нужны для следующих шагов.
  • Начинайте заново при смене темы, при переходе к другому клиенту или документу, а также если ответы поехали и приёмы выше не помогли.
  • Перенесите итог. Прежде чем закрыть длинный диалог, попросите собрать краткое резюме договорённостей — и начните новый разговор с него. Так вы сохраните суть, отбросив переписку.

Если одни и те же условия нужны постоянно, их место не в переписке, а в описании проекта или в шаблоне запроса — тогда они подаются автоматически и не зависят от длины разговора.

Коротко

ИИ не забывает по невнимательности — у него просто нет памяти, а есть ограниченное окно, в которое каждый раз заново подаётся вся переписка. Понимание этого меняет привычки: важное ставим в начало, большое дробим, условия повторяем, диалоги начинаем чаще.

Это продолжение разговора о том, как устроен инструмент. Начало — в статье почему ИИ уверенно ошибается, а о том, как из этого собирается рабочий процесс, — в отдельном разборе.