Содержание
Длинные диалоги с ChatGPT снова упёрлись в старое ограничение LLM: модель может забывать начало переписки, когда контекстное окно забивается новыми сообщениями.
Проблему удобно представить как узкий стол с домино. Пользователь кладёт новые костяшки с одного края, а старые постепенно сдвигаются к другому. Если разговор тянется достаточно долго, первые костяшки падают со стола. В чатах с ИИ это означает потерю раннего контекста.
Почему длинные чаты ломают память ChatGPT
LLM держит разговор не в бесконечной памяти, а в ограниченном контекстном окне. В него попадают сообщения пользователя, ответы модели и служебные инструкции. Когда окно заполняется, приложению приходится ужимать историю или отбрасывать её старые части.
Из-за этого модель может внезапно забыть исходную задачу. Например, вы десять экранов обсуждали архитектуру проекта, а потом ChatGPT уверенно предлагает решение, которое противоречит решению из начала переписки.
Та же логика касается Claude и Gemini. Современные AI-приложения уже умеют автоматически сжимать длинные разговоры. Claude иногда даже ставит чат на паузу, пока ужимает накопленный контекст до более удобного размера.
Автосжатие есть, но им почти нельзя управлять
Проблема не в том, что приложения вообще не сжимают переписку. Проблема в непрозрачности. Пользователь обычно не видит точный момент, когда сервис решил пересобрать контекст, и не знает, какие детали модель сохранила.
В инструментах для разработчиков ситуация лучше. Claude Code и Codex дают возможность вручную запустить сжатие чата. В массовых приложениях уровня ChatGPT такой кнопки обычно нет, хотя именно там люди чаще ведут длинные бытовые и рабочие треды.
На этом фоне в обсуждениях промпт-инженеров закрепился приём handoff summary. Идея простая: модель готовит короткую выжимку для нового чата, а пользователь переносит её как стартовую точку.
Handoff summary сохраняет не только краткий пересказ
Обычная просьба вроде «суммируй нашу переписку в 100 слов» часто режет углы. Она может потерять развилки, ограничения и причину, ради которой чат вообще начали. Handoff summary просит модель сохранить именно рабочий контекст.
- Цель: чего пользователь пытается добиться в этом разговоре.
- Решения: какие варианты уже выбрали и какие отбросили.
- Критичные детали: факты, которые модель легко угадает неправильно.
- Следующий шаг: что нужно сделать сразу после переноса в новый чат.
PCWorld привёл хороший пример с переносом классической RPG Wizardry: Proving Grounds of the Mad Overlord с Apple II на Raspberry Pi 5. После сжатия ChatGPT сохранил главное: Pi 5 хватает по мощности, но вопрос упирается не в железо, а в легальный доступ к оригинальным дискам Apple II.
В резюме модель также зафиксировала юридическую оговорку. Случайные образы .dsk и .woz из интернета не стоит считать легальными только из-за ярлыка «abandonware». Чистые варианты — купить современный лицензированный ремейк или найти физическую копию Apple II и самостоятельно снять образ.
Для второго пути понадобятся устройства вроде Applesauce или KryoFlux. Старые диски могут деградировать или иметь защиту от копирования. Это как раз та деталь, которую легко потерять при обычном коротком пересказе.
Формулировка, вокруг которой идёт обсуждение, звучит так: «Create a handoff summary I can paste into a new chat. Include: what we’re trying to accomplish, key decisions we’ve made, anything important you’d get wrong by guessing, and the very next step. Keep it short enough to read in under a minute».