Я долго не понимала эту штуку. Работаешь с нейронкой, всё идёт хорошо, а потом она внезапно начинает генерить ВООБЩЕ левое: теряет суть, забывает, о чём мы договорились сорок сообщений назад, предлагает то, что мы уже отвергли. Первая мысль всегда была, что модель сегодня плохая. Или у них там что-то на серверах.
А оказалось проще: перегружается линия промтов. Стол завален бумагами, и нужный листок утонул где-то под остальными.
Практики называют переполнение контекста одной из главных причин, почему у людей ничего не выходит. И почти никто не объясняет это нормальным языком: везде либо «контекстное окно составляет N токенов», либо вообще ничего.
Что такое контекстное окно на языке маркетолога
Представьте стол. На него нейронка выкладывает всё, что нужно ей для ответа прямо сейчас: ваш вопрос, всю предыдущую переписку, содержимое открытых файлов, свои же прошлые ответы, инструкции из файла памяти.
Стол не резиновый. Когда он заполняется, старые бумаги уезжают с края. Либо буквально выпадают из виду, либо просто теряются среди новых. Вот поэтому ваши инструкции из начала разговора («пиши коротко», «не трогай другие файлы», «аудитория — занятые мамы») к сотому сообщению перестают работать. Их никто не отменял. Они просто где-то внизу стопки.
Отсюда две вещи, которые стоит понять сразу:
- Нейронка не «помнит» разговор. Каждый раз, когда вы отправляете сообщение, ей заново подают весь стол целиком. Она не вспоминает, она перечитывает. Длинный разговор это не «она меня уже знает», это «ей приходится каждый раз перечитывать сто страниц, чтобы ответить на одну фразу».
- Середина теряется первой. Начало разговора и последние сообщения нейронка удерживает лучше всего. Хуже всего то, что было посередине. Так что ваша важная оговорка на сороковом сообщении из ста это самое уязвимое место.
Про токены, раз уж все про них говорят. Токен это кусочек текста, примерно половина слова в русском. Считать их руками не нужно, это не ваша работа. Полезно знать одно: всё тратит токены. Не только ваши сообщения, но и файлы, которые нейронка открыла, страницы, которые прочитала в браузере, и её собственные длинные ответы. Один заход в интернет за большой статьёй съедает на столе больше места, чем весь ваш разговор до этого.
Признаки, что стол уже завален
Их видно невооружённым глазом, если знать, на что смотреть:
- Забыла ранние инструкции. Вы в начале сказали «отвечай коротко», а она выдаёт простыни. Сказали «не трогай файл X», трогает.
- Генерит левое. Не мелкая неточность, а ответ откуда-то из совсем другой задачи. Вы про заголовок лендинга, она про структуру базы данных.
- Повторяется. Предлагает то, что уже предлагала и что вы отвергли. Иногда прям дословно.
- Теряет суть. Формально на вопрос отвечает, но мимо. Как будто выдернула фразу из середины разговора и отвечает только на неё.
- Ответы становятся длиннее и водянистее. Вместо конкретики общие рассуждения и пересказ того, что уже обсудили.
- Смешивает два проекта. Обсуждали в одном чате лендинг для доставки еды, потом переключились на рекламу другого клиента. Странности полезут почти сразу.
Заметьте, все эти признаки читаются как «нейронка глупая». Отсюда и типичная реакция: люди переформулируют запрос по десятому разу, злятся и делают вывод, что инструмент так себе. А надо было просто убрать со стола.
Что с этим делать: пять приёмов
1. Чистить сессию часто и без сожалений
Самое главное и самое дешёвое. Закончили логический кусок работы, начинайте новый разговор. Не «когда совсем затупит», а по факту закрытия задачи.
Мой рабочий ритм примерно такой: одна задача, одна сессия. Собрали блок лендинга, новый чат. Разобрали данные, новый чат. Ощущается непривычно, в обычном мессенджере мы так не делаем. Но чат с нейронкой это не переписка с человеком, тут длинная история не помогает, а мешает.
Отдельно скажу: если нейронка уже начала тупить, продолжать в том же чате бессмысленно. Мусор оттуда никуда не денется, вы просто досыпете сверху своих сообщений.
2. Промежуточные резюме перед закрытием
Ключевой приём, когда работа длинная и бросать её нельзя. Перед тем как открыть новую сессию, попросите нейронку подвести итог. Этот итог и станет входным билетом в следующий чат.
Прежде чем закрыть эту сессию, собери короткую сводку для нового чата:
1) что уже сделано и работает — списком, без подробностей;
2) какие файлы мы трогали и что в каждом лежит;
3) какие решения приняты и почему (особенно то, что мы отвергли);
4) что осталось сделать следующим шагом.
Пиши так, чтобы человек, который не видел нашего разговора,
всё понял с первого раза. Уложись в 15 строк.
Получившийся текст вставляете в начало нового чата. Стол чистый, а всё важное на нём лежит. Пункт про отвергнутые решения особенно полезен: иначе нейронка в свежей сессии радостно предложит ровно то, что вы час назад забраковали.
3. Дробить задачи
Огромный запрос «собери мне лендинг, подключи форму, настрой аналитику и выложи в интернет» гарантированно переполнит стол. Нейронка откроет десяток файлов, прочитает документацию, наделает ошибок и к середине пути забудет, с чего вообще начинала.
Разбивайте. Сначала структура. Потом тексты. Потом вёрстка. Потом форма. Каждый кусок это своя сессия и своя приёмка. По ощущениям медленнее, по факту быстрее, потому что не приходится переделывать.
4. Выносить правила в файл памяти
Постоянным вещам в переписке не место. Что за проект, какая аудитория, каким тоном писать, что нельзя трогать: всё это должно лежать в файле, который нейронка читает сама в начале каждой сессии.
В Claude Code такой файл называется CLAUDE.md и лежит в папке проекта. Написали один раз, и больше не объясняете заново, кто вы и что делаете. Что туда класть и почему длинный файл вредит не меньше короткого, я разобрала в отдельной статье.
В курсе это модуль 2, там как раз собирается файл памяти проекта и проговаривается принцип «контекст — новая валюта». С одной оговоркой, которую я повторяю каждый раз: больше не значит лучше. Короткий актуальный контекст полезнее длинного досье с мусором. Раздутый файл памяти забивает тот же самый стол.
5. Не тащить в чат то, что можно не тащить
Пара привычек, которые сильно экономят место:
- Не вставляйте в чат целые файлы, если нейронка может открыть их сама. Скажите «посмотри файл landing/index.html» вместо того, чтобы копировать в сообщение три сотни строк.
- Не просите «прочитай эти пять статей и сделай выводы» одним запросом. Пять страниц из интернета это огромный объём. Лучше по одной и с промежуточным выводом после каждой.
- Просите короткие ответы там, где длинные не нужны: «ответь одним абзацем, без примеров кода». Её собственные простыни тоже лежат на столе и тоже занимают место.
Контекст-инжиниринг: что это за слово
Термин появился недавно и на русском почти не описан. Объясню, пока его не превратили в очередной пафосный ярлык.
Промпт-инжиниринг про то, как вы формулируете запрос. Роль, задача, формат, ограничения. Полезная штука, про неё у меня есть отдельный разбор.
Контекст-инжиниринг про то, что вообще лежит на столе в момент ответа. Какие файлы открыты, какая история тянется, что подтянулось из памяти, что нейронка прочитала в интернете. Формулировка запроса тут вообще ни при чём. Можно написать идеальный промт и получить мусор, если на столе бардак.
| Промпт-инжиниринг | Контекст-инжиниринг | |
|---|---|---|
| Про что | Как сформулировать одну задачу | Что нейросеть видит вокруг задачи |
| Рычаги | Роль, контекст, формат, критерии | Файл памяти, чистка сессии, резюме, какие файлы открыты |
| Когда важнее | Разовый запрос, короткая задача | Длинная работа над проектом, несколько дней подряд |
| Симптом провала | Ответ не про то, что вы имели в виду | Ответ про то, но с забытыми правилами и потерянной сутью |
Для маркетолога, который собирает свой проект неделями, вторая колонка в итоге важнее первой. Промт вы научитесь писать нормально уже на третий день. А вот управлять тем, что нейронка видит, это как раз навык, который отличает людей, у которых всё получается, от тех, у кого нейронка вечно «тупит».
Моя привычка, до которой я дошла далеко не сразу. Я закрываю сессию не когда стало плохо, а когда стало хорошо. Получилось то, что нужно: сохраняю результат, прошу короткую сводку, открываю новый чат. Звучит странно, зато у меня больше не бывает вечеров, когда я час выясняю, почему всё развалилось. Раньше я честно досиживала до состояния «оно генерит бред», и каждый раз это стоило мне вечера.
Где это не поможет
- Если задача просто сложная. Чистый контекст не добавит нейронке знаний, которых у неё нет. Иногда она не тупит, а правда не умеет.
- Если вы плохо ставите задачу. Пустой стол не спасёт от расплывчатого «сделай красиво». Тут работает промт, а не чистка.
- Если проблема в данных. Нейронка, которой скормили неверные цифры, будет уверенно строить на них выводы. Это уже не про контекст, а про фактчек.
- Если вы чистите сессию, не сохранив работу. Новый чат обнуляет разговор, а не файлы. Перед крупными переделками всё равно нужна точка сохранения, и контекст тут ни при чём.
Частые вопросы
Как понять, что контекст переполнен, а не что-то другое?
Самый надёжный признак: нейронка перестала соблюдать инструкции, которые раньше соблюдала. Забыла ваше правило из начала разговора или предложила отвергнутое решение, значит дело почти наверняка в переполненном контексте. Проверяется за минуту. Откройте новый чат, опишите ту же задачу коротко. Там всё нормально, значит диагноз подтвердился.
Помогает ли модель с большим контекстным окном?
Отчасти. Стол становится больше, бумаг влезает больше, но принцип не меняется: середина всё равно теряется, качество к концу длинной сессии всё равно падает. Большое окно откладывает проблему, а не отменяет. Привычка чистить сессию нужна в любом случае.
Как экономить токены, если у меня подписка с лимитами?
Основной эффект дают три вещи: не вставлять в чат файлы, которые нейронка может открыть сама; не гонять её по десяти страницам в интернете за один запрос; просить короткие ответы там, где длинные не нужны. Лимиты в подписке Claude считаются окнами по 5 часов, так что упереться в потолок вечером после активного дня это обычное дело, а не поломка.
Терять историю разговора не страшно?
Нет, если перед закрытием попросить сводку: что сделано, какие решения приняты, что дальше. Пятнадцать строк такой сводки полезнее ста сообщений истории, потому что в них уже нет тупиков и отброшенных вариантов.
Обязательно ли разбираться в токенах и цифрах?
Нет. Считать токены руками маркетологу не нужно ни разу. Достаточно понимать принцип стола и выработать привычку его убирать. Этого хватает, чтобы «нейронка тупит» перестало быть регулярной проблемой.