Стать AI-native маркетологомкурс · Nadia Park

Почему нейросеть тупеет к вечеру: контекст простыми словами

· Надя Пак

Утром она понимала с полуслова, а к вечеру забыла ваши правила, потеряла суть и начала выдавать вообще левое. Модель не испортилась и не устала. У неё переполнился контекст, и чинится это за две минуты, если понимать, что происходит.

Я долго не понимала эту штуку. Работаешь с нейронкой, всё идёт хорошо, а потом она внезапно начинает генерить ВООБЩЕ левое: теряет суть, забывает, о чём мы договорились сорок сообщений назад, предлагает то, что мы уже отвергли. Первая мысль всегда была, что модель сегодня плохая. Или у них там что-то на серверах.

А оказалось проще: перегружается линия промтов. Стол завален бумагами, и нужный листок утонул где-то под остальными.

Практики называют переполнение контекста одной из главных причин, почему у людей ничего не выходит. И почти никто не объясняет это нормальным языком: везде либо «контекстное окно составляет N токенов», либо вообще ничего.

Что такое контекстное окно на языке маркетолога

Представьте стол. На него нейронка выкладывает всё, что нужно ей для ответа прямо сейчас: ваш вопрос, всю предыдущую переписку, содержимое открытых файлов, свои же прошлые ответы, инструкции из файла памяти.

Стол не резиновый. Когда он заполняется, старые бумаги уезжают с края. Либо буквально выпадают из виду, либо просто теряются среди новых. Вот поэтому ваши инструкции из начала разговора («пиши коротко», «не трогай другие файлы», «аудитория — занятые мамы») к сотому сообщению перестают работать. Их никто не отменял. Они просто где-то внизу стопки.

Отсюда две вещи, которые стоит понять сразу:

Про токены, раз уж все про них говорят. Токен это кусочек текста, примерно половина слова в русском. Считать их руками не нужно, это не ваша работа. Полезно знать одно: всё тратит токены. Не только ваши сообщения, но и файлы, которые нейронка открыла, страницы, которые прочитала в браузере, и её собственные длинные ответы. Один заход в интернет за большой статьёй съедает на столе больше места, чем весь ваш разговор до этого.

Признаки, что стол уже завален

Их видно невооружённым глазом, если знать, на что смотреть:

Заметьте, все эти признаки читаются как «нейронка глупая». Отсюда и типичная реакция: люди переформулируют запрос по десятому разу, злятся и делают вывод, что инструмент так себе. А надо было просто убрать со стола.

Что с этим делать: пять приёмов

1. Чистить сессию часто и без сожалений

Самое главное и самое дешёвое. Закончили логический кусок работы, начинайте новый разговор. Не «когда совсем затупит», а по факту закрытия задачи.

Мой рабочий ритм примерно такой: одна задача, одна сессия. Собрали блок лендинга, новый чат. Разобрали данные, новый чат. Ощущается непривычно, в обычном мессенджере мы так не делаем. Но чат с нейронкой это не переписка с человеком, тут длинная история не помогает, а мешает.

Отдельно скажу: если нейронка уже начала тупить, продолжать в том же чате бессмысленно. Мусор оттуда никуда не денется, вы просто досыпете сверху своих сообщений.

2. Промежуточные резюме перед закрытием

Ключевой приём, когда работа длинная и бросать её нельзя. Перед тем как открыть новую сессию, попросите нейронку подвести итог. Этот итог и станет входным билетом в следующий чат.

Прежде чем закрыть эту сессию, собери короткую сводку для нового чата:
1) что уже сделано и работает — списком, без подробностей;
2) какие файлы мы трогали и что в каждом лежит;
3) какие решения приняты и почему (особенно то, что мы отвергли);
4) что осталось сделать следующим шагом.

Пиши так, чтобы человек, который не видел нашего разговора,
всё понял с первого раза. Уложись в 15 строк.

Получившийся текст вставляете в начало нового чата. Стол чистый, а всё важное на нём лежит. Пункт про отвергнутые решения особенно полезен: иначе нейронка в свежей сессии радостно предложит ровно то, что вы час назад забраковали.

3. Дробить задачи

Огромный запрос «собери мне лендинг, подключи форму, настрой аналитику и выложи в интернет» гарантированно переполнит стол. Нейронка откроет десяток файлов, прочитает документацию, наделает ошибок и к середине пути забудет, с чего вообще начинала.

Разбивайте. Сначала структура. Потом тексты. Потом вёрстка. Потом форма. Каждый кусок это своя сессия и своя приёмка. По ощущениям медленнее, по факту быстрее, потому что не приходится переделывать.

4. Выносить правила в файл памяти

Постоянным вещам в переписке не место. Что за проект, какая аудитория, каким тоном писать, что нельзя трогать: всё это должно лежать в файле, который нейронка читает сама в начале каждой сессии.

В Claude Code такой файл называется CLAUDE.md и лежит в папке проекта. Написали один раз, и больше не объясняете заново, кто вы и что делаете. Что туда класть и почему длинный файл вредит не меньше короткого, я разобрала в отдельной статье.

В курсе это модуль 2, там как раз собирается файл памяти проекта и проговаривается принцип «контекст — новая валюта». С одной оговоркой, которую я повторяю каждый раз: больше не значит лучше. Короткий актуальный контекст полезнее длинного досье с мусором. Раздутый файл памяти забивает тот же самый стол.

5. Не тащить в чат то, что можно не тащить

Пара привычек, которые сильно экономят место:

Контекст-инжиниринг: что это за слово

Термин появился недавно и на русском почти не описан. Объясню, пока его не превратили в очередной пафосный ярлык.

Промпт-инжиниринг про то, как вы формулируете запрос. Роль, задача, формат, ограничения. Полезная штука, про неё у меня есть отдельный разбор.

Контекст-инжиниринг про то, что вообще лежит на столе в момент ответа. Какие файлы открыты, какая история тянется, что подтянулось из памяти, что нейронка прочитала в интернете. Формулировка запроса тут вообще ни при чём. Можно написать идеальный промт и получить мусор, если на столе бардак.

Промпт-инжинирингКонтекст-инжиниринг
Про что Как сформулировать одну задачу Что нейросеть видит вокруг задачи
Рычаги Роль, контекст, формат, критерии Файл памяти, чистка сессии, резюме, какие файлы открыты
Когда важнее Разовый запрос, короткая задача Длинная работа над проектом, несколько дней подряд
Симптом провала Ответ не про то, что вы имели в виду Ответ про то, но с забытыми правилами и потерянной сутью

Для маркетолога, который собирает свой проект неделями, вторая колонка в итоге важнее первой. Промт вы научитесь писать нормально уже на третий день. А вот управлять тем, что нейронка видит, это как раз навык, который отличает людей, у которых всё получается, от тех, у кого нейронка вечно «тупит».

Моя привычка, до которой я дошла далеко не сразу. Я закрываю сессию не когда стало плохо, а когда стало хорошо. Получилось то, что нужно: сохраняю результат, прошу короткую сводку, открываю новый чат. Звучит странно, зато у меня больше не бывает вечеров, когда я час выясняю, почему всё развалилось. Раньше я честно досиживала до состояния «оно генерит бред», и каждый раз это стоило мне вечера.

Где это не поможет

Частые вопросы

Как понять, что контекст переполнен, а не что-то другое?

Самый надёжный признак: нейронка перестала соблюдать инструкции, которые раньше соблюдала. Забыла ваше правило из начала разговора или предложила отвергнутое решение, значит дело почти наверняка в переполненном контексте. Проверяется за минуту. Откройте новый чат, опишите ту же задачу коротко. Там всё нормально, значит диагноз подтвердился.

Помогает ли модель с большим контекстным окном?

Отчасти. Стол становится больше, бумаг влезает больше, но принцип не меняется: середина всё равно теряется, качество к концу длинной сессии всё равно падает. Большое окно откладывает проблему, а не отменяет. Привычка чистить сессию нужна в любом случае.

Как экономить токены, если у меня подписка с лимитами?

Основной эффект дают три вещи: не вставлять в чат файлы, которые нейронка может открыть сама; не гонять её по десяти страницам в интернете за один запрос; просить короткие ответы там, где длинные не нужны. Лимиты в подписке Claude считаются окнами по 5 часов, так что упереться в потолок вечером после активного дня это обычное дело, а не поломка.

Терять историю разговора не страшно?

Нет, если перед закрытием попросить сводку: что сделано, какие решения приняты, что дальше. Пятнадцать строк такой сводки полезнее ста сообщений истории, потому что в них уже нет тупиков и отброшенных вариантов.

Обязательно ли разбираться в токенах и цифрах?

Нет. Считать токены руками маркетологу не нужно ни разу. Достаточно понимать принцип стола и выработать привычку его убирать. Этого хватает, чтобы «нейронка тупит» перестало быть регулярной проблемой.

Собрать такую систему у себя

На курсе «Стать AI-native маркетологом» это разбирается по шагам на вашем проекте. Первые два модуля бесплатны, карта не нужна.

Начать бесплатно →

первый шаг — около часа