Контекстное окно в 2026: как не дать ИИ «отупеть» в длинном чате
22 июня 2026 г. · 13 мин чтения

Сидишь в одном чате час, задача большая, и вдруг замечаешь: ИИ будто поглупел. Путает то, о чём вы договорились в самом начале, повторяется, лепит ерунду, которую десять сообщений назад делал нормально. Дело не в плохом дне у модели. У неё кончается рабочая память. Сейчас разберёмся, что это за память, почему длинный чат реально портит ответы, и как этим управлять руками.
Если ты ещё ни разу не разговаривал с ИИ в браузере — сначала загляни в Claude с нуля. А тут считаем, что переписываться ты уже умеешь, и копнём глубже: что происходит у модели «в голове», пока вы общаетесь.
Почему длинный чат начинает тупить
Представь рабочий стол. В начале он чистый: лежит одна задача, всё видно, ты быстро находишь нужное. Через час на нём сорок открытых бумажек, три недопитых кофе и стопка того, что уже не актуально. Найти что-то стало тяжело, и ты начинаешь ошибаться.
У ИИ так же. Его рабочий стол называют контекстным окном — это вся память модели на один диалог. Туда складывается всё подряд:
- Твои сообщения — каждый вопрос и каждая правка.
- Ответы модели — всё, что она написала за чат.
- Прикреплённые файлы — кинул документ или код, он тоже лёг на стол.
И вот ключевой момент, который мало кто понимает. Каждый раз, когда ты пишешь новое сообщение, модель отвечает не «с того места», а перечитывает весь диалог заново, с самой первой строчки. Память у неё не как у человека. Она не «помнит» — она каждый раз заново читает всю переписку, чтобы ответить.
Отсюда сразу два следствия. Длинный чат дорожает (модель прожёвывает всё больше текста на каждый ответ) и тормозит. Но это полбеды. Главная беда — дальше.
Context rot: модель реально начинает отвечать хуже

Вот тезис, ради которого весь гайд. Дело не только в деньгах — по мере заполнения контекста модель начинает отвечать ХУЖЕ.
Этому даже есть название — context rot, «гниение контекста». Исследования показали штуку, которая ломает интуицию: модель помнит не весь диалог одинаково. Лучше всего она держит самые последние сообщения и самые первые. А вот серединку длинного чата начинает терять.
Понимаешь, чем это опасно? Инструкции и договорённости ты обычно даёшь в начале. «Пиши коротко», «не трогай этот файл», «вот мой стиль». Пока чат короткий, это работает. Но когда переписка раздулась, твои стартовые правила уезжают в ту самую теряемую зону, и модель про них будто забывает. Не потому что глупая. Просто стол завален, и до нижних бумажек руки уже не доходят.
Когда длинный чат начал игнорировать твои ранние инструкции — не злись и не повторяй их в десятый раз. Это context rot, он есть у всех моделей. Лечится не уговорами, а чистым стартом: новый чат, где правила снова окажутся «свежими».
Сколько «памяти» у твоей модели
Контекстное окно у разных ИИ разное по размеру, и для нас это важно на практике.
- Claude по подписке — окно очень большое, это сотни страниц текста за раз. У топовых моделей ещё больше. Длинную задачу с кучей материала он переварит спокойно.
- ChatGPT в браузере на обычной подписке — окно заметно меньше, у Claude его в разы больше. Для длинных вдумчивых задач с файлами в браузере Claude удобнее.
Точные цифры тут называть бессмысленно: они меняются каждые пару месяцев. Держи в голове порядок, а не число.
И отдельная боль для нас с тобой — русский язык. Модель режет текст на «кусочки» (их зовут токенами), и русский она крошит мельче английского, примерно в два-три раза. То есть один и тот же по смыслу текст на русском съедает заметно больше места в окне, чем на английском. Твой контекст забивается быстрее, чем у англоязычного пользователя. Знать это полезно: длинная русская простыня — дорого и тесно.
Если хочется понять, что такое токены и почему за них берут деньги, это разобрано в гайде «Токены, контекст и цены». Тут мы про другое — про стратегию, как не дать чату распухнуть и отупеть.
Главное правило: один чат — одна задача
Если запомнить из всего гайда одну вещь, пусть будет эта. Один чат — одна задача.
Самая частая ошибка новичка — «кухонная мойка». Это когда в одну бесконечную переписку валят всё подряд: тут спросил про рецепт, там попросил код поправить, следом про отпуск посоветоваться. Модель таскает весь этот винегрет за собой и путается.
Сравни на живом примере. Сначала как делает большинство:
А теперь по-человечески: новая тема — новый чат.
Каждая тема в своём чате. Звучит банально, но именно это держит ответы острыми весь день.
А когда чат всё-таки начал тупить прямо посреди задачи — не реанимируй его. Открой новый и в двух фразах перескажи суть. Вот такой коротенький бриф спасает чаще всего:
Я делаю пост для Telegram о запуске курса по вайб-кодингу. Стиль — простой, на «ты», без терминов, 3 коротких абзаца. Вот черновик, который уже получился: [вставь]. Продолжаем с этого места.
Минута на пересказ — и у тебя снова свежая модель с чистым столом вместо уставшей, которая всё путает.
Показывай нужное, а не всё
Второй большой рычаг — не заваливать стол целиком. Модели не нужен весь твой проект, чтобы поправить одну строчку.
- Прикладывай фрагмент, а не всё. Нужна правка в одном месте — покажи это место, а не документ на сорок страниц.
- В claude.ai используй Projects. Это папка, куда ты один раз кладёшь файлы проекта. Дальше любой чат внутри проекта их «видит», и тебе не надо заново вставлять их в каждую переписку. Файлы лежат один раз, а не жгут контекст по новой каждый день.
- В Claude Code давай ссылку на файл через
@. Не вставляй простыню кода в чат. Напиши@auth.ts, и Claude сам прочитает файл, причём только когда он реально понадобится.


Claude Code: /clear и /compact — когда что
В браузере ты чистишь контекст, открывая новый чат. В Claude Code для этого есть две команды, и путать их не надо.
Сначала про то, как вообще понять, что пора чистить. В Claude Code видно, насколько забит контекст — есть индикатор заполнения. Не жди, пока он упрётся в потолок и сработает автосжатие. Лучше вмешаться раньше.

Теперь сами команды:
/clear— полный сброс. Стирает весь контекст начисто. Жми, когда переключаешься на другую задачу или когда модель залипла и третий ответ подряд несёт чушь. Чистый старт почти всегда лучше, чем уговаривать уставший чат./compact— сжать, но не терять. Сворачивает историю в короткое саммари: суть остаётся, лишний объём уходит. Это для случая, когда задача длинная и ещё не закончена, а контекст уже распух.
Правило большого пальца — жми /compact проактивно, примерно когда контекст забит на две трети. Не жди, пока инструмент сожмёт сам в самый неподходящий момент. Ты сжимаешь по своей воле и контролируешь, что останется.
А ещё можно подсказать, что именно сохранить при сжатии:
/compact сохрани список изменённых файлов и открытые TODO
Вот короткий маршрут, как спасти залипший чат в Claude Code:
/compact. Зашёл в тупик или это уже другая задача — жми /clear.Простое правило: если две попытки исправить не сработали, не пиши третью в том же чате — контекст уже забит неверными ходами и тянет модель не туда. Сначала попробуй откатиться назад (двойной Esc или команда /rewind) и переформулировать точнее. А если чат совсем распух — /clear и зайди с чистого листа.
CLAUDE.md держи как короткий бриф
Если ты завёл файл CLAUDE.md — это инструкция, которую Claude Code читает в начале каждой сессии. Удобно, но есть нюанс: раз он читается каждый раз, то и токены тратит каждый раз. Раздутый CLAUDE.md на тысячу строк тихо съедает контекст ещё до того, как ты задал первый вопрос.
Поэтому держи его коротким, ориентир — до двух сотен строк. Только то, что реально нужно модели каждый раз: стек, главные правила, табу. Всё остальное — в отдельные файлы, которые подтянутся через @, когда понадобятся.
Частые ошибки, на которых горят новички
- Кухонная мойка. Разные задачи в одном бесконечном чате. Лечится правилом «один чат — одна задача».
- Весь файл вместо нужного места. Вставляешь документ или проект целиком, хотя правка в трёх строчках. Покажи эти строчки.
- Бесконечные правки в одном чате. Десятая попытка чинить одно и то же забивает контекст неверными ходами. После двух неудач — чистый старт.
- Раздутый CLAUDE.md. Файл на тысячу строк жрёт токены в каждой сессии. Режь до сути.
- Ждать автосжатия. Сидишь до упора, пока инструмент не сожмёт сам. Жми
/compactраньше, по своей воле.
Дорого и тупо против дёшево и точно
Один и тот же вопрос можно задать так, что модель захлебнётся, а можно так, что она будет острой всю сессию. Смотри.
Так делать не надо:
А вот так — правильно:
auth.ts, там обработка ошибок — почему падает?Разница не в уме модели. Разница в том, чем ты завалил ей стол.
Чек-лист: ты управляешь контекстом
- Понимаешь, что модель перечитывает весь чат заново на каждый ответ.
- Знаешь про context rot: серединку длинного чата модель теряет.
- Живёшь по правилу «один чат — одна задача».
- Показываешь фрагмент, а не весь файл или проект.
- В claude.ai кладёшь файлы проекта в Projects, в Claude Code зовёшь их через
@. - Чат начал тупить — открыл новый и пересказал задачу коротко.
- В Claude Code различаешь
/clear(сброс) и/compact(сжатие) и жмёшь второй проактивно. - CLAUDE.md держишь коротким.
Контекстному окну в курсе «Claude Code: с нуля до Pro» посвящён отдельный урок — там учимся держать контекст чистым прямо в работе над своим проектом.
ИИ не тупеет от длинного разговора — он тонет в нём. Твоя работа простая: держать стол чистым, и тогда модель остаётся острой хоть весь день.
Теперь ты не просто пользуешься ИИ, а управляешь его памятью — а это половина мастерства. Если работаешь в терминале, закрепи базу в Claude Code с нуля. А когда захочешь выжать расход токенов до предела — для участников клуба есть отдельный разбор привычек экономии в «Как экономить токены».
Частые вопросы
Почему ИИ начинает тупить в длинном чате?
Модель не «помнит» разговор — на каждый ответ она перечитывает всю переписку заново, и чем длиннее чат, тем сильнее завален её рабочий стол. Хуже всего она держит середину длинного диалога — это context rot, и твои ранние инструкции уезжают именно туда. Лечится не уговорами, а чистым стартом: новый чат и короткий пересказ задачи.
Чем /clear отличается от /compact в Claude Code?
/clear стирает контекст начисто — жми его, когда переключаешься на другую задачу или модель залипла. /compact сворачивает историю в короткое саммари: суть остаётся, лишний объём уходит — это для длинной незаконченной задачи. Правило большого пальца: жми /compact проактивно, примерно когда контекст забит на две трети.
Что делать, если чат отупел прямо посреди задачи?
Не реанимируй его — открой новый чат и в двух фразах перескажи суть: что делаешь, какой стиль, что уже получилось. Минута на пересказ — и у тебя снова свежая модель с чистым столом. В Claude Code сначала попробуй откатиться (двойной Esc или /rewind), а совсем распухший чат сбрасывай через /clear.
Правда ли, что русский язык съедает контекст быстрее английского?
Да. Модель режет текст на токены, и русский она крошит примерно в два-три раза мельче английского. Один и тот же по смыслу текст на русском занимает заметно больше места в окне, поэтому твой контекст забивается быстрее.
Самое сложное в ИИ — начинать в одиночку.
Непонятные интерфейсы, страх задать «глупый» вопрос, десять вкладок с противоречивыми советами. В клубе с таких вопросов все начинали — спросишь и получишь ответ, а не осуждение.