← вся программа
Новичок бесплатноконтексттокеныосновы

Контекстное окно в 2026: как не дать ИИ «отупеть» в длинном чате

22 июня 2026 г. · 13 мин чтения

Контекстное окно в 2026: как не дать ИИ «отупеть» в длинном чате

Сидишь в одном чате час, задача большая, и вдруг замечаешь: ИИ будто поглупел. Путает то, о чём вы договорились в самом начале, повторяется, лепит ерунду, которую десять сообщений назад делал нормально. Дело не в плохом дне у модели. У неё кончается рабочая память. Сейчас разберёмся, что это за память, почему длинный чат реально портит ответы, и как этим управлять руками.

Если ты ещё ни разу не разговаривал с ИИ в браузере — сначала загляни в Claude с нуля. А тут считаем, что переписываться ты уже умеешь, и копнём глубже: что происходит у модели «в голове», пока вы общаетесь.

Почему длинный чат начинает тупить

Представь рабочий стол. В начале он чистый: лежит одна задача, всё видно, ты быстро находишь нужное. Через час на нём сорок открытых бумажек, три недопитых кофе и стопка того, что уже не актуально. Найти что-то стало тяжело, и ты начинаешь ошибаться.

У ИИ так же. Его рабочий стол называют контекстным окном — это вся память модели на один диалог. Туда складывается всё подряд:

  • Твои сообщения — каждый вопрос и каждая правка.
  • Ответы модели — всё, что она написала за чат.
  • Прикреплённые файлы — кинул документ или код, он тоже лёг на стол.

И вот ключевой момент, который мало кто понимает. Каждый раз, когда ты пишешь новое сообщение, модель отвечает не «с того места», а перечитывает весь диалог заново, с самой первой строчки. Память у неё не как у человека. Она не «помнит» — она каждый раз заново читает всю переписку, чтобы ответить.

Отсюда сразу два следствия. Длинный чат дорожает (модель прожёвывает всё больше текста на каждый ответ) и тормозит. Но это полбеды. Главная беда — дальше.

Context rot: модель реально начинает отвечать хуже

Схема: три стадии заполнения контекстного окна
Свежий чат точен, переполненный — путает и забывает. Не доводи до красной зоны.

Вот тезис, ради которого весь гайд. Дело не только в деньгах — по мере заполнения контекста модель начинает отвечать ХУЖЕ.

Этому даже есть название — context rot, «гниение контекста». Исследования показали штуку, которая ломает интуицию: модель помнит не весь диалог одинаково. Лучше всего она держит самые последние сообщения и самые первые. А вот серединку длинного чата начинает терять.

Понимаешь, чем это опасно? Инструкции и договорённости ты обычно даёшь в начале. «Пиши коротко», «не трогай этот файл», «вот мой стиль». Пока чат короткий, это работает. Но когда переписка раздулась, твои стартовые правила уезжают в ту самую теряемую зону, и модель про них будто забывает. Не потому что глупая. Просто стол завален, и до нижних бумажек руки уже не доходят.

это не баг, это свойство

Когда длинный чат начал игнорировать твои ранние инструкции — не злись и не повторяй их в десятый раз. Это context rot, он есть у всех моделей. Лечится не уговорами, а чистым стартом: новый чат, где правила снова окажутся «свежими».

Сколько «памяти» у твоей модели

Контекстное окно у разных ИИ разное по размеру, и для нас это важно на практике.

  • Claude по подписке — окно очень большое, это сотни страниц текста за раз. У топовых моделей ещё больше. Длинную задачу с кучей материала он переварит спокойно.
  • ChatGPT в браузере на обычной подписке — окно заметно меньше, у Claude его в разы больше. Для длинных вдумчивых задач с файлами в браузере Claude удобнее.

Точные цифры тут называть бессмысленно: они меняются каждые пару месяцев. Держи в голове порядок, а не число.

И отдельная боль для нас с тобой — русский язык. Модель режет текст на «кусочки» (их зовут токенами), и русский она крошит мельче английского, примерно в два-три раза. То есть один и тот же по смыслу текст на русском съедает заметно больше места в окне, чем на английском. Твой контекст забивается быстрее, чем у англоязычного пользователя. Знать это полезно: длинная русская простыня — дорого и тесно.

про токены отдельно

Если хочется понять, что такое токены и почему за них берут деньги, это разобрано в гайде «Токены, контекст и цены». Тут мы про другое — про стратегию, как не дать чату распухнуть и отупеть.

Главное правило: один чат — одна задача

Если запомнить из всего гайда одну вещь, пусть будет эта. Один чат — одна задача.

Самая частая ошибка новичка — «кухонная мойка». Это когда в одну бесконечную переписку валят всё подряд: тут спросил про рецепт, там попросил код поправить, следом про отпуск посоветоваться. Модель таскает весь этот винегрет за собой и путается.

Сравни на живом примере. Сначала как делает большинство:

ты
Помоги с постом для Telegram. (обсудили)
Claude
Готово, вот пост.
ты
А теперь объясни, как настроить роутер.
ты
И ещё переведи вот это письмо на английский.
Claude
(тащит в голове и пост, и роутер, и письмо — контекст забит мешаниной, ответы плывут)

А теперь по-человечески: новая тема — новый чат.

ты
(чат №1) Помоги с постом для Telegram.
Claude
Готово, вот пост.
ты
(новый чат №2) Объясни, как настроить роутер.
Claude
(чистый контекст, думает только про роутер — ответ точнее)

Каждая тема в своём чате. Звучит банально, но именно это держит ответы острыми весь день.

А когда чат всё-таки начал тупить прямо посреди задачи — не реанимируй его. Открой новый и в двух фразах перескажи суть. Вот такой коротенький бриф спасает чаще всего:

промпт

Я делаю пост для Telegram о запуске курса по вайб-кодингу. Стиль — простой, на «ты», без терминов, 3 коротких абзаца. Вот черновик, который уже получился: [вставь]. Продолжаем с этого места.

Минута на пересказ — и у тебя снова свежая модель с чистым столом вместо уставшей, которая всё путает.

Показывай нужное, а не всё

Второй большой рычаг — не заваливать стол целиком. Модели не нужен весь твой проект, чтобы поправить одну строчку.

  • Прикладывай фрагмент, а не всё. Нужна правка в одном месте — покажи это место, а не документ на сорок страниц.
  • В claude.ai используй Projects. Это папка, куда ты один раз кладёшь файлы проекта. Дальше любой чат внутри проекта их «видит», и тебе не надо заново вставлять их в каждую переписку. Файлы лежат один раз, а не жгут контекст по новой каждый день.
  • В Claude Code давай ссылку на файл через @. Не вставляй простыню кода в чат. Напиши @auth.ts, и Claude сам прочитает файл, причём только когда он реально понадобится.
Автоподсказка @файл в Claude Code
Набираешь @ и пару букв — агент подсказывает файлы проекта; в контекст уйдёт только выбранное.
Страница Projects в claude.ai
Projects: файлы проекта лежат один раз и доступны всем чатам внутри — не жгут контекст заново.

Claude Code: /clear и /compact — когда что

В браузере ты чистишь контекст, открывая новый чат. В Claude Code для этого есть две команды, и путать их не надо.

Сначала про то, как вообще понять, что пора чистить. В Claude Code видно, насколько забит контекст — есть индикатор заполнения. Не жди, пока он упрётся в потолок и сработает автосжатие. Лучше вмешаться раньше.

Вывод /context: заполнение окна по категориям
/context показывает, чем занято окно: системный промпт, инструменты, сообщения — и сколько свободно.

Теперь сами команды:

  • /clear — полный сброс. Стирает весь контекст начисто. Жми, когда переключаешься на другую задачу или когда модель залипла и третий ответ подряд несёт чушь. Чистый старт почти всегда лучше, чем уговаривать уставший чат.
  • /compact — сжать, но не терять. Сворачивает историю в короткое саммари: суть остаётся, лишний объём уходит. Это для случая, когда задача длинная и ещё не закончена, а контекст уже распух.

Правило большого пальца — жми /compact проактивно, примерно когда контекст забит на две трети. Не жди, пока инструмент сожмёт сам в самый неподходящий момент. Ты сжимаешь по своей воле и контролируешь, что останется.

А ещё можно подсказать, что именно сохранить при сжатии:

промпт

/compact сохрани список изменённых файлов и открытые TODO

Вот короткий маршрут, как спасти залипший чат в Claude Code:

1
Заметил, что модель тупит
Третья правка подряд не помогает, ответы пошли по кругу — это сигнал, а не повод спорить с моделью.
2
Реши: добить или бросить
Задача почти готова и важно сохранить наработки — жми /compact. Зашёл в тупик или это уже другая задача — жми /clear.
3
Если /compact — укажи, что важно
Добавь инструкцию: какие файлы трогали, что ещё в планах. Саммари сохранит это, а мусор выкинет.
4
Если /clear — дай короткий бриф заново
После полного сброса в двух фразах опиши задачу с нуля. Свежий контекст — точные ответы.
застрял после двух правок — не долби в одном чате

Простое правило: если две попытки исправить не сработали, не пиши третью в том же чате — контекст уже забит неверными ходами и тянет модель не туда. Сначала попробуй откатиться назад (двойной Esc или команда /rewind) и переформулировать точнее. А если чат совсем распух — /clear и зайди с чистого листа.

CLAUDE.md держи как короткий бриф

Если ты завёл файл CLAUDE.md — это инструкция, которую Claude Code читает в начале каждой сессии. Удобно, но есть нюанс: раз он читается каждый раз, то и токены тратит каждый раз. Раздутый CLAUDE.md на тысячу строк тихо съедает контекст ещё до того, как ты задал первый вопрос.

Поэтому держи его коротким, ориентир — до двух сотен строк. Только то, что реально нужно модели каждый раз: стек, главные правила, табу. Всё остальное — в отдельные файлы, которые подтянутся через @, когда понадобятся.

Частые ошибки, на которых горят новички

  • Кухонная мойка. Разные задачи в одном бесконечном чате. Лечится правилом «один чат — одна задача».
  • Весь файл вместо нужного места. Вставляешь документ или проект целиком, хотя правка в трёх строчках. Покажи эти строчки.
  • Бесконечные правки в одном чате. Десятая попытка чинить одно и то же забивает контекст неверными ходами. После двух неудач — чистый старт.
  • Раздутый CLAUDE.md. Файл на тысячу строк жрёт токены в каждой сессии. Режь до сути.
  • Ждать автосжатия. Сидишь до упора, пока инструмент не сожмёт сам. Жми /compact раньше, по своей воле.

Дорого и тупо против дёшево и точно

Один и тот же вопрос можно задать так, что модель захлебнётся, а можно так, что она будет острой всю сессию. Смотри.

Так делать не надо:

ты
Вот мой проект, 5 файлов целиком, почему не работает? (вставляет тысячи строк кода)
Claude
(перечитывает все тысячи строк при каждом твоём следующем сообщении — к 30-му ответу контекст забит, модель путается и тупит)

А вот так — правильно:

ты
Посмотри строки 45–78 в auth.ts, там обработка ошибок — почему падает?
Claude
(читает один небольшой кусок, контекст чистый — отвечает точно и держит форму всю сессию)

Разница не в уме модели. Разница в том, чем ты завалил ей стол.

Чек-лист: ты управляешь контекстом

  • Понимаешь, что модель перечитывает весь чат заново на каждый ответ.
  • Знаешь про context rot: серединку длинного чата модель теряет.
  • Живёшь по правилу «один чат — одна задача».
  • Показываешь фрагмент, а не весь файл или проект.
  • В claude.ai кладёшь файлы проекта в Projects, в Claude Code зовёшь их через @.
  • Чат начал тупить — открыл новый и пересказал задачу коротко.
  • В Claude Code различаешь /clear (сброс) и /compact (сжатие) и жмёшь второй проактивно.
  • CLAUDE.md держишь коротким.
хочешь по шагам и с практикой

Контекстному окну в курсе «Claude Code: с нуля до Pro» посвящён отдельный урок — там учимся держать контекст чистым прямо в работе над своим проектом.

ИИ не тупеет от длинного разговора — он тонет в нём. Твоя работа простая: держать стол чистым, и тогда модель остаётся острой хоть весь день.


Теперь ты не просто пользуешься ИИ, а управляешь его памятью — а это половина мастерства. Если работаешь в терминале, закрепи базу в Claude Code с нуля. А когда захочешь выжать расход токенов до предела — для участников клуба есть отдельный разбор привычек экономии в «Как экономить токены».

Частые вопросы

Почему ИИ начинает тупить в длинном чате?

Модель не «помнит» разговор — на каждый ответ она перечитывает всю переписку заново, и чем длиннее чат, тем сильнее завален её рабочий стол. Хуже всего она держит середину длинного диалога — это context rot, и твои ранние инструкции уезжают именно туда. Лечится не уговорами, а чистым стартом: новый чат и короткий пересказ задачи.

Чем /clear отличается от /compact в Claude Code?

/clear стирает контекст начисто — жми его, когда переключаешься на другую задачу или модель залипла. /compact сворачивает историю в короткое саммари: суть остаётся, лишний объём уходит — это для длинной незаконченной задачи. Правило большого пальца: жми /compact проактивно, примерно когда контекст забит на две трети.

Что делать, если чат отупел прямо посреди задачи?

Не реанимируй его — открой новый чат и в двух фразах перескажи суть: что делаешь, какой стиль, что уже получилось. Минута на пересказ — и у тебя снова свежая модель с чистым столом. В Claude Code сначала попробуй откатиться (двойной Esc или /rewind), а совсем распухший чат сбрасывай через /clear.

Правда ли, что русский язык съедает контекст быстрее английского?

Да. Модель режет текст на токены, и русский она крошит примерно в два-три раза мельче английского. Один и тот же по смыслу текст на русском занимает заметно больше места в окне, поэтому твой контекст забивается быстрее.

Самое сложное в ИИ — начинать в одиночку.

Непонятные интерфейсы, страх задать «глупый» вопрос, десять вкладок с противоречивыми советами. В клубе с таких вопросов все начинали — спросишь и получишь ответ, а не осуждение.