# Контекстное окно в 2026: как не дать ИИ «отупеть» в длинном чате

> Контекстное окно — рабочая память ИИ на один чат. Разбираем, почему длинная переписка портит ответы (context rot) и как держать контекст чистым в браузере и в Claude Code.

Источник: https://aifirstclub.ru/guides/kontekstnoe-okno · AI First Club · 2026-06-22

Сидишь в одном чате час, задача большая, и вдруг замечаешь: ИИ будто поглупел. Путает то, о чём вы договорились в самом начале, повторяется, лепит ерунду, которую десять сообщений назад делал нормально. Дело не в плохом дне у модели. У неё кончается рабочая память. Сейчас разберёмся, что это за память, почему длинный чат реально портит ответы, и как этим управлять руками.

Если ты ещё ни разу не разговаривал с ИИ в браузере — сначала загляни в [Claude с нуля](/guides/claude-s-nulya). А тут считаем, что переписываться ты уже умеешь, и копнём глубже: что происходит у модели «в голове», пока вы общаетесь.

## Почему длинный чат начинает тупить

Представь рабочий стол. В начале он чистый: лежит одна задача, всё видно, ты быстро находишь нужное. Через час на нём сорок открытых бумажек, три недопитых кофе и стопка того, что уже не актуально. Найти что-то стало тяжело, и ты начинаешь ошибаться.

У ИИ так же. Его рабочий стол называют **контекстным окном** — это вся память модели на один диалог. Туда складывается всё подряд:

- **Твои сообщения** — каждый вопрос и каждая правка.
- **Ответы модели** — всё, что она написала за чат.
- **Прикреплённые файлы** — кинул документ или код, он тоже лёг на стол.

И вот ключевой момент, который мало кто понимает. Каждый раз, когда ты пишешь новое сообщение, модель отвечает не «с того места», а перечитывает **весь диалог заново**, с самой первой строчки. Память у неё не как у человека. Она не «помнит» — она каждый раз заново читает всю переписку, чтобы ответить.

Отсюда сразу два следствия. Длинный чат **дорожает** (модель прожёвывает всё больше текста на каждый ответ) и **тормозит**. Но это полбеды. Главная беда — дальше.

## Context rot: модель реально начинает отвечать хуже

Вот тезис, ради которого весь гайд. Дело не только в деньгах — по мере заполнения контекста модель начинает отвечать ХУЖЕ.

Этому даже есть название — context rot, «гниение контекста». Исследования показали штуку, которая ломает интуицию: модель помнит не весь диалог одинаково. Лучше всего она держит **самые последние** сообщения и **самые первые**. А вот серединку длинного чата начинает терять.

Понимаешь, чем это опасно? Инструкции и договорённости ты обычно даёшь в начале. «Пиши коротко», «не трогай этот файл», «вот мой стиль». Пока чат короткий, это работает. Но когда переписка раздулась, твои стартовые правила уезжают в ту самую теряемую зону, и модель про них будто забывает. Не потому что глупая. Просто стол завален, и до нижних бумажек руки уже не доходят.

> Когда длинный чат начал игнорировать твои ранние инструкции — не злись и не повторяй их в десятый раз. Это context rot, он есть у всех моделей. Лечится не уговорами, а чистым стартом: новый чат, где правила снова окажутся «свежими».

## Сколько «памяти» у твоей модели

Контекстное окно у разных ИИ разное по размеру, и для нас это важно на практике.

- **Claude по подписке** — окно очень большое, это сотни страниц текста за раз. У топовых моделей ещё больше. Длинную задачу с кучей материала он переварит спокойно.
- **ChatGPT в браузере** на обычной подписке — окно заметно меньше, у Claude его в разы больше. Для длинных вдумчивых задач с файлами в браузере Claude удобнее.

Точные цифры тут называть бессмысленно: они меняются каждые пару месяцев. Держи в голове порядок, а не число.

И отдельная боль для нас с тобой — **русский язык**. Модель режет текст на «кусочки» (их зовут токенами), и русский она крошит мельче английского, примерно в два-три раза. То есть один и тот же по смыслу текст на русском съедает заметно больше места в окне, чем на английском. Твой контекст забивается быстрее, чем у англоязычного пользователя. Знать это полезно: длинная русская простыня — дорого и тесно.

> Если хочется понять, что такое токены и почему за них берут деньги, это разобрано в гайде [«Токены, контекст и цены»](/guides/tokeny-i-ceny). Тут мы про другое — про стратегию, как не дать чату распухнуть и отупеть.

## Главное правило: один чат — одна задача

Если запомнить из всего гайда одну вещь, пусть будет эта. Один чат — одна задача.

Самая частая ошибка новичка — «кухонная мойка». Это когда в одну бесконечную переписку валят всё подряд: тут спросил про рецепт, там попросил код поправить, следом про отпуск посоветоваться. Модель таскает весь этот винегрет за собой и путается.

Сравни на живом примере. Сначала как делает большинство:

Помоги с постом для Telegram. (обсудили)
Готово, вот пост.
А теперь объясни, как настроить роутер.
И ещё переведи вот это письмо на английский.
(тащит в голове и пост, и роутер, и письмо — контекст забит мешаниной, ответы плывут)

А теперь по-человечески: новая тема — новый чат.

(чат №1) Помоги с постом для Telegram.
Готово, вот пост.
(новый чат №2) Объясни, как настроить роутер.
(чистый контекст, думает только про роутер — ответ точнее)

Каждая тема в своём чате. Звучит банально, но именно это держит ответы острыми весь день.

А когда чат всё-таки начал тупить прямо посреди задачи — не реанимируй его. Открой новый и в двух фразах перескажи суть. Вот такой коротенький бриф спасает чаще всего:

> **Промпт:**
> Я делаю пост для Telegram о запуске курса по вайб-кодингу. Стиль — простой, на «ты», без терминов, 3 коротких абзаца. Вот черновик, который уже получился: [вставь]. Продолжаем с этого места.

Минута на пересказ — и у тебя снова свежая модель с чистым столом вместо уставшей, которая всё путает.

## Показывай нужное, а не всё

Второй большой рычаг — не заваливать стол целиком. Модели не нужен весь твой проект, чтобы поправить одну строчку.

- **Прикладывай фрагмент, а не всё.** Нужна правка в одном месте — покажи это место, а не документ на сорок страниц.
- **В [claude.ai](https://claude.ai) используй Projects.** Это папка, куда ты один раз кладёшь файлы проекта. Дальше любой чат внутри проекта их «видит», и тебе не надо заново вставлять их в каждую переписку. Файлы лежат один раз, а не жгут контекст по новой каждый день.
- **В Claude Code давай ссылку на файл через `@`.** Не вставляй простыню кода в чат. Напиши `@auth.ts`, и Claude сам прочитает файл, причём только когда он реально понадобится.

## Claude Code: /clear и /compact — когда что

В браузере ты чистишь контекст, открывая новый чат. В [Claude Code](/guides/claude-code-s-nulya) для этого есть две команды, и путать их не надо.

Сначала про то, как вообще понять, что пора чистить. В Claude Code видно, насколько забит контекст — есть индикатор заполнения. Не жди, пока он упрётся в потолок и сработает автосжатие. Лучше вмешаться раньше.

Теперь сами команды:

- **`/clear` — полный сброс.** Стирает весь контекст начисто. Жми, когда переключаешься на другую задачу или когда модель залипла и третий ответ подряд несёт чушь. Чистый старт почти всегда лучше, чем уговаривать уставший чат.
- **`/compact` — сжать, но не терять.** Сворачивает историю в короткое саммари: суть остаётся, лишний объём уходит. Это для случая, когда задача длинная и ещё не закончена, а контекст уже распух.

Правило большого пальца — жми `/compact` **проактивно**, примерно когда контекст забит на две трети. Не жди, пока инструмент сожмёт сам в самый неподходящий момент. Ты сжимаешь по своей воле и контролируешь, что останется.

А ещё можно подсказать, что именно сохранить при сжатии:

> **Промпт:**
> /compact сохрани список изменённых файлов и открытые TODO

Вот короткий маршрут, как спасти залипший чат в Claude Code:

1. **Заметил, что модель тупит** — Третья правка подряд не помогает, ответы пошли по кругу — это сигнал, а не повод спорить с моделью.
2. **Реши: добить или бросить** — Задача почти готова и важно сохранить наработки — жми `/compact`. Зашёл в тупик или это уже другая задача — жми `/clear`.
3. **Если /compact — укажи, что важно** — Добавь инструкцию: какие файлы трогали, что ещё в планах. Саммари сохранит это, а мусор выкинет.
4. **Если /clear — дай короткий бриф заново** — После полного сброса в двух фразах опиши задачу с нуля. Свежий контекст — точные ответы.

> Простое правило: если две попытки исправить не сработали, не пиши третью в том же чате — контекст уже забит неверными ходами и тянет модель не туда. Сначала попробуй откатиться назад (двойной Esc или команда `/rewind`) и переформулировать точнее. А если чат совсем распух — `/clear` и зайди с чистого листа.

## CLAUDE.md держи как короткий бриф

Если ты завёл файл [CLAUDE.md](/guides/claude-md-kontekst-proekta) — это инструкция, которую Claude Code читает в начале **каждой** сессии. Удобно, но есть нюанс: раз он читается каждый раз, то и токены тратит каждый раз. Раздутый CLAUDE.md на тысячу строк тихо съедает контекст ещё до того, как ты задал первый вопрос.

Поэтому держи его коротким, ориентир — до двух сотен строк. Только то, что реально нужно модели каждый раз: стек, главные правила, табу. Всё остальное — в отдельные файлы, которые подтянутся через `@`, когда понадобятся.

## Частые ошибки, на которых горят новички

- **Кухонная мойка.** Разные задачи в одном бесконечном чате. Лечится правилом «один чат — одна задача».
- **Весь файл вместо нужного места.** Вставляешь документ или проект целиком, хотя правка в трёх строчках. Покажи эти строчки.
- **Бесконечные правки в одном чате.** Десятая попытка чинить одно и то же забивает контекст неверными ходами. После двух неудач — чистый старт.
- **Раздутый CLAUDE.md.** Файл на тысячу строк жрёт токены в каждой сессии. Режь до сути.
- **Ждать автосжатия.** Сидишь до упора, пока инструмент не сожмёт сам. Жми `/compact` раньше, по своей воле.

## Дорого и тупо против дёшево и точно

Один и тот же вопрос можно задать так, что модель захлебнётся, а можно так, что она будет острой всю сессию. Смотри.

Так делать не надо:

Вот мой проект, 5 файлов целиком, почему не работает? (вставляет тысячи строк кода)
(перечитывает все тысячи строк при каждом твоём следующем сообщении — к 30-му ответу контекст забит, модель путается и тупит)

А вот так — правильно:

Посмотри строки 45–78 в `auth.ts`, там обработка ошибок — почему падает?
(читает один небольшой кусок, контекст чистый — отвечает точно и держит форму всю сессию)

Разница не в уме модели. Разница в том, чем ты завалил ей стол.

## Чек-лист: ты управляешь контекстом

- Понимаешь, что модель перечитывает весь чат заново на каждый ответ.
- Знаешь про context rot: серединку длинного чата модель теряет.
- Живёшь по правилу «один чат — одна задача».
- Показываешь фрагмент, а не весь файл или проект.
- В [claude.ai](https://claude.ai) кладёшь файлы проекта в Projects, в Claude Code зовёшь их через `@`.
- Чат начал тупить — открыл новый и пересказал задачу коротко.
- В Claude Code различаешь `/clear` (сброс) и `/compact` (сжатие) и жмёшь второй проактивно.
- CLAUDE.md держишь коротким.

> Контекстному окну в курсе [«Claude Code: с нуля до Pro»](/courses/claude-code-s-nulya-do-pro) посвящён отдельный урок — там учимся держать контекст чистым прямо в работе над своим проектом.

ИИ не тупеет от длинного разговора — он тонет в нём. Твоя работа простая: держать стол чистым, и тогда модель остаётся острой хоть весь день.

---

Теперь ты не просто пользуешься ИИ, а управляешь его памятью — а это половина мастерства. Если работаешь в терминале, закрепи базу в [Claude Code с нуля](/guides/claude-code-s-nulya). А когда захочешь выжать расход токенов до предела — для участников клуба есть отдельный разбор привычек экономии в [«Как экономить токены»](/guides/kak-ekonomit-tokeny).

## Частые вопросы

### Почему ИИ начинает тупить в длинном чате?
Модель не «помнит» разговор — на каждый ответ она перечитывает всю переписку заново, и чем длиннее чат, тем сильнее завален её рабочий стол. Хуже всего она держит середину длинного диалога — это context rot, и твои ранние инструкции уезжают именно туда. Лечится не уговорами, а чистым стартом: новый чат и короткий пересказ задачи.

### Чем /clear отличается от /compact в Claude Code?
`/clear` стирает контекст начисто — жми его, когда переключаешься на другую задачу или модель залипла. `/compact` сворачивает историю в короткое саммари: суть остаётся, лишний объём уходит — это для длинной незаконченной задачи. Правило большого пальца: жми `/compact` проактивно, примерно когда контекст забит на две трети.

### Что делать, если чат отупел прямо посреди задачи?
Не реанимируй его — открой новый чат и в двух фразах перескажи суть: что делаешь, какой стиль, что уже получилось. Минута на пересказ — и у тебя снова свежая модель с чистым столом. В Claude Code сначала попробуй откатиться (двойной Esc или `/rewind`), а совсем распухший чат сбрасывай через `/clear`.

### Правда ли, что русский язык съедает контекст быстрее английского?
Да. Модель режет текст на токены, и русский она крошит примерно в два-три раза мельче английского. Один и тот же по смыслу текст на русском занимает заметно больше места в окне, поэтому твой контекст забивается быстрее.