Лимиты Claude Code: контекст, расход и как экономить
Какие лимиты бывают у Claude Code, куда на самом деле уходит контекст, какие приёмы реально сокращают расход и как заметить приближение лимита до того, как работа встанет.
Все статьи гида Claude Code · 13
Слово «лимит» здесь означает три разные вещи, и путаница между ними стоит и денег, и времени.
Какие лимиты бывают
Окно контекста. Сколько текста модель держит перед глазами в одном разговоре. Кончается изнутри сессии и проявляется тем, что агент забывает начало.
Лимит тарифа. Сколько вы можете использовать за период по подписке. Кончается снаружи и проявляется тем, что запросы перестают проходить до сброса окна.
Лимит одного ответа. Сколько модель может выдать за раз. Проявляется обрывом на середине - особенно заметно, когда просите сгенерировать большой файл целиком.
Симптомы разные, и лечение разное: первое лечится гигиеной сессии, второе - тарифом или ключом API, третье - разбиением задачи.
Куда уходит контекст
Практически весь расход - это не ваши сообщения. Ваши сообщения занимают проценты.
- Прочитанные файлы. Агент открыл файл на тысячу строк, чтобы поправить одну функцию, - весь файл теперь в контексте.
- Вывод команд. Лог сборки, вывод тестов, результат поиска по репозиторию. Одна неудачная команда с многословным выводом съедает больше, чем весь ваш диалог.
- История правок. Каждая внесённая правка остаётся в разговоре.
- Постоянные файлы проекта. Описание проекта читается в начале каждой сессии. Если оно разрослось до полутора тысяч строк, вы платите за него в каждой задаче.
Отсюда главный вывод: экономия контекста - это управление тем, что агент читает, а не тем, как вы формулируете.
Приёмы экономии
По убыванию эффекта:
- Одна сессия - одна задача. Самый действенный приём. Закончили - очистили контекст. Продолжение длинного диалога стоит дороже и работает хуже.
- Давайте точный адрес. «Посмотри функцию разбора в этом файле» вместо «разберись, почему не работает парсер». Во втором случае агент прочитает пол-репозитория, чтобы найти то, что вы и так знали.
- Не просите вывалить большие файлы в чат. Пусть агент правит файл, а не печатает его целиком.
- Держите описание проекта коротким. В нём должно быть то, что нужно всегда. Процедуры выносите в скиллы, которые подключаются по ситуации.
- Делегируйте разведку субагенту. Поиск по большому репозиторию вернёт вам вывод на три страницы. Субагент прочитает всё это у себя и вернёт краткий ответ.
- Берите модель по задаче. Рутина не требует самой дорогой модели - см. выбор модели.
- Сжимайте контекст осознанно. Сжатие лучше, чем упереться в предел, но хуже, чем начать чисто: при сжатии часть деталей теряется навсегда.
Как заметить приближение лимита
Три сигнала, по которым видно, что пора останавливаться:
- Индикатор контекста подошёл к трём четвертям. Это момент завершить шаг, а не начинать новый.
- Агент повторяет то, что уже делал, или заново читает файл, который читал десять минут назад. Значит, ранняя история уже свёрнута.
- Ответы стали общими. Конкретика ушла из контекста, и модель отвечает по общим знаниям вместо вашего проекта.
Правильная реакция на все три - зафиксировать результат в коде и в коммите, а затем начать новую сессию. Незакоммиченная работа в конце длинной сессии - худшее сочетание из возможных: контекст кончается ровно тогда, когда терять его дороже всего.
Что дальше
Про выбор модели и её влияние на расход - отдельная статья. Про то, что вообще происходит с контекстом в агентных системах, есть разбор в блоге: бюджет контекста агента. Общая картина - гид по Claude Code.
Вопросы и ответы
Почему Claude Code начал отвечать хуже к концу сессии?
Контекст заполнился, и часть ранней истории была свёрнута в краткий пересказ. Детали теряются, а агент продолжает работать так, будто помнит их. Это главный аргумент за короткие сессии: чистый контекст под новую задачу почти всегда даёт лучший результат, чем продолжение длинного диалога.
Как понять, сколько контекста осталось?
Инструмент показывает заполненность контекста, и на неё стоит смотреть так же, как на индикатор топлива. Когда остаётся четверть, разумно закончить текущий шаг и начать новую сессию, а не запускать в этом же окне ещё одну большую задачу.
Что дороже - длинный диалог или несколько коротких?
Длинный диалог. Каждый следующий запрос отправляет весь накопленный контекст заново, поэтому стоимость шага растёт по мере разговора. Три короткие сессии под три задачи обходятся дешевле, чем одна сессия, где эти же задачи шли подряд.
Ещё по теме
- Claude Code: полный практический гидГид
- Claude Code в России: доступ, оплата и ограниченияЧто именно не работает у Claude Code из России, какие способы оплаты остаются, как отличить проблему доступа от ошибки конфигурации и что стоит понимать про правила сервиса и риск блокировки аккаунта.
- Claude Code API key: где взять и как подключитьГде создаётся ключ API для Claude Code, куда его класть, чем свой ключ отличается от подписки по деньгам и правам, и что делать при ошибке 401.
- Claude Code CLI: команды, флаги и режимыКак запускается Claude Code, какие есть режимы разрешений, какие флаги реально пригодятся в работе и что стоит один раз вынести в конфигурацию проекта вместо повторения руками.
Сделаю под ключ
Нужен результат, а не настройка агента? Соберу ваш MVP
Я каждый день работаю с Claude Code и довожу продукты до пользователей.
от 1 500 $ · 1-2 недели