Гайд · Claude Code · сентябрь 2026
Как экономить лимит Claude Code в 2026: 5 шагов за 4 минуты
Лимит съедает не твой вопрос, а вся переписка сессии: она уезжает к модели заново с каждым сообщением. Открой Claude Code, набери /context и запиши верхнее число, это твой постоянный налог. Дальше по шагам. Перед каждой новой задачей набирай /clear, не тяни вчерашнюю сессию. Потом вставь по очереди две строки и нажимай Enter:
/plugin marketplace add DietrichGebert/ponytail
/plugin install ponytail@ponytail
Перезапусти Claude Code, набери /ponytail full, повтори /context на той же задаче и сравни с записанным числом. Третий шаг: поставь graphify и дай ему построить карту проекта, чтобы модель перестала перечитывать файлы поиском. Четвёртый: перенеси свои длинные инструкции из CLAUDE.md в навыки, которые грузятся по вызову. Пятый: подними шлюз OmniRoute, чтобы работа не вставала, когда лимит всё-таки кончился. Четыре минуты работы, и расход перестаёт утекать в пустоту. Ниже цифры: сколько каждый шаг реально экономит и сколько сам стоит
Экономия держится на одном: не таскать за собой то, что программа уже отправляла раньше. Бесплатная часть даёт больше всего - обнулять разговор между несвязанными задачами командой /clear и держать файл памяти проекта короче двухсот строк. Платная часть это четыре надстройки: Ponytail, Graphify, agent-skills и шлюз OmniRoute на 352 провайдера. Первые три вместе висят на 3 610 единиц контекста постоянно, четвёртая работает снаружи и контекст не занимает вообще. По независимой проверке JetBrains выигрыш Ponytail 10,3% стоимости, а не 54%, как обещает автор. Любую цифру перепроверяй замером до и после на одной и той же работе
Куда на самом деле уходит лимит
Механика простая, и она написана прямым текстом в документации Claude Code: программа отправляет модели всю переписку с каждым запросом. Вопрос в одну строку в сессии, которая открыта с утра, тянет за собой весь разговор целиком.
Я разобрал журналы 300 своих рабочих сессий, 118 870 обращений к модели. Читал только числа расхода, тексты не трогал. Вот что вышло:
всего контекста отправлено 40 241 630 504
из них старый контекст 38 798 545 358 (96,4%)
ответы модели 125 337 481 (0,31%)
медиана на первом ответе 71 250
медиана самого тяжёлого запроса 286 762
Девяносто шесть единиц из каждых ста оплаченных это то, что уже было сказано раньше. Твои свежие слова живут в оставшихся четырёх. Отсюда и вывод: экономия это не «писать короче», а не таскать за собой лишнее.
Есть ещё второй слой, который многие не замечают. Медиана 71 250 на первом же ответе означает: сессия стартует уже с полным рюкзаком. Это системная часть, описания инструментов, память проекта и короткие карточки всех твоих навыков. Ты ещё ничего не спросил, а налог уже начислен. Подробнее про то, из чего вообще собирается это окно, у меня есть отдельный разбор.
Разбор 21.09.2026 по локальным журналам 300 рабочих сессий и 118 870 обращений к модели: суммарный контекст 40 241 630 504 единицы, из них повторно присланный старый контекст 38 798 545 358, это 96,4%. Медиана контекста на первом ответе сессии 71 250, нижняя четверть 68 830, верхняя 73 847. Медиана самого тяжёлого запроса сессии 286 762.
Шаг 1: срезать налог старта, это бесплатно
Самый большой выигрыш не стоит ни копейки и делается четырьмя командами. Набери в Claude Code:
/context
Он покажет, из чего собран твой рюкзак: системная часть, инструменты, память, описания внешних подключений. Смотри на строки, которые весят больше тысячи, и решай по каждой, нужна ли она тебе сегодня.
Дальше три действия по убыванию выгоды.
| Что срезаешь | Чем | Цена приёма | Когда делать |
|---|---|---|---|
| вчерашний разговор | /clear | ноль | перед каждой новой задачей |
| подключения, которыми не пользуешься | /mcp | ноль | раз в неделю |
| раздутую память проекта | правка CLAUDE.md | полчаса один раз | если файл длиннее двухсот строк |
Таблица прокручивается вбок →
Первое: /clear между несвязанными задачами. Это обнуление разговора, оно стоит ноль. Многие вместо него жмут /compact, и это ошибка: сжатие само по себе дорогое, потому что модель сначала прочитывает всю историю, которую собирается ужать. Сжимать имеет смысл, когда внутри одной задачи ты правда не можешь потерять контекст, и тогда лучше с указанием, что сохранить: /compact оставь только решения по схеме базы.
Второе: погаси внешние подключения, которыми сегодня не пользуешься, командой /mcp. Описания инструментов у таких подключений по умолчанию отложены, в рюкзак попадают только имена, но десяток лишних серверов всё равно набегает.
Третье: посмотри на свой CLAUDE.md. Файл памяти грузится ВСЕГДА, целиком, в каждую сессию. В документации Claude Code прямо написано держать его короче двухсот строк, а методички выносить в навыки, которые подтягиваются только когда нужны. Если у тебя там лежит трёхсотстрочная инструкция про деплой, ты платишь за неё каждый раз, когда правишь вёрстку.
Шаг 2: Ponytail, чтобы модель не писала лишнего
Ponytail это надстройка, которая заставляет модель отвечать короче и писать компактнее, не меняя сути ответа. Ставится двумя строками прямо внутри Claude Code:
/plugin marketplace add DietrichGebert/ponytail
/plugin install ponytail@ponytail
Если вместо зелёной галочки выпала красная строка «Host key verification failed», установка упёрлась не в тебя: каталог тянет довесок с GitHub по закрытому каналу, для которого нужен личный ключ, а его на машине нет. Выйди из Claude Code клавишей Esc, открой окно для ввода команд («Терминал» на Mac, «PowerShell» на Windows) и вставь ровно эту строку:
git config --global url."https://github.com/".insteadOf [email protected]:
Она дописывает одно правило в твой личный файл настроек ~/.gitconfig и переводит скачивание на обычный веб-адрес. Ничего не удаляет и не ломает. Нажми Enter, ответа не будет, это нормально. Вернись в Claude Code и повтори команду установки: теперь пройдёт до строки с именем пакета и зелёной галочкой.
После установки перезапусти Claude Code. Уровень работы задаётся одной командой, значений четыре: /ponytail lite, /ponytail full, /ponytail ultra, /ponytail off. Начинай с full, это рабочая середина. Если ставишь Claude Code на нескольких машинах, уровень можно зафиксировать переменной PONYTAIL_DEFAULT_MODE, тогда он не будет слетать.
Сколько он экономит, зависит от того, чьим цифрам верить. Авторы у себя в проекте показывают минус 54% кода и минус 22% расхода. В JetBrains прогнали независимую проверку: 80 парных задач на одной модели и одной версии Claude Code, с Ponytail и без. Там вышло скромнее: минус 15,4% написанного кода, минус 10,3% стоимости, минус 11% времени. По качеству результата разницы не нашли вообще: 65 задач из 80 одинаковые, 9 хуже, 6 лучше. И важная деталь оттуда же: на крупных сборках экономия доходит до минус 31%, а на мелких правках близка к нулю.
Если ставишь надстройки впервые и не понимаешь, что такое каталог и чем он отличается от самого пакета, начни с пошаговой установки плагинов, там это разобрано с нуля.
Шаг 3: Graphify, чтобы агент не перечитывал файлы
Самая обидная утечка выглядит так: ты просишь поправить одну функцию, а модель уходит шарить по проекту поиском, читает пятнадцать файлов целиком и складывает их в контекст. Через три таких захода твоё окно забито чужим кодом.
Graphify строит из проекта карту связей и подставляет её вместо чтения файлов подряд. Ставится он не через каталог, а через Python:
pip install graphifyy
graphify install
graphify claude install
Первая строка ставит сам инструмент, для неё нужен Python. Набери pip --version и нажми Enter: если увидел номер версии, всё на месте. Если выпало «command not found», попробуй python3 -m pip install graphifyy, а если и python3 не нашёлся, поставь Python с сайта python.org и открой окно команд заново.
Третья строка прописывает Claude Code отдельную запись в память проекта и вешает перехват на поиск по файлам: когда агент собирается грепать, его разворачивают к карте. Дальше работают три команды: /graphify query ищет по смыслу, /graphify path показывает, что с чем связано, /graphify explain объясняет кусок кода по карте, а не по перечитанным файлам. Чтобы карта не устаревала, привяжи её пересборку к каждому сохранению правок в проекте. Вставь строку graphify hook install и нажми Enter: дальше карта обновляется сама.
Оговорка честная: карта, построенная неделю назад на другой ветке, хуже чем её отсутствие. Модель уверенно ответит по устаревшим связям, а ты не поймёшь, откуда взялась ерунда. Поставь автоматическое обновление сразу, не откладывай.
Шаг 4: вынести свои инструкции из памяти в навыки
Это продолжение первого шага, но руками его делать долго. Идея такая: всё, что лежит в CLAUDE.md, висит в контексте постоянно, а навык грузится только когда модель поняла, что он нужен. В контексте от навыка всегда висит одна короткая карточка, тело подтягивается в момент вызова.
Готовый набор таких навыков ставится двумя строками:
/plugin marketplace add addyosmani/agent-skills
/plugin install agent-skills@addy-agent-skills
Собрал набор Адди Османи, экс-директор Google Cloud AI по разработке для Gemini: ушёл из Google в 2026 после 14 лет и сейчас работает в Anthropic над самим Claude Code. Сам репозиторий заявляет «25 навыков: 24 базовых плюс один служебный, который объясняет остальные» - это и есть число из ролика. Я поставил пакет в отдельный профиль и пересчитал командой claude plugin details: живых навыков оказалось 34, плюс 4 отдельных помощника. Ставить на веру ни то, ни другое число не стоит, верь своей установке. Плюс девять команд вроде /spec, /plan, /build, /test, /review, /ship, и сами навыки включаются по форме задачи, руками их звать не нужно. Считать здесь нужно не сколько всего навыков лежит в пакете, а сколько ты реально вынес из своего CLAUDE.md в навыки: планирование, тесты, ревью, а не то, что нужно каждую минуту
Вот цена вопроса, я поставил все три надстройки в отдельный профиль и снял её командой claude plugin details:
| Надстройка | Версия | Постоянно в контексте | Тело по вызову |
|---|---|---|---|
| Graphify | 1.0.0 | 93 | 8 100 |
| Ponytail | 4.10.0 | 676 | 1 400 |
| agent-skills | 0.6.10 | 2 841 | от 140 до 5 300 на навык |
| Итого | 3 610 |
Таблица прокручивается вбок →
Три тысячи шестьсот единиц это плата за вход, около 5% от моей медианы налога старта. Ponytail и Graphify отбивают её сразу. А вот agent-skills окупается только если ты правда вынес из своего CLAUDE.md больше 2 841 единицы. Не вынес и просто поставил сверху: стало хуже, а не лучше.
Шаг 5: OmniRoute, чтобы шлюз сам переключил модель, когда лимит кончился
Четыре приёма выше растягивают то, что уже есть, но ни один не спасает, когда лимит всё-таки обнулился посреди работы. Для этого случая ставится отдельная вещь, шлюз OmniRoute: он встаёт между Claude Code и моделями и сам уводит запрос на другого провайдера, когда у текущего кончилась квота. В отличие от трёх прошлых надстроек, он не сидит в твоём контексте ни единицей: это отдельная программа на твоём компьютере, а не плагин Claude Code
Ставится одной командой, требует Node:
npm install -g omniroute
omniroute
Вторая строка поднимает панель на http://localhost:20128. Дальше в настройках Claude Code (~/.claude/settings.json) прописываешь адрес шлюза вместо адреса Anthropic и ключ, который шлюз сам выдаёт в своей панели. На 21 сентября 2026 года в реестре шлюза 352 провайдера, 154 из них с пометкой «бесплатный доступ». Панель по умолчанию открыта без ключа и с паролем CHANGEME, это задокументированный риск, лечится сменой пароля и настройкой REQUIRE_API_KEY=true. Полный порядок подключения, проверка через /status и разбор, что делать с паролем панели по умолчанию, у меня разобраны отдельно, это на 10 минут: OmniRoute для Claude Code: шлюз за 10 минут и три строки. Здесь я эту дорогу не повторяю, чтобы не пересказывать вторую статью внутри этой
Как проверить, что экономия реальная
Ни одно число выше не стоит принимать на веру, включая мои. Замер делается за пять минут и на своей работе.
Возьми одну настоящую задачу, не игрушечную. Выполни её в чистой сессии без надстроек и сразу после ответа набери /context, запиши верхнее число. Потом /clear, включи надстройки, повтори ту же задачу тем же запросом и снова /context. Сравнивай одинаковое с одинаковым: один и тот же проект, одна и та же формулировка, одна и та же модель.
Дальше три отчёта, которые показывают разное.
| Отчёт | Что показывает | Когда смотреть |
|---|---|---|
/context | из чего собран рюкзак прямо сейчас | до и после каждого изменения |
/usage | расход по тарифу и разбивку по надстройкам в процентах | когда ищешь утечку |
/insights | картину за неделю, тренд вместо одного дня | раз в неделю |
claude plugin details | постоянную цену конкретной надстройки | перед установкой новой |
Таблица прокручивается вбок →
/context показывает срез прямо сейчас: из чего собран рюкзак в эту секунду. Это инструмент для шага 1.
/usage показывает расход по твоему тарифу и, что важнее, разбивку: какие навыки, помощники, надстройки и внешние подключения сколько съели в процентах. Там же подсвечивается поведение, которое утянуло больше десятой части расхода. Если в этом списке первым стоит что-то, чем ты сегодня не пользовался, ты нашёл свою утечку.
/insights показывает картину за неделю, по ней видно тренд, а не один удачный день.
И отдельно: claude plugin details имя@каталог печатает строку «Always-on», ту самую постоянную цену надстройки. Прогони её по всему, что у тебя стоит, прежде чем ставить что-то ещё. Если считаешь расход не по подписке, а по ключу, там другая арифметика, она разобрана в статье про расход по API.
Ещё одна вещь, которую стоит знать про замеры: кэш живёт час на подписке и пять минут на кредитах. Вернулся в большую сессию после обеда, и первое же сообщение оплатило весь контекст заново по полной цене. Это не баг, это правило игры, и оно сильно портит замеры, если гонять их с перерывами.
Где экономия бьёт по качеству
Честно про обратную сторону, четыре места.
Ponytail на мелких правках не даёт почти ничего, зато дисциплина короткого ответа иногда срезает пояснение, которое тебе как раз было нужно. В независимой проверке 9 задач из 80 вышли хуже. Не катастрофа, но и не ноль.
Graphify с устаревшей картой уверенно врёт. Сама она не пересобирается, пока не включишь автоматическое обновление строкой graphify hook install.
/clear посреди задачи стирает то, до чего вы с моделью уже договорились. Чистить надо между задачами, а не внутри одной.
Вынос инструкций в навыки работает, пока навык вызывается. Если модель не поняла, что он нужен, она сделает по своему усмотрению, а ты будешь думать, что инструкция действует.
И ещё про установку. Два каталога из трёх в моём прогоне тянут довесок с GitHub по закрытому каналу, для которого нужен личный ключ. Если ключа на машине нет, установка обрывается строкой «Host key verification failed». Лечится одной строкой в настройках, которая переводит скачивание на обычный веб-адрес. В инструкциях этого нет ни у кого.
Чего эти приёмы не сделают
Они не увеличивают сам лимит. Ни один из них не добавляет тебе ни одного часа сверх тарифа. Они растягивают то, что уже выдано: делают одну и ту же работу дешевле, чтобы лимита хватило дольше. Если ты упираешься в потолок каждый день к обеду, экономия отодвинет это к вечеру, но не отменит.
Второе: цифры не складываются. Минус 10% от Ponytail и минус сколько-то от Graphify не дают минус тридцать, потому что они режут разные куски одного пирога. Считай по своему /context, а не по сумме чужих обещаний.
Третье: первые три приёма экономят то, что уже есть, а не отменяют момент, когда лимит обнулился. Для этого случая и нужен шаг 5 выше, шлюз OmniRoute
И четвёртое, про размеры самих лимитов: сколько именно даёт каждый тариф после осеннего пересмотра, лежит в разборе лимитов, а разница между навыком, надстройкой и внешним подключением на пальцах разобрана тут.
Источники
Все страницы открыты живым запросом 21 сентября 2026 года; цифры расхода сняты с моих собственных журналов, а цена надстроек с собственной установки в отдельный профиль
- Документация Claude Code, раздел про расход - почему вся переписка уезжает с каждым запросом, отчёты
/context,/usage,/insights, срок жизни кэша - Документация Claude Code, раздел про навыки - почему карточка навыка висит всегда, а тело грузится по вызову
- Страница проекта Ponytail на GitHub - две команды установки, четыре уровня, переменная
PONYTAIL_DEFAULT_MODE, лицензия MIT - Независимая проверка Ponytail в JetBrains - 80 парных задач, минус 15,4% кода, минус 10,3% стоимости, нулевая разница по качеству
- Страница проекта agent-skills на GitHub - состав набора, заявленные 25 навыков, команды установки, лицензия MIT
- Биография Адди Османи на его личном сайте - должность директора Google Cloud AI по разработке для Gemini, уход из Google и переход в Anthropic в 2026 году
- Страница интеграции Graphify с Claude Code - установка, перехват поиска по файлам, команды карты, обновление хуками git
- Страница проекта OmniRoute на GitHub - лицензия MIT, число провайдеров, установка npm
- Собственный разбор 300 локальных журналов сессий и собственная установка четырёх надстроек в отдельный профиль 21 сентября 2026 года, macOS
Памятка: что сделать и что это стоит
Шесть строк, ради которых стоит вернуться сюда через неделю замеров
Сохрани себе
- записать своё число из
/contextДО любых изменений, иначе сравнивать будет не с чем /clearмежду задачами бесплатен,/compactдорогой: сжатие сначала читает всю историюCLAUDE.mdгрузится всегда и целиком, держать короче двухсот строк, остальное в навыки- Ponytail: минус 10,3% стоимости по независимой проверке, а не минус 54%, и почти ноль на мелких правках
- Graphify без автоматического обновления карты уверенно врёт по устаревшим связям
- три надстройки стоят 3 610 единиц постоянно: 93 Graphify, 676 Ponytail, 2 841 agent-skills
- OmniRoute контекст не занимает вообще, зато требует отдельной установки и хотя бы одного бесплатного провайдера в запасе
Про следующий шаг
Лимит растянут, а собирать на него всё равно надо что-то своё
Четыре шага выше дают тебе больше времени работы в сутки. Дальше вопрос ровно один: что именно ты в это время собираешь и доходит ли оно до живых людей
Сам я после замера оставил Ponytail на уровне full, а agent-skills снял: у меня в памяти проекта не нашлось трёх тысяч единиц, которые он бы заменил. Такие развилки решаются не чтением обзоров, а своим /context и своей задачей рядом с тем, кто уже собрал
На Лагере мы берём твою задачу, режем её на шаги и за три дня доводим до работающей вещи. Приходишь со своей задачей, уходишь с собранным результатом
Заявка в закрытый канал, одобряю сразу. Бот напишет первым и отдаст три дня Лагеря. Бесплатно
Частые вопросы
Экономия лимита это то же самое, что экономия денег?
На подписке да, но косвенно: ты не платишь за каждый запрос, ты упираешься в потолок реже. По ключу API это прямые деньги, там каждая единица контекста в счёте.
Почему `/compact` дороже, чем `/clear`?
Потому что сжатие это работа модели. Чтобы ужать историю, её надо сначала прочитать целиком, и за это чтение ты платишь. /clear просто закрывает разговор и стоит ноль.
Сколько экономит Ponytail на самом деле?
Авторы показывают минус 22% расхода и минус 54% кода. Независимая проверка на 80 парных задачах дала минус 10,3% стоимости и минус 15,4% кода, при этом качество не изменилось. Ориентируйся на второе число и проверяй на своей задаче.
Надо ли ставить все пять шагов сразу?
Нет, и лучше не надо. Ставь по одному и после каждого сверяй /context на одной и той же задаче. Иначе не поймёшь, что сработало, а что просто добавило постоянного веса. Шаг 5, шлюз OmniRoute, вообще не про контекст, его ставь отдельно, когда решишь именно вопрос «что делать, если лимит кончился»
В agent-skills правда 24 навыка, как в ролике?
Сам репозиторий так и заявляет: 25 навыков, 24 из них рабочие плюс один служебный. Это число из ролика и оно честное со стороны автора. Но моя собственная установка через claude plugin details показала 34 живых навыка на момент прогона 21 сентября 2026 года. Репозиторий обновляется, поэтому верь не витрине и не этой статье, а своей команде на своей машине
Что делать, если установка обрывается на «Host key verification failed»?
Это каталог тянет довесок с GitHub по закрытому каналу, для которого нужен личный ключ, а ключа на машине нет. Лечится одной строкой в настройках, которая переводит скачивание на обычный веб-адрес, после этого установка проходит.
Мои приёмы не помогли, лимит всё равно кончается каждый день
Значит дело не в расходе, а в объёме работы. Тогда смотри в сторону переключения на другую модель в момент исчерпания квоты или в сторону тарифа выше. Экономия растягивает лимит, но не увеличивает его.
Если дочитал до конца
Дальше я пишу в своём канале
Я работаю один, без команды и подрядчиков: всё собираю Claude, Claude Code и агентами. В канале показываю внутрянку: что реально держу подключённым, что сэкономило день, а что снял через неделю. Разборов там заметно больше, чем доезжает до сайта
Это заявка на вход в мой закрытый канал, одобряю сразу. Бесплатно