Вступление: неделя, которая стала короче
Недельный лимит Claude Code упал на 17% в середине сентября 2026 года, когда закончилась летняя акция. Люди на самых больших планах теперь пишут, что неделя кончается к среде. В официальном анонсе Anthropic сказано, что лимиты навсегда подняли на 25%, а в следующем за ним посте то же изменение названо сокращением на 17%.
Во всех списках советов, как растянуть лимит, нет ни одной цифры. Здесь у каждого способа есть измеренное число, и способы расставлены по местам. Два результата выделяются: почти половина токенов за месяц ушла на субагентов, а одна долгая пауза заставляет следующее сообщение переписать большую часть сессии.
Что изменилось и как считать
Все измерения здесь взяты из логов Claude Code одного разработчика за один месяц: 455 сессий и 63,398 запросов, с 3 сентября по 3 октября.
Акция шла с мая по 13 сентября и поднимала недельный лимит на 50%. Лимит каждого пятичасового окна не менялся ни разу. В конце августа аккаунт Anthropic для разработчиков объявил о постоянном повышении на 25%, а в следующем посте той же ветки говорится, что на деле это сокращение на 17%. Верно и то и другое:
| Период | Недельный лимит (старый лимит = 100) |
|---|---|
| До акции | 100 |
| Во время акции (с мая по 13 сентября) | 150 |
| Постоянный уровень с 14 сентября | 125 |
Падение со 150 до 125 и есть те самые 17%, которые чувствуют люди. Один пользователь с двумя самыми большими планами написал, что 100% в среду у него раньше никогда не случалось. Другой, на таком же плане, во вторник утром был на 86%. Дело не только в сокращении: в начале сентября вышла более прожорливая модель, так что не каждая пустая неделя объясняется этим изменением.
С вашей стороны виден процент. Экран /usage делит недавний расход между скиллами, субагентами, плагинами и каждым подключённым MCP-сервером и отмечает промахи кэша. Одна клавиша переключает его между последним днём и последними семью. Чего не видно, так это размера лимита в токенах: Anthropic публикует проценты и множители, но никогда не называет число токенов. Поэтому всё измеренное ниже выражено в токенах, по одной рабочей нагрузке, а не в доле вашей недели.
У подсчёта токенов по логам есть ловушка. Лог записывает один и тот же ответ несколько раз, так что сумма по всем строкам даёт 18.6 миллиарда токенов. Если считать каждый ответ один раз, получится 9.3 миллиарда. Наивный подсчёт почти вдвое завышает всё.
Субагенты: почти половина счёта
Субагент это ещё один Claude, которого ваша сессия запускает для побочной задачи и который по окончании отчитывается. За измеренный месяц субагенты потратили 48.1% всех токенов за 2,631 запуск.
| Показатель | Доля субагентов |
|---|---|
| Все токены | 48.1% |
| Выходные токены | 63.9% |
| С весами, как публичный прайс-лист оценивает вывод и запись в кэш | 55.3% |
У каждого субагента есть и входная плата. Ещё до того как он что-то сделал, его первый запрос уже несёт в медиане 47,117 токенов: инструкции, список инструментов и список скиллов, всё отправлено заново. Другой автор измерил это на другой машине и получил от 16,000 до 21,000 токенов на запуск для агентов с совсем крошечным собственным промптом. Как сказано в той статье, файл агента это погрешность округления на фоне стоимости его собственного запуска.
Вторая половина это модель. По умолчанию субагент наследует модель основного разговора, поэтому переключение сессии на самую большую модель сажает на неё и всех помощников. В измеренных логах самая маленькая модель обработала меньше 1% запросов субагентов. Решение умещается в одну строку в файле агента: поле model с меньшей моделью для задач вроде запуска тестов или поиска файлов.
Отсюда две привычки. Не запускайте субагента для мелкой задачи, которую можно сделать на месте, а тем, кого оставили, закрепляйте маленькую модель.
Ограничение этого результата: никто не измерял, сколько закрепление экономит в долях недели, а маленькая модель, которой нужно больше шагов, может обойтись дороже. Цифра 48% получена на работе, которая сильно разветвляется. Ваша собственная доля видна на экране /usage.
Пятиминутный кэш, о котором молчат
Claude Code хранит ваш разговор в кэше промптов на сервере, и чтение из него стоит малую долю от повторной отправки. Для основной сессии этот кэш живёт один час. Для субагента пять минут.
В документации это сказано прямо: субагентам даётся пять минут, даже на подписке, пока вы не выберете больше. То же относится ко всему, что находится вне основного разговора, включая фоновую работу и сжатие контекста. Измеренные логи это подтверждают: каждая запись в кэш от субагента попадала на пятиминутный уровень, а каждая от основной сессии на часовой.
Разработчик на Reddit заметил, к чему это приводит: один из его субагентов за один день восемь раз переписал весь свой контекст. Решение это одна строка в файле настроек, "subagentPromptCacheTtl": "1h".
| Его измерение | До | После |
|---|---|---|
| Записи в кэш | 12.2 миллиона токенов | 3.0 миллиона токенов |
| Пятичасовое окно с четырьмя субагентами | от 2% до 100% | от 0% до 22% |
Это один пользователь, сравнивший два разных дня, а не контролируемый тест. В логах, измеренных здесь, это почти ничего не меняет: только 95 из 41,790 повторных запросов субагентов (около двух на тысячу) пришли после ожидания дольше пяти минут, хотя каждый из них переписал около 75,000 токенов.
Так что всё зависит от того, как работают ваши субагенты. Если они ждут долгую сборку, ревью или вас, включайте. Если работают короткими всплесками, оставьте как есть: кэш, который живёт час, дороже в записи.
Перерыв, который переписывает всю сессию
Кэш основной сессии живёт один час. После более долгого перерыва его уже нет, и следующее сообщение не может ничего прочитать из кэша. В документации это описано прямо: сообщение, которое вы отправляете после перерыва, промахивается мимо кэша и заново обрабатывает весь ваш контекст.
| Пауза перед сообщением | Запросов | Переписано в кэш (медиана) |
|---|---|---|
| Меньше 5 минут | 18,029 | 1,176 токенов |
| От 5 до 60 минут | 414 | 1,327 токенов |
| Больше 60 минут | 79 | 130,332 токена |
Типичная сессия в тот момент содержала 175,523 токена, так что большая её часть была записана заново. Счётчик к тому же не считает запись и чтение одинаково. Один разработчик поставил перед Claude Code прокси с журналом и следил за своим пятичасовым окном: по его соотношениям, токен, записанный в кэш, весит примерно в сорок раз больше токена, прочитанного из него.
Claude Code об этом знает. Когда вы возвращаетесь в большую сессию после долгого перерыва, он предлагает продолжить с краткого пересказа. Соглашайтесь.
Более дешёвая привычка появляется раньше. Когда задача закончена, очищайте сессию, пока кэш ещё тёплый. Очистка ничего не стоит, и следующая задача начинается с малого объёма. Сжатие контекста тоже работает, но сжатие огромной сессии само по себе огромный запрос.
Перерыв не единственный способ потерять кэш. Смена модели посреди сессии тоже его опустошает, потому что у каждой модели свой. На новейших моделях смена effort этого не делает. Claude Code просит подтвердить смену модели, пока кэш тёплый, и этот запрос и есть предупреждение.
Ограничения: 79 холодных возвращений это небольшая выборка, и часть из них идёт после сжатия. Кроме того, пересказ теряет детали, так что за это решение приходится платить частью непрерывности.
Effort: способ, который может стоить качества
Effort показывает, как долго модели позволено думать, прежде чем ответить. Уровней пять, от low до max, и размышление оплачивается как вывод. По умолчанию на большинстве моделей стоит high, а на двух новейших medium.
В документации сказано, что бюджет размышления может доходить до десятков тысяч токенов на запрос и что верхний уровень склонен к переразмышлению. На новейших моделях размышление вообще нельзя отключить, поэтому уровень остаётся единственным рычагом.
Один разработчик прогнал одни и те же 29 реальных задач на всех пяти уровнях:
| Уровень effort | Средняя цена задачи | Пройдено задач (из 29) |
|---|---|---|
| low | $2.50 | 23 |
| medium | $3.15 | 28 |
| high | $5.01 | 26 |
| xhigh | $6.51 | 25 |
| max | $8.84 | 27 |
Качество не росло вместе со стоимостью. Medium прошёл больше задач, чем любой уровень выше, и в пересчёте на доллар тоже дал больше всего пройденных задач. По его словам, кривая, похоже, достигает пика на medium. Команда Claude Code работает так же: один из её инженеров строит на low или medium, проводит ревью и запускает проверку только на high.
Подвох в том, почему это решение может стоить качества. На сложных задачах, которые он выбрал, low не прошёл ни разу из пяти, а high прошёл пять из пяти. Попытка на low заняла две минуты, на high тридцать три.
Поэтому подбирайте effort под шаг: medium для разработки, high когда ошибка обходится дорого (баг в старом коде, миграция, завершающая проверка), max почти никогда. Логи сессий записывают effort каждого запроса, так что можно проверить, что вы на самом деле запускали.
Эти цены указаны в долларах на более старой модели, а не в долях недели: этого никто не публиковал. И дешёвая попытка, которая проваливается и запускается дважды, стоит дороже, чем одна удачная.
Советы, которые весят меньше, чем обещают
Некоторые способы есть в каждом списке и почти ничего не меняют. Их можно попробовать бесплатно. Просто неделя ушла не туда.
Единственный по-настоящему весомый в этой группе это то, что загружается на старте. Одна статья измерила первый запрос из пустой папки в 29,061 токен, а внутри настоящего проекта почти в 39,000. В логах, измеренных здесь, медианный первый запрос равен 55,989 токенов и колеблется от 15,764 до 105,020 в зависимости от проекта. Команда /context показывает, что там лежит (файлы памяти, скиллы, списки инструментов), и называет каждый загруженный файл памяти. Уберите то, чем не пользуетесь. Выигрыш скромный, потому что этот блок записывается один раз и затем читается из кэша на каждом следующем шаге. Больно становится при холодном старте и при каждом запуске субагента.
| Популярный совет | Измерено |
|---|---|
| Удаление MCP-серверов | 1,350 токенов на 51 инструмент в трёх серверах; 18 токенов на один сервер с одним инструментом |
| Отключение подсказок промптов | 3-4% у одного пользователя; заявление «до 10%» пришло от одного аккаунта с огромными контекстами |
| Фильтрация вывода shell | около 0.1% общего объёма, по измерению участника одного из таких фильтров |
Определения инструментов теперь по умолчанию подгружаются отложенно, поэтому MCP-серверы весят так мало. В документации стоимость подсказок промптов названа небольшой. Все три пункта растут вместе с размером вашего контекста, а серверы обходятся дороже на старых моделях, где отложенная загрузка выключена. Отключайте, если хотите, но не ждите, что неделя вернётся.
Ранжированная таблица
Ранжирование по измеренному:
| Место | Способ | Измерено | Подвох |
|---|---|---|---|
| 1 | Меньше субагентов, и дешевле | 48.1% токенов; 47,117 на запуск | Меньше параллелизма |
| 2 | Не возобновлять холодную сессию | Переписано 130,332 токена против 1,176 | Пересказ теряет детали |
| 3 | Effort: medium для разработки | $3.15 против $5.01 за задачу; пройдено 28 из 29 | Low проваливает сложные задачи |
| 4 | Кэш субагентов на один час | С 12.2 миллиона до 3.0 миллионов токенов записи в кэш | Окупается, только если субагенты ждут |
| 5 | Убрать лишнее из загрузки на старте | +9,744 токена к базовым 29,061 | Платится один раз за сессию |
Три популярных совета (MCP-серверы, подсказки промптов, вывод shell) не там, куда ушла неделя.
Ограничения, прямо: это ранжирование выражено в токенах, по одному месяцу работы одного человека плюс измерения других людей. Anthropic не публикует размер лимита в токенах, поэтому никто со стороны не может перевести это в долю вашей недели. У вас порядок может быть другим, и экран /usage подскажет.
Два самых больших способа это привычки, а не настройки, и они бесплатны: запускайте меньше субагентов и никогда не возобновляйте холодную сессию целиком.
AIDive