AIDive

Claude Code 주간 한도 17% 감소, 되찾는 5가지 방법

AIDive · 게시 · 수정

코딩 에이전트

인트로: 짧아진 한 주

Claude Code의 주간 한도는 2026년 9월 중순, 여름 프로모션이 끝나면서 17% 줄었습니다. 최상위 요금제를 쓰는 사람들은 이제 수요일이면 한 주치가 바닥난다고 말합니다. Anthropic의 공식 발표는 한도를 영구적으로 25% 올렸다고 하는데, 바로 다음 게시물은 같은 변경을 17% 감소라고 부릅니다.

한도를 늘리는 팁 모음에는 숫자가 하나도 없습니다. 이 글은 각 해결책에 측정한 숫자를 붙이고 순위를 매깁니다. 두드러지는 결과는 두 가지입니다. 한 달치 토큰의 거의 절반이 서브에이전트로 갔고, 긴 휴식 한 번이면 다음 메시지가 세션 대부분을 다시 쓰게 만든다는 점입니다.

무엇이 바뀌었나, 그리고 세는 법

여기 나오는 측정값은 개발자 한 명의 Claude Code 로그 한 달치에서 나왔습니다. 9월 3일부터 10월 3일까지, 세션 455개와 요청 63,398건입니다.

프로모션은 5월부터 9월 13일까지 이어졌고 주간 한도를 50% 높였습니다. 5시간 창마다 적용되는 한도는 한 번도 바뀌지 않았습니다. 8월 말에 Anthropic의 개발자 계정은 영구적으로 25% 올린다고 발표했고, 같은 스레드의 한 게시물 뒤에서는 계산하면 17% 감소라고 말합니다. 두 말 다 사실입니다.

기간 주간 한도 (예전 한도 = 100)
프로모션 이전 100
프로모션 기간 (5월부터 9월 13일까지) 150
9월 14일부터의 영구 수준 125

150에서 125로 내려간 것이 사람들이 체감하는 17%입니다. 최상위 요금제 두 개를 쓰는 한 사용자는 수요일에 100%에 도달한 건 처음이라고 적었습니다. 같은 요금제의 다른 사용자는 화요일 아침에 이미 86%였습니다. 한도 삭감만이 원인은 아닙니다. 9월 초에 더 많이 먹는 모델이 나왔기 때문에, 한 주치가 바닥나는 모든 경우가 이 변경 때문은 아닙니다.

사용자 쪽에서 볼 수 있는 것은 퍼센트입니다. /usage 화면은 최근 사용량을 스킬, 서브에이전트, 플러그인, 연결된 MCP 서버별로 나눠 보여 주고 캐시 미스도 표시합니다. 키 하나로 최근 하루와 최근 7일 사이를 전환합니다. 볼 수 없는 것은 토큰으로 본 한도의 크기입니다. Anthropic은 퍼센트와 배수만 공개하고 토큰 수는 공개하지 않습니다. 그래서 아래의 모든 측정값은 한 작업량에서 나온 토큰이지, 여러분의 한 주에서 차지하는 몫이 아닙니다.

로그에서 토큰을 세는 데에는 함정이 있습니다. 로그가 같은 응답을 여러 줄에 걸쳐 기록하기 때문에 모든 줄을 더하면 186억 토큰이 나옵니다. 한 번씩만 세면 93억입니다. 단순하게 세면 모든 수치가 거의 두 배로 부풀려집니다.

서브에이전트: 청구서의 거의 절반

서브에이전트는 세션이 부수적인 일을 맡기려고 시작하는 또 다른 Claude이고, 일이 끝나면 결과를 보고합니다. 측정한 한 달 동안 서브에이전트는 2,631번의 실행에서 전체 토큰의 48.1%를 썼습니다.

측정 항목 서브에이전트의 비중
전체 토큰 48.1%
출력 토큰 63.9%
공개 가격표가 출력과 캐시 쓰기에 매기는 가중치로 계산 55.3%

서브에이전트마다 입장료도 있습니다. 아무 일도 하기 전에 첫 요청이 이미 중앙값 47,117 토큰을 싣고 있습니다. 지시문, 도구 목록, 스킬 목록이 모두 다시 전송되기 때문입니다. 다른 사람이 다른 기기에서 측정했을 때는 자체 프롬프트가 아주 짧은 에이전트도 실행마다 16,000에서 21,000 토큰이 들었습니다. 그 글의 표현대로, 에이전트 파일은 자기 실행 비용 안에서 반올림 오차입니다.

모델이 나머지 절반입니다. 기본적으로 서브에이전트는 메인 대화의 모델을 물려받으므로, 세션을 가장 큰 모델로 바꾸면 모든 도우미도 그 모델로 돌아갑니다. 측정한 로그에서 가장 작은 모델이 처리한 서브에이전트 요청은 1% 미만이었습니다. 해결책은 에이전트 파일의 한 줄입니다. 테스트 실행이나 파일 검색 같은 작업에는 model 필드를 더 작은 모델로 지정하면 됩니다.

여기서 습관 두 가지가 나옵니다. 직접 처리할 수 있는 작은 일에는 서브에이전트를 쓰지 말고, 계속 쓸 서브에이전트에는 작은 모델을 고정하세요.

이 결과의 한계도 있습니다. 모델을 고정했을 때 한 주에서 얼마를 아끼는지는 아무도 측정하지 않았고, 턴이 더 많이 필요한 작은 모델은 오히려 비용이 더 들 수 있습니다. 48%는 여러 갈래로 뻗는 작업에서 나온 수치입니다. 여러분의 비중은 /usage 화면에서 확인할 수 있습니다.

아무도 말하지 않는 5분 캐시

Claude Code는 대화를 서버의 프롬프트 캐시에 보관하고, 캐시에서 다시 읽는 비용은 다시 보내는 비용의 일부에 불과합니다. 메인 세션의 캐시는 1시간 유지됩니다. 서브에이전트의 캐시는 5분 유지됩니다.

문서에도 분명히 적혀 있습니다. 구독 중이어도 더 길게 선택하기 전까지 서브에이전트는 5분을 받습니다. 백그라운드 작업과 컴팩션을 포함해 메인 대화 밖의 모든 것이 마찬가지입니다. 측정한 로그도 일치합니다. 서브에이전트의 캐시 쓰기는 전부 5분 등급에, 메인 세션의 캐시 쓰기는 전부 1시간 등급에 기록됐습니다.

Reddit의 한 개발자가 그 결과를 알아챘습니다. 그의 서브에이전트 하나가 하루에 전체 컨텍스트를 여덟 번 다시 썼습니다. 해결책은 설정 파일의 한 줄, "subagentPromptCacheTtl": "1h"입니다.

그의 측정 이전 이후
캐시 쓰기 1,220만 토큰 300만 토큰
서브에이전트 4개를 돌린 5시간 창 2%에서 100% 0%에서 22%

이는 서로 다른 이틀을 비교한 한 사용자의 결과이지 통제된 실험이 아닙니다. 여기서 측정한 로그에서는 거의 영향이 없었습니다. 서브에이전트의 후속 요청 41,790건 중 5분보다 오래 기다린 뒤에 온 것은 95건(천 건에 두 건 정도)뿐이었지만, 그 하나하나가 약 75,000 토큰을 다시 썼습니다.

그러니 서브에이전트가 어떻게 일하느냐에 달려 있습니다. 긴 빌드나 리뷰, 또는 사용자를 기다리는 일이 많다면 켜세요. 짧게 몰아서 돌아간다면 그대로 두세요. 1시간 유지되는 캐시는 쓰는 비용이 더 비싸기 때문입니다.

세션 전체를 다시 쓰게 만드는 휴식

메인 세션의 캐시는 1시간 유지됩니다. 그보다 오래 쉬면 캐시가 사라지고, 다음 메시지는 아무것도 읽어 오지 못합니다. 문서가 정확히 설명합니다. 휴식 뒤에 보내는 메시지는 캐시를 놓치고 전체 컨텍스트를 다시 처리합니다.

메시지 전의 공백 요청 수 다시 쓴 캐시 (중앙값)
5분 미만 18,029 1,176 토큰
5분에서 60분 414 1,327 토큰
60분 초과 79 130,332 토큰

그 시점의 일반적인 세션은 175,523 토큰을 담고 있었으므로, 대부분이 다시 쓰인 셈입니다. 게다가 미터는 쓰기와 읽기를 똑같이 취급하지 않습니다. 한 개발자가 Claude Code 앞에 로깅 프록시를 두고 자신의 5시간 창을 관찰했습니다. 그의 비율로는 캐시에 쓴 토큰 하나가 캐시에서 읽은 토큰 하나의 약 40배로 계산됩니다.

Claude Code도 이를 압니다. 긴 휴식 뒤에 큰 세션을 다시 열면 대신 요약에서 재개하자고 제안합니다. 받아들이세요.

더 싼 습관은 그보다 앞에 있습니다. 작업이 끝나면 캐시가 아직 따뜻할 때 세션을 비우세요. 비우는 데에는 비용이 들지 않고 다음 작업은 작게 시작합니다. 컴팩션도 통하지만, 거대한 세션을 컴팩션하는 것 자체가 거대한 요청입니다.

휴식만이 캐시를 잃는 방법은 아닙니다. 세션 도중에 모델을 바꾸면 캐시가 비워집니다. 모델마다 자기 캐시를 따로 갖기 때문입니다. 최신 모델에서는 effort를 바꿔도 비워지지 않습니다. Claude Code는 캐시가 따뜻할 때 모델 전환을 확인하라고 묻는데, 그 질문이 경고입니다.

한계는 이렇습니다. 콜드 복귀 79건은 작은 표본이고, 일부는 컴팩션 직후입니다. 요약은 세부 내용도 잃기 때문에 이 해결책은 연속성을 어느 정도 희생합니다.

effort: 품질을 깎을 수 있는 해결책

effort는 모델이 답하기 전에 얼마나 오래 생각할 수 있는지를 정합니다. low부터 max까지 다섯 단계가 있고, 생각은 출력으로 과금됩니다. 기본값은 대부분의 모델에서 high, 가장 새로운 두 모델에서는 medium입니다.

문서에 따르면 생각 예산은 요청당 수만 토큰에 이를 수 있고 최상위 단계는 과하게 생각하는 경향이 있습니다. 최신 모델에서는 생각을 아예 끌 수 없으므로 단계가 유일한 조절 수단입니다.

한 개발자가 실제 작업 29개를 다섯 단계 모두로 돌렸습니다.

effort 단계 작업당 평균 비용 통과한 작업 (29개 중)
low $2.50 23
medium $3.15 28
high $5.01 26
xhigh $6.51 25
max $8.84 27

품질은 비용을 따라가지 않았습니다. medium은 그보다 높은 어느 단계보다 많은 작업을 통과했고, 비용 대비 통과 수도 가장 높았습니다. 그의 표현대로 곡선은 medium에서 정점을 찍는 것으로 보입니다. Claude Code 팀도 같은 방식으로 일합니다. 엔지니어 한 명은 low나 medium으로 만들고, 리뷰하고, 검증만 high로 돌립니다.

이 해결책이 품질을 깎을 수 있는 이유가 함정입니다. 그가 고른 어려운 문제에서 low는 5번 중 0번 통과했고 high는 5번 중 5번 통과했습니다. low로 한 번 시도하는 데 2분, high로는 33분이 걸렸습니다.

그러니 단계는 작업 단계에 맞추세요. 만들 때는 medium, 실수의 대가가 클 때(오래된 코드의 버그, 마이그레이션, 마무리 점검)는 high, max는 거의 쓰지 않습니다. 세션 로그에는 모든 요청의 effort가 기록되므로 실제로 무엇을 돌렸는지 확인할 수 있습니다.

이 비용은 이전 모델 기준의 달러 금액이지 한 주에서 차지하는 몫이 아니며, 그 수치는 아직 아무도 공개하지 않았습니다. 그리고 싸게 시도했다가 실패해 두 번 돌리면, 한 번에 성공하는 것보다 더 듭니다.

광고만큼 무겁지 않은 팁들

어떤 해결책은 모든 목록에 있지만 효과는 미미합니다. 해 보는 데 돈이 들지는 않습니다. 다만 한 주가 사라진 곳이 거기가 아닐 뿐입니다.

이 그룹에서 진짜 효과가 있는 것은 시작할 때 로드되는 내용입니다. 한 글은 빈 폴더에서 첫 요청이 29,061 토큰, 실제 프로젝트 안에서는 거의 39,000 토큰이라고 측정했습니다. 여기서 측정한 로그의 첫 요청 중앙값은 55,989 토큰이고, 프로젝트에 따라 15,764에서 105,020까지 분포합니다. /context 명령은 그 안에 무엇이 있는지(메모리 파일, 스킬, 도구 목록) 보여 주고 로드한 메모리 파일을 하나하나 이름으로 알려 줍니다. 쓰지 않는 것은 덜어 내세요. 이 블록은 한 번 쓰이고 이후 모든 턴에서 캐시로 읽히기 때문에 이득은 크지 않습니다. 콜드 스타트와 모든 서브에이전트 실행에서 타격이 큽니다.

인기 팁 측정 결과
MCP 서버 제거 서버 3개의 도구 51개에서 1,350 토큰, 도구 1개짜리 서버 하나는 18 토큰
프롬프트 제안 끄기 한 사용자 기준 3~4%, "최대 10%"라는 주장은 컨텍스트가 엄청나게 큰 한 계정에서 나왔음
셸 출력 필터링 전체 양의 약 0.1%, 그런 필터 중 하나의 기여자가 측정

도구 정의는 이제 기본적으로 지연 로드되기 때문에 MCP 서버의 무게가 이렇게 작습니다. 문서는 프롬프트 제안의 비용을 작다고 말합니다. 세 가지 모두 컨텍스트가 커질수록 늘어나고, 지연 로드가 꺼져 있는 이전 모델에서는 서버 비용이 더 큽니다. 원하면 끄세요. 하지만 한 주를 되찾기를 기대하지는 마세요.

순위표

측정한 결과를 기준으로 한 순위입니다.

순위 해결책 측정 결과 함정
1 더 적고 더 싼 서브에이전트 토큰의 48.1%, 실행당 47,117 병렬성 감소
2 콜드 세션을 재개하지 않기 1,176에 비해 130,332 토큰 다시 쓰기 요약은 세부 내용을 잃음
3 effort: 만들 때는 medium 작업당 $5.01에 비해 $3.15, 29개 중 28개 통과 low는 어려운 문제에서 실패
4 서브에이전트 캐시를 1시간으로 캐시 쓰기 토큰 1,220만에서 300만으로 서브에이전트가 기다릴 때만 이득
5 시작할 때 로드되는 내용 줄이기 기준 29,061 토큰에 +9,744 토큰 세션당 한 번만 지불

인기 있는 세 가지(MCP 서버, 프롬프트 제안, 셸 출력)는 한 주가 사라진 곳이 아닙니다.

한계를 솔직히 말하면, 이 순위는 한 사람의 한 달치 작업에서 나온 토큰 기준이고 다른 사람들의 측정값이 더해졌습니다. Anthropic은 토큰으로 본 한도의 크기를 공개하지 않으므로, 외부의 누구도 이를 여러분의 한 주에서 차지하는 몫으로 환산할 수 없습니다. 여러분의 순서는 다를 수 있고, /usage 화면이 알려 줄 것입니다.

가장 큰 두 해결책은 설정이 아니라 습관이고, 둘 다 공짜입니다. 서브에이전트를 더 적게 실행하고, 콜드 세션은 절대 통째로 재개하지 마세요.

무료 자료

출처

자주 묻는 질문

2026년 9월에 Claude Code의 주간 한도가 왜 줄었나요?
5월부터 9월 13일까지 이어진 프로모션이 주간 한도를 50% 높였습니다. 프로모션이 끝나면서 Anthropic은 영구 수준을 예전 한도보다 25% 높게 정했고, 이는 사람들이 쓰던 프로모션 수준보다 17% 낮습니다. 5시간 창 한도는 바뀌지 않았습니다.
Claude Code 사용량을 가장 많이 쓰는 것은 무엇인가요?
측정한 한 달치 로그에서 서브에이전트가 전체 토큰의 48.1%, 출력 토큰의 63.9%를 썼습니다. 서브에이전트는 실행마다 아무 일도 하기 전에 지시문과 도구 목록으로 중앙값 47,117 토큰을 싣고 있었습니다. 여러분의 비중은 /usage 화면에서 볼 수 있습니다.
Claude Code 서브에이전트가 더 싼 모델을 쓰게 하려면 어떻게 하나요?
에이전트 파일에 model 필드를 추가하세요. 예를 들면 model: haiku 입니다. 기본적으로 서브에이전트는 메인 대화의 모델을 물려받기 때문에, 가장 큰 모델로 돌리는 세션은 모든 도우미도 그 모델로 돌립니다.
긴 휴식 뒤에 Claude Code 세션을 재개하면 어떻게 되나요?
메인 세션의 프롬프트 캐시는 1시간 유지됩니다. 그 뒤에는 다음 메시지가 캐시를 놓치고 전체 컨텍스트를 다시 처리합니다. 측정한 로그에서는 중앙값 130,332 토큰을 다시 썼고, 5분 이내에 보냈을 때는 1,176 토큰이었습니다. Claude Code는 대신 요약에서 재개하자고 제안하며, 그러면 다시 쓰는 일을 피할 수 있습니다.
Claude Code에서 어떤 effort 단계를 써야 하나요?
만들 때는 medium, 실수의 대가가 클 때는 high, max는 거의 쓰지 않습니다. 한 개발자가 실제 작업 29개로 시험했을 때 medium은 작업당 $3.15에 28개를 통과했고 max는 $8.84에 27개를 통과했습니다. 어려운 문제에서 low effort는 5번 중 0번, high는 5번 중 5번 통과했습니다.
MCP 서버를 제거하면 Claude Code 사용량이 줄어드나요?
거의 줄지 않습니다. 도구 정의는 기본적으로 지연 로드되어 시작할 때는 이름만 로드됩니다. 한 측정에서는 서버 3개의 도구 51개가 1,350 토큰이었고, 도구 1개짜리 서버 하나는 18 토큰이었습니다.

관련 영상