5시간 사용 제한을 버티는 나만의 방법
how i survive 5 hour usage limits
핵심 요약
AI 에이전트 사용 시 토큰 제한을 피하기 위한 서브 에이전트 활용, 모델 라우팅, 스킬 최적화 등 실전 팁을 공유합니다.
- 서브 에이전트 활용 — 컨텍스트를 제한하여 토큰 소모를 줄이고 작업 효율을 높임
- 모델 라우팅 전략 — Claude와 Codex를 상황에 맞춰 유연하게 교차 사용함
- 스킬 최적화 — 미리 정의된 스킬을 사용하여 AI의 불필요한 추론 과정을 방지함
- MCP 집계기 사용 — 로컬 MCP 집계기로 토큰 팽창을 막고 인증을 중앙에서 관리함
Codex 서브레딧에서 누가 이거 물어보길래 답글 달았던 거 좀 다듬어서 가져와 봄. (원래는 그냥 키보드 막 두들겨서 쓴 거라 좀 지저분했거든 ㅋㅋ)
보통 제한 걸리면 5시간짜리 제한에 걸리지, 주간 제한은 이제 거의 안 걸림. 예전엔 맨날 걸렸지만.
솔직히 내가 에이전트들한테 시키는 일 양을 보면 제한 훨씬 더 자주 걸려야 정상인데 말이지.
근데 아래 적은 몇 가지 "비결"(이걸 비결이라고 할 수 있다면 말이야) 덕분에 클라우드 모델 토큰 사용량 관리도 훨씬 잘 되고 생산성도 엄청나게 올랐음.
1) 컨텍스트 제한이 있는 서브 에이전트 쓰기. 얘네는 채팅이 압축될 때마다 불어나는 거대한 시스템 프롬프트를 달고 다니지 않음. 목표는 압축 단계까지 절대 안 가게 하거나, 아예 근처에도 안 가는 거임. 뻔한 소리 같지만, Claude Code한테 /workflows를 쓰라고 하거나 일을 어떻게 쪼갤지 명확하게 지시하셈. 서브 에이전트를 몇 개나 만들지도 지정할 수 있는데, 난 이거 좋아함. 안 그러면 가끔 너무 많이 만들어서 내 소중한 토큰을 다 잡아먹거든... 아니, 내 소중한 반지... 아니 토큰 말이야.
2) 동적 모델 라우팅. 가능할 땐 Sonnet이나 Haiku로 돌리고, 5.3 Spark는 사용량이 따로 잡히니까 적절히 섞어 쓰는 거임. Claude 제한에 가까워지면 Codex로 더 밀어 넣고, 반대도 마찬가지고. 모르는 사람도 많던데, Claude Code 안에서 Codex를 헤드리스로 돌릴 수 있음. (설정법은 구글링 해보셈) 난 이거 진짜 좋아함. 구독 두 개를 팀처럼 굴릴 수 있거든!!! (난 Claude 20배 요금제에 ChatGPT Pro 월 200달러짜리 쓰고 있음. 그래, 구독료로만 월 400달러 태우는 중임. 근데 내가 부동산 투자 사업 백엔드 파트너로 일하면서 툴이랑 워크플로우를 엄청나게 관리하고, 개인적으로도 자잘한 실험을 많이 하니까.)
3) 스킬(Skills). 내가 직접 만든 것도 많고 깃허브에서 가져다 쓰는 것도 엄청 많음. 많은 사람들이 스킬을 안 쓰면 채팅창이 개판 난다는 걸 모름. AI가 매번 그 일을 어떻게 할지 "생각"하느라 토큰을 다 써버리거든. API나 MCP 쓸 때는 더 심함. 적절한 엔드포인트 찾겠다고 이리저리 쑤시고 다니니까.
MCP 관련 보너스 팁: MCP 얘기가 나와서 말인데, 난 로컬에서 MCP 애그리게이터를 돌림. 토큰 낭비가 엄청나게 줄어듦. MCP를 프로젝트별로 스코프 지정해서 쓸 수도 있긴 한데, 그건 귀찮고 프로젝트 바뀔 때마다 설정 바꾸는 게 생산적이지가 않음. 애그리게이터를 쓰면 토큰 부하도 줄고 인증도 중앙에서 관리할 수 있음. 난 팀원이나 프로젝트, 사업별로 에이전트 스코프를 다르게 가져가야 해서 이게 꼭 필요함. 개인적인 인증이랑 사업용 인증을 분리해두는 걸 좋아하거든.
뭐든 그렇듯 내 말에 동의 안 하는 사람도 있을 거고, 숙련된 빌더들한테는 다 뻔한 소리일 수도 있음. 그래도 위에 적은 내용에 대해 어떻게 생각하는지, 토큰 제한 관리할 때 도움 되는 다른 팁 있으면 공유 좀 해주라.
3년 반 전에 내가 처음 AI 진지하게 파기 시작했을 때 이런 팁들을 알고 있었더라면 얼마나 좋았을까 싶음. 여기 초보자들한테도 좀 도움이 됐으면 좋겠네. 뭐 팔아먹으려는 건 아니고, 내가 배운 게 많기도 하고 현실에서 이런 짓 하는 사람이 나밖에 없어서 앞으로 여기 좀 자주 들어와 보려고 ㅋㅋ
초보자들 궁금한 거 있으면 언제든 물어봐. 아가페.

