Claude MAX 사용자들을 위한 팁!!!
A tip for Claude MAX users!!!
핵심 요약
Claude Code 사용 시 토큰 제한을 피하기 위한 세션 관리 및 모델 라우팅 최적화 팁을 공유합니다.
- 세션 관리 — 빌드 단위를 작게 나누고 세션마다 새로 시작하여 토큰 낭비를 방지함
- 모델 라우팅 — 설계는 Opus, 빌드는 Sonnet, 검색은 Haiku로 모델을 분리하여 효율화함
- 자동 압축 지양 — 자동 압축은 오히려 재학습 비용을 발생시키므로 사용을 자제함
- 워크플로우 최적화 — 프로젝트 문서를 Obsidian 스타일로 정리하고 컨텍스트 엔지니어링을 적용함
claude code 쓰다가 사용량 제한 금방 걸리는 놈들은 /usage 쳐봐라. 어디서 제일 많이 잡아먹는지 다 나온다.
깔끔하게 세팅 안 해놨으면 당장 해라!! 무조건 첫 세션에서 설계랑 계획부터 짜고, 빌드를 조각조각 나눠라. 조각 하나당 세션 하나씩이다. 한 세션에 여러 조각 쑤셔 넣지 마라. auto-compact 돌리고 같은 세션에서 계속 이어가는 짓도 하지 마라. 조각 하나 끝나면 무조건 새 세션 파라. context-mode 같은 툴 쓰면 조금이라도 아낄 수 있다. 그리고 프로젝트 지식 베이스나 문서 너무 크면 obsidian 스타일 위키로 정리해 둬라.
내 램이 32GB라 컨테이너 띄워놓고 동시에 빌드 4개밖에 못 돌린다. 지금 리셋까지 3일 남았는데 벌써 60% 찍었다. 워크플로우 잘 짜면 일주일 주기에 6일 차쯤에 제한 걸릴 듯? 뭐 이 정도면 괜찮지!! 아, 그리고 Fable은 9%밖에 안 썼다.
솔직히 이거 말고 대안이 없다. claude code 하네스랑 LLM 지능이 소프트웨어 엔지니어링 쪽으로는 codex나 chatgpt보다 훨씬 낫거든.
아, 그리고 모델 라우터 설정 꼭 해라! 설계나 계획은 Opus 4.8(내 기본 모델임, opus 5는 별로더라)로 하고, 빌드는 Sonnet, 검색이나 단순 작업은 haiku로 돌리게끔.. 이거 설정 꼭 해놔라.
결국 context-engineering이랑 하네스 튜닝 좀 해줘야 한다. 그러면 꽤 쓸만하게 돌아간다.


