Mac을 활용해 Claude Code 채팅을 밤새 읽게 하고 토큰 사용량을 1/3로 줄인 방법
How I got my Mac to read my Claude Code chats at night and extend my token usage by 1/3rd
핵심 요약
로컬 Mac의 Apple Intelligence를 활용해 Claude 채팅 기록을 자동으로 요약함으로써 토큰 비용을 획기적으로 절감한 사례입니다.
- 토큰 절감 전략 — 로컬 기기에서 채팅 기록을 요약하여 유료 모델의 재독 과정을 생략함
- 자동화 워크플로우 — 채팅 종료 시 Mac이 자동으로 작업 내용과 다음 단계를 정리함
- 비용 효율성 — 유료 모델 대신 로컬 모델을 사용하여 토큰 소모 없이 문맥을 유지함
- 도구 활용 — Claude Code의 로컬 파일 저장 기능을 활용해 로컬 모델이 기록을 읽게 함
매주 리셋되기 이틀 전에 자꾸 사용량 제한에 걸리는 거임. 그래서 도대체 어디서 토큰을 이렇게 처먹나 싶어서 파봤지. 보니까 사용량의 3분의 1 정도가 재독(re-reads)이더라. 파일은 수정도 안 됐는데 계속 다시 읽고, 예전 채팅 내용을 새 채팅에 계속 불러오고 있었던 거지.
Apple Intelligence가 제일 빠른 AI는 아닐지 몰라도, 밤새 내 채팅 로그 공짜로 읽어주는 데는 이만한 게 없음. 채팅 로그 읽는 데 굳이 똑똑한 모델 쓸 필요 없잖아? 읽는 건 그냥 쉬운 작업이니까.
그래서 지금 내 세팅은 이거임: 내 Mac이 채팅이 길어질 때마다 로컬에서 알아서 다 읽어버림. 토큰 0개 소모, 내가 자는 동안에도 돌아감. 채팅 하나 끝나면 Mac이 알아서 요약본을 써줌. 무슨 일이 있었고, 뭐가 결정됐고, 다음엔 뭘 해야 하고, 어떤 파일을 건드렸는지 싹 정리하는 거지. 그럼 다음 날 아침에 새 채팅 시작할 때, 비싼 모델한테 처음부터 끝까지 다 읽히면서 돈 날릴 필요 없이 바로 이어서 시작할 수 있음. 혹시라도 Mac이 못 읽는 건 Haiku로 넘기게 설정해뒀는데, 아직까지는 Mac 선에서 다 해결돼서 쓸 일도 없더라.
결국 똑같은 Max 플랜 유지하면서 토큰 효율만 3배 가까이 뽑아내는 중임.

