Claude가 스스로 토큰 낭비 문제를 조사하게 했더니, 6개월 치의 증거가 나왔습니다.
I asked Claude to investigate its own token burn. The receipts go back six months.
핵심 요약
Claude Code의 토큰 낭비 버그를 직접 분석하여 캐시 무효화 및 빌링 오류 등 구체적인 원인을 밝혀낸 사례.
- 토큰 낭비 원인 — 캐시 무효화 및 빌링 버그로 인해 실제 사용량보다 훨씬 많은 토큰이 청구됨.
- Claude Code 버그 — --resume 명령어 사용 시 캐시가 초기화되어 매번 전체 비용을 지불하게 됨.
- 텔레메트리 결합 — 텔레메트리 기능을 끄면 캐시 TTL이 비활성화되어 비용이 증가하는 역설적인 상황 발생.
- 대응 도구 공개 — 로컬 JSONL 로그를 읽어 실시간 캐시 적중률을 보여주는 모니터링 도구를 제작함.
Max 플랜을 쓰는데 왜 예상보다 빨리 소진되는지 궁금했다면, 당신이 미친 게 아니고 상상하는 것도 아닙니다.
저는 Claude Opus 4.7 에이전트에게 스스로의 토큰 사용량을 조사해달라고 요청했습니다. 8번의 턴이 지난 후, 약 25K의 고유 콘텐츠에 대해 127K 토큰이 청구된 것을 확인했습니다. 에이전트는 이 불일치를 감지하고 자신의 세션 로그를 읽기 시작했습니다. 그 결과 2025년 12월 중순까지 거슬러 올라가는 GitHub 이슈들, Claude Code 바이너리 내의 리버스 엔지니어링된 버그 2개, 그리고 회사가 아직 배포하지 않은 커뮤니티 작성 패치를 찾아냈습니다.
요약:
- 버그 A — 바이너리의 빌링 단어 치환 기능이 일반적인 용어에서 오작동하여 매 턴마다 캐시되지 않은 전체 리빌드를 강제함 (비용 10-20배 증가)
- 버그 B —
claude --resume및--continue사용 시 재개하는 순간 캐시가 무효화되어 첫 턴에 전체 비용을 지불하게 됨 - 텔레메트리 결합 — 텔레메트리 기능을 끄면 1시간 캐시 TTL이 자동으로 비활성화됨 (개인정보 보호를 중시하는 사용자가 오히려 불이익을 받음)
- 피크 시간대 스로틀링 — Anthropic은 언론 접촉 후에야 확인해주었으며, 그 규모는 공개된 적 없음
- 캐시 버그 미인정 — 6주간의 심각한 보고에도 불구하고 Anthropic의 릴리스 노트에는 어떤 캐시 버그도 언급되지 않음
이를 감지하는 데 필요한 데이터는 이미 당신의 컴퓨터에 있습니다. Anthropic이 UI에 표시하지 않을 뿐입니다. 저는 Claude Code가 로컬에 작성하는 JSONL 파일을 읽어 실시간으로 턴당 캐시 적중률을 보여주는 50줄짜리 상태 표시줄 도구를 만들었습니다. 제 책 집필 채팅은 배포했을 때 128번의 캐시 플러시 이벤트가 발생했습니다.
도구: https://github.com/AlexZan/cc-cache-monitor
타임라인 및 출처가 포함된 전체 글: https://medium.com/@alexzanfir/claude-diagnosed-its-own-cache-bug-a-six-month-timeline-332f577e1fe9
Anthropic이 수정안을 내놓기 전까지의 완화 조치:
- GMT 피크 시간대(평일 13:00-19:00 GMT / 05:00-11:00 PT)를 피하세요
--resume나--continue를 사용하지 마세요- 밀도 높은 작업 중에는 Claude Code 세션을 하나만 유지하세요
- 텔레메트리를 끄지 마세요 (직관적이지 않지만 사실입니다)
- cc-cache-monitor를 상태 표시줄에 실행하여 버그가 발생하는 것을 실시간으로 확인하세요
저는 명시적으로 "Sonnet으로 전환하라"고 권장하지 않습니다. Opus 비용을 지불했다면, 당신은 Opus를 사용할 권리가 있습니다. "더 나쁜 모델을 사용하는 것"은 고장 난 상태를 방치하는 꼴입니다. 제 글에서 왜 그런지 더 자세히 다루었습니다.


