AMD 엔지니어가 6,852개의 Claude Code 세션을 분석해 성능 저하를 증명했습니다. Anthropic이 인정한 부분과 부인한 부분, 그리고 실제로 효과가 있는 해결책을 소개합니다.
AMD engineer analyzed 6,852 Claude Code sessions and proved performance changed. Here's what Anthropic confirmed, what they disputed, and the fixes that actually work.
핵심 요약
AMD 엔지니어가 대규모 데이터 분석을 통해 Claude Code의 성능 저하를 입증하고, Anthropic의 대응과 실질적인 해결책을 제시했습니다.
- 데이터 기반 분석 — 6,852개 세션과 23만 건 이상의 도구 호출을 분석해 Claude Code의 성능 변화를 객관적으로 입증함.
- 성능 저하 원인 — Anthropic의 'adaptive thinking' 도입과 기본 노력 수준 하향 조정 등이 복합적으로 작용함.
- 비용 급증 이유 — 캐시 버그와 에이전트 동시성 증가, 성능 저하로 인한 재시도 등이 겹쳐 비용이 크게 상승함.
- 실질적 해결책 — 환경 변수 설정(`CLAUDE_CODE_EFFORT_LEVEL=max`)과 독립형 바이너리 사용 등으로 성능을 복구할 수 있음.
AMD AI 그룹의 한 선임 이사는 Claude Code가 점점 나빠지고 있다는 느낌을 받은 것에 그치지 않고, 측정 시스템을 구축하여 6,852개의 세션 파일을 수집하고 234,760건의 도구 호출을 분석하여 AI 역사상 가장 데이터가 풍부한 버그 리포트(GitHub Issue #42796)를 제출했습니다.
실제로 무슨 일이 일어났는지 요약해 드립니다.
데이터가 보여준 것:
- 편집당 파일 읽기: 6.6x → 2.0x (−70%)
- 블라인드 편집(Claude가 먼저 읽지 않은 파일을 편집): 6.2% → 33.7%
- "소유권 회피" 정지 훅 발생: 17일 동안 0 → 173회
- API 비용: 월 $345 → $42,121 (복합적인 원인 — 아래 참조)
편집당 읽기 횟수 지표가 핵심입니다. 이는 '느낌'이 아닌 행동 기반 지표입니다. Claude는 먼저 조사하고 편집하던 것에서 그냥 편집하는 것으로 바뀌었고, 이는 실제 컴파일러 코드를 망가뜨렸습니다.
Anthropic이 실제로 인정한 것:
- 2월 9일: Opus 4.6이 "적응형 사고(adaptive thinking)"로 전환됨 — 작업에 따라 추론 깊이가 달라짐
- 3월 3일: 기본 노력 수준이 **중간(85)**으로 하락 — 가장 영향력이 컸던 확인된 변경 사항
- 3월 26일: 피크 시간대 스로틀링 도입(평일 PT 오전 5시~11시), 사전 공지 없음
- 사고 토큰 0 버그: 확장된 사고(Extended Thinking)를 '높음'으로 설정해도 추론 토큰이 0으로 반환될 수 있는 버그
- 프롬프트 캐시 버그로 인한 비용 10-20배 증가
부인한 것:
- "사고 능력 67% 하락" 주장 — Anthropic은 변경 사항이 로그에서 사고 과정을 숨겼을 뿐 실제 추론 능력이 감소한 것은 아니라고 주장함 (AMD는 이에 반박)
- 의도적인 수요 관리/"너프" — Anthropic은 이를 단호히 부인함
$42,000 청구서에 대한 설명:
비용 급증은 단순히 성능 저하 때문만은 아니었습니다.
- AMD 팀이 3월 초에 의도적으로 동시 에이전트를 1~3개에서 5~10개로 확장함
- 두 개의 개별 캐시 버그가 토큰 비용을 10~20배 부풀림
- 성능 저하로 인한 재시도가 겹침
- 사고 토큰 0 버그: 스마트한 출력을 위해 비용을 지불했으나 얕은 출력을 얻음
여전히 현실이고, 여전히 엉망입니다. 하지만 원인은 단순히 "Anthropic이 모델을 너프했다"는 것보다 더 복잡합니다.
확인된 해결책 (Boris Cherny 직접 제공):
# 전체 노력 수준 복구
CLAUDE_CODE_EFFORT_LEVEL=max
# 또는 세션 내에서
/effort max
# 적응형 사고 비활성화
CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING=1
# npx 대신 독립형 바이너리 사용 (Bun 캐시 버그 방지)
claude # NOT: npx u/anthropic-ai/claude-code
# 관련 없는 작업 간 컨텍스트 초기화
/clear
참고: 4월 7일 기준으로 Anthropic은 API/Team/Enterprise 사용자를 위해 높은 노력 수준을 기본값으로 복구했습니다.


