Claude Code는 심각한 문제가 있고, 사후 분석(Post-Mortem)만으로는 부족하다
Claude Code has big problems and the Post-Mortem is not enough
핵심 요약
Claude Code의 과도한 시스템 프롬프트와 컨텍스트 오염으로 인한 성능 저하를 지적하며, Anthropic의 대응이 미흡하다고 비판함.
- 시스템 프롬프트 충돌 — Claude Code가 모델에 상충하는 지시를 계속 주입해 컨텍스트를 낭비하고 성능을 저하시킴.
- 제품 비대화 문제 — 95%의 사용자에게 불필요한 기능들이 추가되면서 도구가 지나치게 복잡하고 무거워짐.
- Anthropic의 대응 미흡 — 최근 발표된 사후 분석 보고서가 근본적인 문제를 해결하기엔 부족하며 여전히 개선이 필요함.
- 사용자 경험 양극화 — 일부 사용자는 여전히 잘 작동한다고 느끼는 반면, 많은 사용자가 성능 저하와 버그를 호소함.
TL;DR
- Claude Code는 모델에 침묵하고 잠재적으로 충돌하는 지시사항을 끊임없이 폭격하며, 사용자에게는 이를 비밀로 하라고 지시함
- 이로 인해 컨텍스트가 가득 차고, 중요할 수도 있고 아닐 수도 있는 구절에 끊임없이 주의를 기울이게 강요함
- 얼마 전 유출된 정보가 지금 사람들이 겪고 있는 많은 문제를 예견했음
- 그냥 가서 읽어보셈. 내 clanker(AI)가 쓴 게 아니라, 원래 이렇게 씀. (clanker가 코드베이스를 샅샅이 뒤져 아래 주장들을 검증하는 데 도움을 주긴 했음.)
출시 전 편집: 이 글의 99%를 다 쓴 후에 추가해야 할 내용: Anthropic이 방금 Claude Code의 몇 가지 문제와 그에 대한 수정 사항을 다룬 사후 분석(post-mortem)을 발표했음. 그들은 또한 Claude Code의 공개 버전을 도그푸딩(dogfooding)하기 시작할 것이라고 말했는데, 이는 내가 아래에서 제기할 대부분의 문제를 수면 위로 끌어올릴 것으로 기대함. 그들이 수정한 내용(내가 옳았다는 걸 증명하는 셈이지 ^그냥 ^^말해본 거임)은 글에서 최대한 지우려고 노력했지만, 남아있는 게 있을 수도 있음.

어때
솔직히 말해서 Opus 4.7은 4.6보다 엄청난 개선이 있었다고 생각함. 4.7이 나오기 전 약 일주일 정도를 제외하면 4.6이 성능 저하를 겪는 걸 거의 느끼지 못했는데, 이건 항상 Anthropic의 고전적인 징후였음. 하지만 불만은 훨씬 일찍 시작되었고, 이렇게 연기가 많이 난다면 OpenAI가 PR에 돈을 엄청나게 쏟아붓고 있거나, 아니면 실제로 어딘가에 불이 난 거임.
(후자가 확실함, 무조건 후자임. ^^^전자가 사실이기도 하지만, 그건 불만 사항들과는 아무 상관이 없음.)
그러니 난 Anthropic을 응원하러 온 것도 아니고, '실력 문제(skill issue)'라고 비난하러 온 것도 아님. 대신, Anthropic 친구들에게 진심 어린 마음으로 '개입'이 필요할 때가 된 것 같아서 글을 씀. 그들이 스스로를 해치기 시작했고, 조직적인 눈멀음(organizational blindness)에 빠져서 그걸 깨닫기 어려워진 상태라고 생각하기 때문임.
오늘 나는 한동안 생각해 온 가설을 제시해 보려고 함. 어쩌면 나 자신을 노출해서 ToS(서비스 약관) 위반으로 차단당할지도 모르고, AI가 이 글을 썼다는 비난을 여전히 받겠지만(요즘 인간들이 AI보다 패턴 매칭을 더 많이 하니까 lol). 제목에 적힌 가설은 다음과 같음:
Claude Code는 적극적으로 Anthropic을 해치고 있다
- 또는: 제발 속도를 좀 늦춰주세요
이건 누구를 공격하거나, 폭로하거나, 손가락질하려는 의도가 아님. 이건 나 혼자, 그리고 몇몇 친구들과만 공유했던 사실을 "내가 말했잖아"라고 말할 기회일 뿐임. 그 친구들은 내가 항상 이 말을 해왔다는 걸 증명해 줄 거임 ^제발 ^^친구들아 ^^^맹세해. CC를 '졸업'한 사람들 사이에서 드문 의견이 아니며, 핵심은 이거임: Claude Code는 95%의 사용자가 절대 필요로 하지 않을 무의미한 비대화(bloat)일 뿐이다.
대부분의 시간 동안 이건 무해했고, Opus 4.5 출시 당시에는 도구가 정말 훨씬 더 나은 상태였다고 생각함. 불행히도 Opus 4.5는 Anthropic의 제품 팀이 Claude Code 개발의 상당 부분을 위임할 수 있을 만큼 충분히 좋은 첫 번째 모델이었고, 그 결과 LLM이 개발한 코드베이스가 으레 그렇듯 . LLM을 둘러싼 전체 개발 패러다임은 본질적으로 "슬롭(slop, 쓰레기 코드)과 코드의 비율을 어떻게 최대화할 것인가"와 "내가 얻는 슬롭을 어떻게 쉽게 갈아버릴 것인가"에 대한 것임. 최근 유출을 본 사람들은 동의하겠지만, Anthropic은 그 비율 조정이 좀 잘못된 것 같음.

