실제 코드베이스에서 한 달간 Claude Code를 사용해 본 후기 — 장점, 단점, 그리고 애매한 중간 지점
One month of Claude Code on a real codebase — the good, the bad, and the weird middle part
핵심 요약
Claude Code를 실무에 도입해 본 개발자가 생산성 향상과 AI 코드 검토의 피로감에 대해 공유했습니다.
- 생산성 향상 — 반복적인 리팩토링이나 테스트 코드 작성 등 단순 작업에서 큰 효율을 보임
- 명확한 지시 — 작업 전 명확한 의도와 맥락을 설명해야 AI의 결과물 정확도가 비약적으로 상승함
- 검토 피로 — AI가 생성한 코드를 검토하는 과정에서 발생하는 정신적 소모가 직접 작성할 때보다 큼
- AI의 한계 — 아키텍처 판단이나 비즈니스 로직 이해 등 고도의 판단이 필요한 영역에서는 여전히 부족함
Claude Code 한 달 정도 써봤다. 장난감 프로젝트 말고, 실제로 배포하는 프로덕션 코드에 돌려봄. 까먹기 전에 느낀 점 좀 정리해 본다.
첫 주는 진짜 사기 치는 줄 알았다. 개판인 FastAPI 코드베이스 던져주고, 전체 다 sync에서 async로 바꾸고 프로젝트 구조 싹 갈아엎으라고 시켰거든. 45분 만에 끝내더라. 내가 했으면 최소 반나절은 걸렸을 거고, 나중에 버그도 몇 개 튀어나왔을 텐데 말이지.
둘째 주에는 현실을 좀 맛봤다. 파일 8개 정도 건드려야 하는 기능을 추가해 봤는데, 코드는 진짜 깔끔하게 짜더라. 솔직히 내가 짠 것보다 나았음. 근데 틀렸어. 버그가 있는 게 아니라, 내 머릿속에만 있고 코드 어디에도 없는 비즈니스 로직을 얘가 모르는 거지. 내 잘못이 크긴 한데, 겉보기엔 너무 완벽해 보여서 더 빡치더라.
셋째 주부터는 작업 시키기 전에 짧게 명세서 같은 걸 적기 시작했다. 거창한 건 아니고, 왜 이 작업을 하는지 3~5문장 정도로 설명하는 정도. 근데 이게 차원이 다르더라. 체감상 성공률이 70%에서 95%까지 올라감.
얘가 진짜 돈값 하는 구간은 리팩토링, 신규 기능 구현, 테스트 코드 작성, 문서화 같은 거. 그냥 "이 패턴 보고 똑같이 다 적용해" 하는 작업들. 반대로 판단력이 필요한 부분에선 죽을 쑤더라. 아키텍처 트레이드오프, 보안 이슈, 기능이 진짜 끝난 건지 판단하는 거, 그리고 코드엔 없는데 내 머릿속에만 있는 규칙들 이해하는 거.
아무도 말 안 해준 게 있는데, 코드 리뷰 피로감이 장난 아님. AI가 짠 코드 몇 시간 읽고 나면, 직접 코딩할 때보다 두 배는 더 지침. 이게 뇌를 쓰는 방식이 달라서 그래. 뭔가 만드는 게 아니라 계속 감시하고 검사하는 거라 뇌가 금방 지쳐버림.
그래도 계속 돈 내고 쓸 생각이다. 한 달에 15시간 정도는 아껴주니까 그건 확실히 크거든. 근데 얘를 "AI 동료"라고 생각하면 안 됨. 그냥 손 빠른 신입 개발자라고 생각하는 게 딱 맞다. 센스는 좋은데 명확하게 지시해 줘야 하고, 결국 핵심적인 생각은 내가 해야 함. 너네는 어떠냐? 써보니까 어때?




