Claude Code에서 느껴지는 '작업 완료'의 환상
The Illusion of Finished Work in Claude Code
핵심 요약
Claude Code가 생성한 결과물이 검증 전에도 완벽해 보이는 현상과, 이를 보완하기 위한 더 나은 검토 환경의 필요성을 논합니다.
- 작업 완료 환상 — 에이전트가 생성한 결과물이 검증 없이도 완성된 것처럼 보여 위험함
- 검토 환경 개선 — 코드뿐만 아니라 에이전트의 작업 과정과 의사결정 과정을 검토할 수 있어야 함
- 인간의 책임 — 에이전트가 똑똑해질수록 최종 결과물에 대한 인간의 검증과 소유권이 중요해짐
- 도구 실험 — 에이전트 워크플로우를 지원하기 위한 새로운 작업 공간 모델(Cate)을 제안함
Claude Code를 쓰면서 계속 느끼는 점에 대해 짧은 글을 썼습니다. 결과물이 실제로 검증되기도 전에 이미 완성된 형태를 띠고 있다는 점입니다.
Claude Code는 이제 코드베이스를 탐색하고, 변경 사항을 계획하고, 파일을 수정하고, 명령어를 실행하고, PR을 생성하고, 병렬 세션을 작업하고, 수행한 내용을 요약할 수 있습니다. 유용하지만, 이는 '검토'의 의미를 바꿉니다. 우리는 더 이상 생성된 몇 줄의 코드만 검토하는 게 아닙니다. 일련의 행동 체인을 검토하는 것이죠.
제가 걱정하는 부분은 신뢰도 격차입니다. 에이전트는 깔끔한 diff, 훌륭한 요약, 통과하는 테스트를 만들어내면서도 실제 동작, 보안 문제, 아키텍처 제약 사항, 혹은 엣지 케이스를 놓칠 수 있습니다. "에이전트가 멈췄다"와 "머지해도 안전하다"는 같은 말이 아닙니다.
에이전트 기반 코딩에는 더 나은 검토 인터페이스가 필요하다고 생각합니다. 원래 작업, 계획, 읽은 파일, 변경된 파일, 실행된 명령어, 테스트 출력, 의존성 변경, 승인, 보안 검사, 그리고 특히 '검증되지 않은 부분'까지 보여줘야 합니다.
이건 Claude를 비판하는 글이 아닙니다. 저도 Claude Code를 사용하고 있고, 플랜 모드, 워크트리, 서브 에이전트, PR 리뷰 같은 워크플로우는 정말 중요하다고 생각합니다. 하지만 에이전트가 발전할수록 인간의 소유권은 더욱 중요해집니다.
더 자세한 내용은 여기서 썼습니다:
https://cate.cero-ai.com/blog/illusion-of-finished-work
이걸 어떻게 다룰지에 대한 제 생각입니다:
https://github.com/0-AI-UG/cate
Claude Code를 사용하는 다른 분들은 이 문제를 어떻게 다루고 계신지 궁금합니다. 최종 diff를 주로 신뢰하시나요, 아니면 에이전트가 거쳐온 경로까지 검토하려고 하시나요?
