Claude Code + Codex 쓰면서 무한 감사(audit) 루프에 빠지는 사람 또 있음?
Anyone else using Claude Code + Codex and getting stuck auditing forever?
핵심 요약
AI 에이전트 두 개를 활용한 개발 워크플로우에서 감사 루프에 갇혀 배포가 지연되는 문제에 대한 고민.
- 개발 워크플로우 — Claude가 코딩하고 Codex가 감사하는 구조를 구축함.
- 무한 루프 문제 — 사소한 지적까지 모두 수정하려다 보니 배포가 지연됨.
- 솔로 개발자의 고민 — 실질적인 버그와 사소한 개선점을 구분하는 기준이 필요함.
- 해결책 모색 — 감사 횟수 제한이나 직접적인 아키텍처 설계 등 효율적인 방법 논의.
솔로 창업자로서 개발 팀 없이 Flutter로 모바일 앱을 만들고 있음. 기능을 만들기 위해 Claude Code를 사용하고, 작업물을 확인하는 보조 수단으로 Codex를 사용 중임.
워크플로우는 이럼: Claude가 사양을 작성하고 기능을 빌드하면, Codex가 둘 다 감사해서 GREEN, YELLOW, RED를 줌. RED가 나오면 Claude에게 다시 보내서 수정하게 하고, 감사를 다시 돌림.
이게 똑똑한 설정이라고 생각했는데, 이제는 내가 미친 루프를 만들어냈다는 생각이 듦.
어제는 어려운 기능 하나가 하루 만에 사양 버전 5개와 RED 감사 4번을 거쳤음. 최악인 건 Codex가 찾아낸 문제들이 대부분 진짜 문제였다는 거임. 그래서 매번 '음... 이건 고쳐야겠지'라고 생각하게 됨.
하지만 그중 상당수는 심각한 버그가 아니었음. 단락이 표와 모순된다거나, Claude가 파일을 실제로 확인하지 않고 코드가 뭔가를 한다고 말한다거나, 작은 엣지 케이스가 충분히 명확하게 설명되지 않은 것 같은 사소한 것들이었음.
그래서 고치고, 다시 감사하고, 또 다른 걸 찾으면 고치고, 다시 감사하고... 그러다 보니 정작 배포는 못 하고 하루 종일 프로세스를 더 완벽하게 만드는 데만 시간을 썼음.
동시에 두 번째 모델을 제거하고 싶지는 않음. 진짜 문제를 잡아내긴 하니까. 혼자 개발하고 있고, 경험 많은 개발자도 아니고, 옆에서 모든 걸 검토해 줄 엔지니어도 없으니까.
그래서 에이전트를 사용하는 다른 솔로 빌더들에게 묻고 싶음: 다들 이걸 어떻게 처리함?
AI 하나로 다른 AI를 감사하게 함? '최대 2번의 감사 라운드 후 배포' 같은 제한을 둠? 아니면 앱을 실제로 망가뜨릴 수 있는 보안, 데이터 같은 문제만 배포를 막고 사소한 건 무시함?
난 기본적으로 **"대충 코딩하고 기도하기"**와 "태양이 폭발할 때까지 두 AI가 서로를 검토하게 하기" 사이의 중간 지점을 찾으려고 함.
실제로 효과를 보고 있는 방법이 있음?
도움이 될 만한 팁 좀 부탁함. 더 빠르게 만들고 싶지만 무모해지고 싶지는 않음.

