실제로 이슈 생성부터 PR까지 AI 에이전트로 완전 자동화해서 돌리는 사람 있음?
Is anyone actually running coding agents autonomously from issue to PR?
핵심 요약
완전 자율형 코딩 에이전트 워크플로우의 현실성과 검증 방식에 대한 논의.
- 자동화 현실성 — 복잡한 작업보다는 명확한 버그 수정이나 단순 패턴 작업에 국한됨
- 검증의 중요성 — 자동화된 PR이라도 코드 리뷰와 CI 테스트 통과는 필수적임
- 신뢰 문제 — AI의 권한 남용이나 의도치 않은 코드 변경(scope creep)에 대한 우려 존재
- 워크플로우 효율 — 최종 Git 작업 자동화보다는 구현 단계의 효율성이 더 중요함
완전 자율형 워크플로우가 실제로 얼마나 흔한지 궁금함. Claude나 Codex를 사용자와 상호작용하며 조종하는 게 아니라, 이슈를 할당하고 에이전트가 알아서 계획하고 구현하게 둔 뒤 완성된 PR을 받는 방식 말임.
실제 레포지토리에서 이런 방식을 사용한다면, 누군가 PR을 리뷰하거나 머지하기 전에 에이전트가 할당된 작업을 제대로 수행했는지, 권한 범위를 지켰는지, 필요한 검사를 통과했는지 어떻게 검증함?
특히 여전히 수동 검증이 필요한 부분을 포함해서, 최근의 실제 사례들이 궁금함.


