AI 에이전트가 위험한 작업(환불, 결제 등)을 수행할 때 사람의 승인을 어떻게 처리하시나요?
How do you handle human approval when your AI agent does something risky (refunds, payments)?
핵심 요약
AI 에이전트의 위험한 작업에 대한 사람의 승인 프로세스를 워크플로우 상태로 관리하고, 승인과 작업을 엄격히 결합하는 방식이 논의되었습니다.
- 워크플로우 상태 관리 — 승인을 단순 알림이 아닌 에이전트의 일시 정지 상태로 처리함
- 작업과 승인 결합 — 승인된 파라미터와 실제 실행 내용을 고정하여 변조를 방지함
- 감사 추적 기록 — 승인자, 타임스탬프, 변경 전후 데이터를 기록하여 규제 대응을 준비함
- 신뢰성 있는 전달 — 이메일이나 슬랙 알림이 누락되지 않도록 확실한 승인 경로를 확보함
저는 1인 개발자입니다(메시징/CPaaS 기업인 Cequens 출신). 에이전트를 만들 때마다 같은 벽에 부딪히곤 합니다. 에이전트가 환불 발행, 자금 이동, 계정 변경 등 위험 부담이 큰 작업을 수행하려 할 때, 먼저 실제 사람이 승인해주길 원합니다. 에이전트를 영원히 차단하려는 게 아니라, 사람으로부터 빠른 '예/아니오' 답변만 받으려는 거죠.
현재 제 선택지들은 별로 좋지 않게 느껴집니다:
- 슬랙/이메일 알림을 하드코딩 → 무시되기 일쑤고 기록도 남지 않음
- 작업을 차단하고 수동으로 처리 → 에이전트를 쓰는 의미가 없어짐
그래서 다른 분들은 어떻게 처리하는지 궁금합니다:
- 에이전트가 사람의 승인을 필요로 할 때, 현재 어떻게 처리하고 계신가요?
- 승인 요청이 누락되거나 무시된 적이 있나요? 무엇이 문제였나요?
- 상사나 규제 기관이 "사람이 승인했다는 걸 증명해봐"라고 한다면, 증명할 수 있나요?
공개하자면: 저는 이 문제를 해결하기 위한 무언가를 만들고 있습니다(WhatsApp/SMS를 통한 신뢰할 수 있는 승인 + 변조 방지 로그). 하지만 솔직히 이 고통이 다른 분들에게도 실재하는지, 아니면 저만 겪는 문제인지 알고 싶습니다. 홍보하려는 게 아니라, 진심으로 정보를 공유하고 싶습니다. 여러분의 설정은 어떤가요?
