작업 중간에 에이전트 뒤치다꺼리 좀 그만해, 생산성 다 깎아먹는 중임
stop babysitting your agents mid-task, it's killing your productivity
핵심 요약
AI 에이전트가 브라우저 환경에서 예기치 못한 상황에 무한 루프에 빠지는 문제를 해결하기 위해 모델 최적화보다 런타임 환경 개선이 중요하다는 의견.
- 런타임 환경 개선 — 모델 프롬프트 최적화보다 브라우저 세션 유지 및 격리된 환경 구축이 핵심임.
- 무한 루프 방지 — 동일한 동작 반복 시 작업을 중단하고 상태를 저장하는 복구 경로 설계가 필요함.
- 생산성 저하 해결 — 에이전트가 예기치 못한 팝업이나 세션 만료에 대응하지 못해 발생하는 토큰 낭비를 줄여야 함.
- 실제 환경 테스트 — 데모용이 아닌 실제 복잡한 환경에서 에이전트의 성능을 검증하는 것이 중요함.
최근에 이 문제를 깊게 파고 있는데, 나만 그런 건지 궁금함. 페이지에서 예상치 못한 상황만 발생하면 에이전트가 바로 맛이 가버림.
테스트할 땐 잘 돌아가는데, 갑자기 팝업이 뜨거나 로그인 세션이 만료되면 에이전트가 아주 슬픈 무한 루프에 빠짐. 클릭, 대기, 관찰, 다시 클릭, 다시 관찰, 아무 일도 안 일어남. 포기할 때쯤이면 벽 보고 멍하니 있는 놈한테 단어당 돈 주는 것처럼 토큰을 다 날려 먹음.
나한테 진짜 효과 있었던 건 — 다들 아는 건데 나만 뒷북치는 건지 모르겠지만 — 에이전트 로직보다 환경을 다시 생각하는 거였음. 격리된 브라우저 컨텍스트, 세션 유지, CLI로 한 번씩 툭툭 건드리는 대신 실제 코드로 다단계 액션을 묶어서 실행하기. 내 활성 탭을 뺏지 않는 병렬 실행 같은 것들.
이거 하려고 ego lite 써봤는데, 작업 완료율이랑 그냥... 수치스럽게 만료되는 비율 차이가 꽤 큼. 깔끔한 데모 말고 실제 복잡한 환경에서 20~50% 정도 더 빨라짐.
어쨌든 요점은 다들 모델만 최적화하고 있는데, 사실 병목은 런타임이라는 거임. 뭐 당연한 소리일 수도 있고 내가 이제야 깨달은 걸 수도 있지만.
다들 프로덕션에서 에이전트 어떻게 돌림? 나처럼 토큰 잡아먹는 실패 루프 자주 겪음? 아니면 내가 그냥 개판으로 만들고 있는 거임? ㅋㅋ


