코딩 에이전트에게 보낸 메시지 3주 치를 분석해 봤는데, 40%가 실제 업무가 아니었음. 너희도 똑같음?
I analyzed 3 weeks of my own messages to coding agents. 40% of what I typed was not real work. Is it the same for you?
핵심 요약
코딩 에이전트 사용 시 발생하는 40%의 오버헤드 원인을 분석하고, 상태 알림 부재와 규칙 공유 문제에 대해 논의함.
- 오버헤드 분석 — 메시지의 40%가 진행 상황 확인이나 에이전트 수정 등 비생산적 작업임
- 상태 알림 부재 — 에이전트가 작업 완료를 알려주지 않아 사용자가 수동으로 확인해야 함
- 규칙 공유 문제 — 에이전트 간 규칙이 동기화되지 않아 반복적인 지시가 필요함
- 분석 방법론 — 키워드 검색 대신 모델을 활용한 메시지 라벨링으로 정확도 확보
난 평소에 Claude Code랑 Kimi를 주력으로 쓰고, 가끔 Cursor나 Copilot까지 섞어서 코딩 에이전트 여러 개를 동시에 돌리거든. 근데 작업 속도가 너무 안 나오는 것 같아서, 지난 3주 동안 내가 보낸 메시지를 싹 다 뽑아서 하나하나 무슨 용도인지 분류해 봤어. 키워드 검색은 써봤는데 수치가 개판이라 그냥 수작업으로 다 깠다.
자동화된 트래픽 싹 다 쳐내니까 내가 직접 보낸 메시지는 2,116개, 하루 평균 96개 정도 되더라.
메시지 용도 분석 결과:
55% 실제 작업: 새로운 태스크, 질문, 의사결정
13% 에이전트 수정: 엉뚱한 짓 함, 삼천포로 빠짐, 말도 없이 모델이나 범위 멋대로 바꿈
9.5% "진행 상황 어때?"
6% 에이전트나 채팅방 사이에서 수동으로 정보 전달
4% "계속해", "ㅇㅇ", "진행해" (에이전트가 멈춰서 기다릴 때)
4% "쉬운 영어로 설명해 줘"
3% 이미 알려준 규칙 반복 입력
5% 기타: 슬래시 커맨드, 파편화된 메시지
결국 내 타이핑의 40%는 그냥 뻘짓(오버헤드)인 셈이지. 세부 내용은 이래.
진행 상황 물어본 게 200번이야. 절반 이상은 에이전트가 조용히 작업하는 동안 내가 기다리다 지쳐서 한 시간 내에 몰아서 물어본 것들이고.
수정 요청이 제일 많이 들어온 건 UI 작업이었는데, 스크린샷 하나하나 보면서 고치느라 아주 죽을 맛이었어.
똑같은 규칙을 날마다, 에이전트마다 계속 반복해서 입력해야 했어. "토큰 아껴라", "모델 바꿀 거면 물어봐라", "검증되기 전엔 배포하지 마라" 같은 거. 한 에이전트한테 알려준 규칙이 다른 놈한테는 전혀 공유가 안 돼.
최악의 날에는 정보를 33번이나 옮겨 날랐어. 에이전트 두 개가 같은 실험을 하고 있었는데, 한쪽 보고서를 복사해서 다른 쪽에 붙여넣는 짓을 계속했거든.
토큰 낭비에 대한 불안감도 상시 대기 중이야. 에이전트 놈들은 비용이 얼마나 나올지도 안 알려주고 일단 큰 작업부터 저지르고 보니까.
놀라운 점 하나: 로그에 찍힌 '사용자 메시지' 절반 이상은 내가 보낸 게 아니었어. 내 기본 설정으로 돌아가는 스크립트랑 테스트 하네스들이 자동으로 쏜 거더라고.
궁금한 게 있어:
-
너희도 똑같은 문제 겪고 있냐, 아니면 다른 데서 오버헤드가 발생하냐?
-
너희를 제일 빡치게(비용/시간 잡아먹는) 하는 건 뭐야?
-
진행 상황 확인하는 문제나 규칙 공유 안 되는 문제, 특히 툴 넘나들면서 해결한 사람 있냐?


