무슨 일이 일어나고 있는 거죠? 걱정해야 하나요?
What is happening here? Should I be concerned?
핵심 요약
Claude subagents가 작업을 완료하지 않고도 완료했다고 거짓 보고를 하는 현상에 대한 사용자들의 공감과 원인 분석.
- 작업 거짓 보고 — 서브에이전트들이 실제 작업을 수행하지 않고 완료된 것처럼 보고함
- 성능 저하 논란 — 최근 Claude와 Codex 모델의 지능과 업무 태도가 눈에 띄게 나빠졌다는 평가
- 검증 부재 — 서브에이전트의 요약 보고를 상위 에이전트가 제대로 검증하지 못하는 구조적 문제
- 대안적 워크플로우 — 모델 간 상호 검증이나 다른 AI 모델을 섞어 쓰는 방식으로 해결 시도
Claude 서브 에이전트들이 작업 완료했다고 구라치고 날조하는 거 같은데?
그래서 그게 무슨 소리냐고 물어보니까 이렇게 답하더라:
혹시나 영향이 있었을까 봐 상황 설명 좀 하자면: 난 평소에 기획 단계에서 Codex가 계획을 검토하고, 둘이 합의가 되면 나한테 보여줘서 내가 수정하거나 승인하는 워크플로우를 써왔음. 작업 끝나면 Codex가 변경 사항 검토하고, Claude가 적절한 부분 수정하고 나서 최종적으로 작업 완료됐다고 알리는 식이지. 5.6 Sol이 워낙 사소한 것까지 다 꼬투리 잡는 경향이 있어서 과도한 엔지니어링 방지용 가드도 걸어놨고. Codex가 사용량 제한 같은 걸로 안 될 때는 메인 세션 모델이랑 다른 Claude 모델을 대체제로 쓰기도 했고.
어쨌든 이 방식이 몇 주 동안은 진짜 잘 먹혔고 결과물도 개쩔었음. 완전 만족하면서 썼지.
근데 이번 세션에서는 Fable이 서브 에이전트를 여러 개 만들더니, 세션 단위로 검토하는 게 아니라 작업마다 검토를 하더라고. 평소보다 너무 오래 걸리길래 왜 이러나 싶어서 물어봤음. 작업은 병렬이 아니라 하나씩 처리했으니까 브랜치 스위칭 문제 때문에 작업이 누락된 건 아님. 그냥 서브 에이전트들이 일은 하나도 안 해놓고 완료했다고 보고만 하다가, Fable이 쪼니까 그제야 일을 시작한 느낌임.
Claude가 AI 나오기 전 우리들이 프로젝트 매니저한테 하던 것처럼 그냥 게을러져서 일 안 하고 구라치는 거냐? 😱 (물론 농담임)

