토큰/할당량 폭발 없이 Pi/OMP로 코딩을 위임하는 방법이 있을까요?
How are you using Pi/OMP to delegate coding without exploding token/quota usage?
핵심 요약
복잡한 에이전트 오케스트레이션으로 인한 과도한 토큰 소모 문제를 해결하고 효율적인 위임 워크플로우를 찾는 질문입니다.
- 워크플로우 비효율성 — 복잡한 자동화 과정에서 2천만~5천만 토큰과 수백 번의 요청이 발생하는 문제 발생함
- 비용 최적화 고민 — 모델별 역할 분담과 수동 승인 과정을 통해 할당량 낭비를 줄이려 함
- 위임 전략 문의 — task.eager 설정이나 수동 제어를 통해 구현 단계에서 효율적으로 코딩을 위임하는 방법을 찾음
OhMyPi를 써서 거창한 오케스트레이션 프레임워크 직접 안 짜고, 역할별로 모델 다르게 돌려보려고 하는데 생각처럼 쉽지가 않네.
이상적인 시나리오는 이거임:
-
오케스트레이터: GPT-5.6 Sol XHigh
-
플래닝: GPT-6 Astra High
-
구현: GPT-5.6 Luna XHigh 태스크 에이전트
-
최종 검토: GPT-6 Astra XHigh
-
계획 승인이나 최종 검토 시점은 내가 직접 결정.
처음에는 플래닝, 체크리스트, 위임, 검증, 대기, 리뷰, 수정까지 다 때려 박은 복잡한 /work-on 명령어를 만들었거든? 근데 이게 진짜 개낭비더라. 중간 규모 작업인데 토큰 2천만~5천만 개 처먹고 모델 호출만 300~570번씩 찍히는데, 에이전트끼리 삽질하고 재검증하느라 시간 다 버림.
그래서 엄청 단순화했는데 이번엔 또 다른 문제가 터짐. 구현자가 파일 수정 중인데 부모 모델이 멋대로 리뷰를 돌리질 않나, /plan 쓰니까 플래너랑 리뷰어 둘 다 Astra XHigh인데 굳이 리뷰어를 또 붙여서 토큰만 날리더라고.
Astra Medium/Low를 오케스트레이터로도 써봤는데 성능은 괜찮았음. 근데 작업 전후 비교해보니까 Work/Codex 할당량 5%가 한 번에 증발하더라. 나한테는 너무 비쌈. 그래서 지금은 다시 Sol XHigh를 부모로 돌려놓고 어드바이저는 꺼버렸음.
이제는 그냥 워크플로우를 사람이 직접 통제하는 쪽으로 가려고 함:
plan -> 내가 승인 -> 태스크 에이전트로 /implement -> 내가 확인 -> /review
내가 OMP에서 진짜 원하는 건 이거임: "작업은 네가 하되, 실질적인 코딩은 직접 하지 말고 태스크 에이전트한테 위임해라."
OMP 고수들은 이거 어떻게 처리함?
특히 궁금한 거:
-
task.eager: always+modelRoles.task설정만으로 커스텀 오케스트레이션 프롬프트 없이 충분함? -
부모 모델이 정상적으로 조율하게 두면서, 구현 위임을 강제하는 제일 깔끔한 방법이 뭐임?
-
플랜/리뷰 경계를 직접 통제함, 아니면 OMP가 알아서 다 하게 둠?
-
중간 규모 작업에 토큰 2천만~5천만 개, 요청 수백 번 찍히는 거면 내 워크플로우가 확실히 잘못된 거 맞지?
-
할당량 낭비 안 하면서 퀄리티 챙길 수 있는 꿀팁이나 가벼운 명령어 설정 같은 거 있음?
도움 된다면 내 설정이나 명령어 공유할 의향 있음.


