GPT-6.1 Sol은 저렴함. 코드를 절대 직접 짜지 못하게 해서 77% 더 싸게 만듦
GPT-6.1 Sol is cheap. We made it 77% cheaper by never letting it write code
핵심 요약
오케스트레이터가 코드를 직접 작성하지 않고 워커에게 위임하게 하여 비용을 77% 절감한 사례 공유.
- 비용 절감 — 오케스트레이터의 코드 작성 제한으로 토큰 비용 77% 감소함.
- 속도 저하 — 워커 위임 방식 도입으로 작업 시간이 7분에서 43분으로 증가함.
- 운영 고민 — 오케스트레이터의 사소한 수정 허용 여부와 범위에 대한 논의가 진행됨.
- 기술 스택 — GPT-6.1 Sol과 Qwen 3.8 27B 조합의 에이전트 워크플로우를 사용함.
이번 주 오케스트레이터로 Sol 쓰는 게 대세인 것 같은데, 오케스트레이터/워커 구성으로 돌리는 형들한테 진짜 궁금한 게 있어서 물어봄. 우리 첫날 돌려본 데이터 기반으로 질문함.
우리는 아예 쓰기 권한을 막아버렸음. 오케스트레이터는 읽고, 계획 짜고, 위임하고, 검토만 함. 파일 수정이나 셸 명령어 날리려고 하면 다 거부함. 파일 건드리는 건 오직 워커들뿐임. 이유는 비용이랑 규율 때문임. 비싼 모델이 토큰 써가면서 코드 짜는 건 낭비고, 지가 직접 고칠 수 있으면 위임을 안 하려고 들거든.
오늘 GPT-6.1 Sol을 오케스트레이터로, Qwen 3.8 27B를 RTX 3090 한 장에 박아서 워커로 돌려봤는데, 작은 3D 게임 3개 돌린 결과는 이거임:
| Game | Sol does it all | Sol orchestrates only | Cut |
|---|---|---|---|
| Pool | $0.39 | $0.05 | 87% |
| Bowling | $0.14 | $0.06 | 57% |
| Foosball | $0.22 | $0.06 | 73% |
| Total | $0.75 | $0.17 | 77% |
"안 돼"라고 막아버린 대가는 시간임. Sol 혼자 돌리면 7분도 안 걸릴 걸 43분이나 걸림. 로컬 그래픽카드 속도가 전체 속도를 결정하니까. 그리고 사소한 거에서 진짜 웃겨짐. 오케스트레이터가 오타 한 글자 발견해도 그걸 다시 워커한테 작업으로 보내야 하거든.
그래서 중간 지점을 찾으려는데 고민됨. 오케스트레이터한테 일정 크기 이하의 작은 수정은 허용할까? 아니면 그렇게 하면 결국 다시 다 지가 하려고 들까?
형들은 Sol을 에이전트 대장으로 앉혔을 때 쓰기 권한 줬음?
(참고: 내가 개발 중인 오픈소스 에이전트에서 나온 내용임. 궁금한 사람 있으면 댓글로 자세히 알려줌.)

