ds4.1, minimax, mimo 같은 저가형 모델들을 오케스트레이션하는 게 그냥 최상급 모델 구독하는 것보다 시간 낭비라는 생각이 들기 시작함. 다들 어떻게 생각함?
I'm beginning to think orchestrating lots of cheapo models like ds4.1 and minimax and mimo is a waste of time compared to just all frontier subs. Thoughts?
핵심 요약
다양한 저가형 모델을 오케스트레이션하는 것보다 최상급 모델을 사용하는 것이 효율적이라는 의견이 지배적입니다.
- 오케스트레이션 효율성 — 다수의 저가형 모델을 병렬로 돌리는 것은 비용 대비 성능이 떨어지거나 관리만 복잡해짐.
- 순차적 워크플로우 — 계획은 최상급 모델이, 실행은 저가형 모델이 담당하는 순차적 방식이 훨씬 효과적임.
- 모델 역할 분담 — 기능 명세는 최상급 모델이, 코드 구현과 테스트는 저가형 모델이 수행하는 단계적 접근이 권장됨.
- 보조 모델 활용 — 서브 에이전트는 코드 리뷰나 단순 테스트 등 독립적인 읽기 전용 작업에 활용하는 것이 가장 좋음.
최근에 중국 쪽 제공업체들 다 써보면서 오케스트레이션이랑 스웜(swarm) 같은 거 엄청 굴려보고 있는데, 그냥 돈 100% 다 때려 박아서 클로드랑 챗GPT 구독하고, 진짜 싼 모델 필요하면 루나(luna)나 돌리는 게 나은 거 아닌가 싶다. ds4.1 같은 거 쓰면서 토큰 낭비하고 비효율적인 거 따지면 결국 가격은 비슷하거나 오히려 더 비싸질 것 같거든.
지금 opus 5.5로 전체 오케스트레이션 돌리고, 지능적인 판단이 필요한 건 전부 sol 6.1 써서 처리 중인데, mimo, deepseek, glm, minimax 같은 애들한테 역할 부여해가면서 별짓을 다 하고 있단 말이지. 근데 이게 진짜 의미가 있는 건지 모르겠다. 이거 진짜 제대로 테스트해 본 사람 있냐? 아니면 그냥 시간 낭비하는 거냐?
내 진짜 궁금한 점은 이거야. 보조금 받는 루나(Luna)를 오케스트레이션이나 툴질로 어떻게든 이겨서, 토큰당 가격 대비 성능을 더 뽑아낼 수 있냐는 거지. 아니면 온갖 꼼수랑 에이전트 관리 기법을 다 동원해도 걔네 보조금 빵빵한 플랜으로 얻는 가성비를 절대 못 따라가는 거냐?

