실제 멀티 에이전트 코딩 시스템에서 Fable 5, Opus 5, Opus 4.8을 리더로 테스트해 본 결과 - Fable 5 Low가 최고의 오케스트레이터였습니다
We tested Fable 5, Opus 5, and Opus 4.8 as the lead in a real multi-agent coding system - Fable 5 Low was clearly the best orchestrator for us
핵심 요약
복잡한 코딩 환경에서 Fable 5 Low가 리더로서 가장 자연스럽고 효율적인 오케스트레이션 성능을 보여주었습니다.
- 역할 기반 아키텍처 — Fable 5 Low를 리더로, Sonnet 5를 검토자로, Opus 5를 작성자로 배치하여 효율 극대화함
- Fable 5의 강점 — 에이전트 간 협업을 자연스럽게 유도하고 규칙 준수 및 의존성 관리가 뛰어남
- Opus 5의 한계 — 기술적 능력은 뛰어나지만 독단적인 행동 경향이 있어 지속적인 관리가 필요함
- 비용 및 제한 — Fable은 성능은 우수하나 주간 사용량 제한이 병목 현상을 일으키는 주요 원인임
이건 합성 벤치마크가 아님. 대략 500k~900k 정도의 활성 컨텍스트, 수많은 규칙, 커스텀 SQLite/JSON 메모리 시스템, 훅, 명령어, 그리고 멀티 에이전트 아키텍처가 돌아가는 실제 대규모 코딩 작업 환경에서 진행한 실전 테스트임.
우리 최종 세팅은 꽤 명확해졌음. 메인 모델 하나가 리드/오케스트레이터 역할만 전담함. Sonnet 5는 정보 탐색이랑 독립적인 검토를 위한 읽기 전용 레이어로 씀. Opus 5 Low/Medium/High는 작성자(writer) 역할을 하는데, 한 번에 딱 한 명만 작업 공간을 수정할 수 있게 제한함. 메인 에이전트가 계획 짜고, 업무 쪼개고, 위임하고, 실제로 저장된 diff를 확인한 다음 수정이랑 최종 통합 여부를 결정함.




