오픈 소스 하네스로 전환하기 위한 도움 요청
Help shifting to an open source harness
핵심 요약
자율 소프트웨어 개발 팀을 운영하며 Claude 사용량 한계에 부딪힌 작성자가 비용 절감을 위한 오픈 소스 하네스 및 모델 스택을 추천받고자 합니다.
- 비용 효율성 — Claude 사용량 제한 문제 해결을 위해 오픈 소스 모델로의 전환을 모색함
- 멀티 에이전트 시스템 — GitHub를 거치지 않는 효율적인 에이전트 간 통신 방식이 필요함
- 기술 스택 추천 — OpenHands, Qwen, DeepSeek 등 모델 애그노스틱한 하네스 도입을 고려함
도움 좀 구함: 토큰 효율성 (아니, 토큰 맥싱 같은 거 말고)
좀 어이없는 상황인데, AI 네이티브 로펌 인프라 구축하려고 자율형 소프트웨어 개발 팀을 만들었거든? 근데 이게 Claude Max 20배 할당량을 3일 만에 다 처먹고 있음.
지난 몇 주 동안 에이전트들을 실제 팀처럼 돌아가게 세팅해 놨어. 아키텍트/PO, 개발자, 디자이너, QA까지 다 배치하고 에이전트끼리 직접 소통도 하게 만들었지. 근데 이러니까 에이전트들이 GitHub에서 계속 문맥을 다시 불러오느라 토큰을 엄청 잡아먹네.
덕분에 퀄리티랑 속도는 확실히 좋아졌는데, 이제 Claude 자체가 병목 현상의 주범이 돼버림.
이번 주에 사용량 초기화됐을 때도 100%로 돌아오질 않더라. 리셋 당일인데 벌써 "이번 주 사용량 52%"라고 뜨는 거 실화냐. 헬프 봇은 "매일 조금씩 풀린다"고 하는데 개뿔, 그런 거 없음.
정확한 메커니즘이 뭔지는 몰라도, 중요한 건 지금 월 200달러짜리 코딩 환경의 한계치에 계속 걸리고 있다는 거야.
이제 아키텍처를 업그레이드할 때가 된 듯.
팀 전체나 일부를 모델에 구애받지 않는(model-agnostic) 하네스로 옮겨볼까 생각 중이야. 시스템이 잘 돌아가게 해주는 에이전트 간 소통 방식은 유지하면서, 굳이 최상급 지능이 필요 없는 작업에는 더 저렴하거나 오픈 웨이트 모델을 쓰는 거지.
특히 OpenHands, Qwen/DeepSeek, OpenRouter/LiteLLM 같은 걸 활용하는 구성에 관심이 많은데, 혹시 내가 아직 모르는 더 좋은 거 있으면 추천 좀.
단일 코딩 에이전트 말고 진짜 자율형 소프트웨어 팀 운영하는 형들 있으면, 실제로 어떤 하네스나 모델 스택 쓰고 있는지 좀 알려줘.
GitHub를 세상에서 제일 비싼 단톡방으로 안 만들면서 멀티 에이전트 소통 문제 해결한 사람 있으면 진짜 인정.


