추출 단계를 Claude에서 다른 모델로 옮겼습니다
I moved our extraction step off Claude
핵심 요약
Claude 워크플로우의 추출 단계를 저렴한 모델로 분리한 후 발생하는 라우팅 문제에 대한 고민입니다.
- 워크플로우 최적화 — 단순 추출 작업은 저렴한 모델로, 복잡한 추론은 Claude로 분리함
- 라우팅 고민 — 저렴한 모델의 실패 시 발생하는 추가 비용과 재시도 문제를 해결하려 함
- 데이터 기반 접근 — 실패 사례를 분석하여 패턴을 찾고 라우팅 로직을 결정하려 함
- 검증 우선 전략 — 실패 시 Claude로 넘기는 방식을 유지하며 점진적으로 개선 중
너희들 이해를 돕기 위해 좀 더 상황을 설명하자면, 원래는 Claude 하나가 입력값 읽는 것부터 필드 몇 개 뽑아내고 추론이 필요한 부분까지 전부 다 처리하는 워크플로우를 쓰고 있었거든.
근데 요청들을 따로 떼서 살펴보니까 추출하는 과정은 매번 똑같은 필드에, 구조화된 출력값이라 검증하기도 쉽고 꽤나 단순한 작업이더라고. 그래서 그 단계는 더 싼 모델로 넘기고, 입력값이 지저분하거나 판단이 필요한 부분만 Claude가 맡게 바꿨어.
생각보다 훨씬 잘 돌아가긴 하는데, 이제 새로운 문제가 생겼네. 싼 모델이 제대로 못 할 게 뻔한 입력값들이 있는데, 일단 시도했다가 검증에서 털리고 나서야 Claude한테 다시 보내는 상황이 생기니까 오히려 예전보다 일을 두 번씩 하게 되는 꼴이 된 거야.
문서가 길거나 포맷이 들쭉날쭉한 경우처럼 문제가 생기는 패턴은 대충 파악했는데, 이걸 일일이 하드코딩으로 규칙 박아두기엔 좀 불안정하거든. 혹시 이런 식으로 워크플로우 쪼개서 쓰는 형들, 모델 선택을 아예 처음에 딱 정하고 시작해? 아니면 일단 싼 모델 먼저 돌려보고 실패하면 그때 넘기는 방식으로 해?


