나만 그런 건가, 아니면 Claude 문제인가. (5 시리즈 모델들이 가장 충성도 높은 고객층의 기대에 못 미침)
Is it me or is it Claude. (5 series models miss the mark with there most loyal client base)
핵심 요약
Claude 5 시리즈 모델의 성능 저하와 토큰 효율성 문제로 인해 기존 헤비 유저들이 이탈을 고민하고 있습니다.
- 모델 성능 저하 — Opus 5가 이전 버전 대비 복잡한 작업 수행 능력이 떨어짐
- 토큰 효율성 문제 — Fable 모델이 계획 수립에는 좋으나 토큰 소모가 너무 심함
- 사용자 이탈 조짐 — 성능 불만으로 인해 OpenAI로 넘어가거나 자체 호스팅을 고려함
- 모델 일관성 부족 — Anthropic이 모델을 임의로 수정하면서 프로젝트에 악영향을 줌
Claude는 항상 업계에 있는 내 모든 친구들에게 최고의 선택지였어. Opus 4.6~4.8은 훌륭했고 몇 가지 문제가 있긴 했지만 우리는 그 모델들을 사랑했지.
Opus 5는 그냥 의미가 없어. 차라리 Sonnet 5에서 더 나은 응답을 얻을 수 있어. 적어도 Sonnet은 시키는 대로 하고, 안 될 때는 포기해서 토큰을 다 날려버리지 않게 해주거든.
내 문제는 Fable이 계획 수립에는 훌륭하고 작동도 잘하지만, 실제 사용하기에는 너무 토큰을 많이 잡아먹는다는 거야. 계획 하나를 세우거나 문제를 이해하기 위해 백로그를 구성하고 나면, 그 결과물을 실제로 사용하기 위해 다음 세션까지 기다려야 해.
Anthropic은 이제 내 동료들 사이에서 보이콧 대상이 되고 있어. 아니면 이미 우리가 작성해둔 워크플로우 같은 걸 처리하는 보조 모델로만 사용되고 있지. 하지만 이제는 솔직히 우리 클러스터에 GPU 노드를 몇 개 더 추가해서, Claude가 우리 주요 워크로드에 대해 퇴보하는 것 같으니 우리가 직접 튜닝하고 개선할 수 있는 모델을 자체 호스팅할까 생각하는 지점까지 왔어.
