혹시 Sonnet 5가 장난 같다고 생각하는 사람 또 있음?
Anyone else think Sonnet 5 is a joke?
핵심 요약
Sonnet 5의 과도한 토큰 소모와 비효율적인 비용 구조에 대한 비판과 설정 최적화 논의.
- 토큰 소모 문제 — Sonnet 5가 이전 모델 대비 훨씬 많은 토큰을 소모함.
- 비용 효율성 논란 — 성능 향상은 미미한데 비용만 높아져 비효율적임.
- 설정 최적화 필요 — 기본 설정 대신 'effort' 설정을 낮춰야 쓸만함.
- 기업의 수익 모델 — Anthropic이 토큰 사용량을 늘려 수익을 챙기려는 의도가 보임.
나는 일상적인 엔지니어링 작업에 Sonnet 4.6을 엄청나게 애용하는 사람임. Opus가 한 번에 끝내는 작업이나 비지도 학습 작업에 더 낫다는 건 알지만, 전문 소프트웨어 엔지니어로서 내 워크플로우에는 Sonnet 4.6이 정확도, 속도, 가격 면에서 최고의 조합이라고 생각함.
그래서 Anthropic이 Sonnet 5를 출시했을 때 기대는 됐지만 회의적이었음... 특히 가격 공지에서 7월 말까지 할인한다는 내용을 봤을 땐 더 그랬음. 새 모델에 바로 할인을 한다고? 수상했음.
이유는 바로 드러났음. 모델 자체가 Sonnet 5의 기본 "thinking" 모드가 4.6보다 토큰을 30% 더 쓴다고 말하지만, 내 경험상 비슷한 작업에서 4.6보다 최대 5배나 더 많은 토큰을 태우고 있음! 그리고 출력 품질이나 "지능" 면에서 이득은 거의 제로임.
Anthropic이 사람들이 가격에 민감해진 걸 알고, "업그레이드" 모델을 "할인"해서 내놓으면서 토큰 사용량과 실제 비용이 이전 모델보다 훨씬 늘어난 걸 눈치 못 채게 하려는 게 아닌가 싶음.
일반 사용자는 /model에서 이전 모델로 바꿀 수 있다는 걸 모름. Anthropic은 효율적인 모델을 같은 이름의 훨씬 비효율적인 모델로 바꿔치기해서 돈을 챙기는 거임. 비즈니스 모델이 최악임. 근데 나만 이렇게 느끼는 건지, 회사 동료들은 Opus 4.8이랑 비교하면서 논의하고 있음(난 그것도 너무 비싸고 일상 작업엔 과하다고 생각하는데).


