이제 Claude의 낮은 노력(effort) 수준을 표준화해야 할까?
Do we need to normalize lower effort levels for Claude now?
핵심 요약
Opus 5의 성능과 비용 효율성을 고려할 때, 높은 노력 수준보다는 낮은 수준을 기본으로 사용하는 것이 합리적이라는 의견입니다.
- Opus 5 효율성 — 낮은 노력 수준으로도 이전 모델을 능가하는 성능을 보여줌
- 비용 절감 효과 — Max 수준 대비 1/3 가격으로 동일한 지능 수준 확보 가능
- 벤치마크 오해 — 최고 사양 기준 비교로 인해 Claude가 지나치게 비싸게 인식됨
- 사용 전략 제안 — 일상적인 작업에는 낮은 노력 수준을 표준으로 삼아야 함
Opus 5 나오고 나서부터는 굳이 High 이상으로 쓸 이유가 뭔지 도통 모르겠음. 거의 모든 상황에서 말이야.
평소엔 낮은 단계 쓰면 너무 멍청해 보여서 잘 안 썼는데, 요즘 모델들 지능 수준 보니까 낮은 단계도 이제는 꽤 괜찮은 선택지 같음.
Opus 5 Medium은 Artificial Analysis에서 56점 나오는데 작업당 $0.72임. Opus 4.8 Max도 똑같이 56점인데 $2.03이나 함. 지능은 똑같은데 가격은 거의 3분의 1 수준임:
최근에야 AA에서 각 노력(effort) 단계별 통계를 보여주기 시작했는데(Opus 5가 메이저 업데이트라 그런 건지, 아니면 이제 노력 단계도 좀 논의해봐야 할 때가 된 건지 모르겠음).
다들 Claude 비용 비싸다, 모델 느리다 불만이 많은데, 솔직히 맞는 말이긴 함! 근데 Opus 5는 특히나 낮은 단계가 표준이 되어가는 느낌임. 더 빠르고 저렴한 데다가, 이전 모델들보다 훨씬 똑똑하기까지 하니까:
온라인에 올라오는 비교나 벤치마크 대부분이 Extra High/Max 성능만 가져다 쓰니까 비용이 엄청나게 비싸 보이는 거임(Sonnet 5도 비슷한 문제 겪는 중 ㅋㅋ). Grok 4.5나 GPT 같은 모델들이랑 그 수치들 비교하면서 Claude만 미친 듯이 비싼 것처럼 보이는 건 좀 웃긴 상황이지.
만약 Anthropic이 그냥 High까지만 지원하고 Extra High/Max를 아예 안 냈으면 비용 관련해서 Claude가 지금보다 훨씬 칭찬받지 않았을까 싶음 ㅋㅋ. 물론 저 단계들이 아예 쓸모없다는 건 아닌데, 굳이 저걸 쓸 일이 거의 없어야 한다고 봄.
내 생각이 틀릴 수도 있겠지만, 이제는 낮은 노력 단계를 기본으로 쓰는 게 Claude 모델들 제대로 써먹는 유일한 방법인 것 같음.


