Claude Code, 모델별 노력 수준(effort level)에 따른 비용 테이블 공개
Claude Code ships a per-model table of what each effort level costs
핵심 요약
Claude Code의 모델별 노력 수준에 따른 토큰 비용 테이블이 공개되었으며, 사용자들은 최근 사용량 제한 변경에 대해 강한 불만을 표출하고 있습니다.
- 비용 테이블 공개 — 모델별 노력 수준에 따른 토큰 사용량 추정치가 확인됨
- 모델별 차이 — Opus 5는 상위 수준에서 비용 증가가 적지만 Sonnet 5는 급격히 증가함
- 사용자 불만 — 최근 사용량 제한 변경으로 인해 실사용이 불가능해졌다는 의견이 지배적임
- 대안 모색 — 많은 사용자가 ChatGPT 등 타 서비스로의 이탈을 고려하고 있음
Claude Code 바이너리 안에 숨겨진 effort_cost_index를 보면, 같은 작업에 대해 모델별로 토큰 사용량을 대략 이렇게 추정해 놨음. high = 1로 정규화된 수치임.
| Model | low | medium | high | xhigh | max | xhigh to max |
|---|---|---|---|---|---|---|
| sonnet-5 | 0.47 | 0.74 | 1 | 2.41 | 5.59 | +132% |
| opus-4-8 | 0.72 | 0.90 | 1 | 1.65 | 1.88 | +14% |
| opus-5 | 0.67 | 0.76 | 1 | 1.60 | 1.70 | +6% |
| fable-5 | 0.60 | 0.77 | 1 | 1.74 | 1.91 | +10% |
(fable-5-1이랑 mythos-5-1은 빌드 두 개 사이에서 튜닝이 좀 바뀌었음: 최신 빌드에선 1.38/1.74임.)
Opus 5는 최상위 구간에서 상승폭이 확 꺾임.
-
high -> xhigh는 +60%인데, -
xhigh -> max는 고작 **+6%**밖에 안 됨.
Sonnet 5는 정반대임. 같은 구간에서 비용이 두 배 넘게 뜀.
그러니까 모델마다 "max"가 의미하는 바가 완전히 다르다는 거임. Opus 5한테 max는 xhigh에서 찔끔 더 얹은 수준인데, Sonnet 5한테는 진짜로 돈 깨지는 구간인 거지.
성공 기준이 아니라 시도당 토큰 수임
UI에 적힌 문구는 토큰 그대로 옮기면 이거임:
{from} effort uses more tokens per task than {to}.
이건 작업 시도당 소모량을 말하는 거임. 작업이 완료된다거나, 제대로 끝난다거나, 단계마다 똑같은 양의 일을 한다는 보장이 없음. 재시도 비용도 안 들어갔고. 시도당 0.76x인 단계라고 해서 재시도까지 필요하면 0.76x만큼 싸지는 게 아니라는 소리임.
직접 측정해 본 결과
Opus 5에서 에이전트 8개 돌려봤음 (실제 작업 2개 x 노력 단계 4개), 저장소랑 베이스 커밋은 똑같고 클론은 격리된 상태로:


