다들 예전보다 토큰을 비슷한 양으로 쓰고 있는 거 확실해?
내가 묻는 이유는 Opus 5나 Fable 5/5.1 같은 새로운 모델들이 나오면서, 이 모델들이 처리할 수 있는 작업의 수준이 Opus 4.8이나 그 이전 모델들보다 훨씬 높아졌기 때문이야. 새로운 기능들이 생기면서 예전엔 사람이 개입해야 했던 어려운 작업들을 이제는 모델이 알아서 처리하게 됐고, 그러다 보니 자연스럽게 모델의 한계치에 가까운 더 복잡한 작업들을 맡기게 되는 거지. Opus 5나 Fable 5/5.1 같은 최상급 모델을 쓰면 당연히 그만큼 토큰을 훨씬 많이 쓰게 돼! Opus 4.8을 쓸 때랑은 사용량 자체가 비교가 안 될 거야.
내 예측인데, 모델의 한계치에 가까운 작업을 안 하고 Opus 4.8이나 Sonnet 4.6 같은 구형 모델을 쓰면 사용량은 예전이랑 똑같을걸? 문제는 너희가 더 어려운 작업이 해결되는 걸 좋아하고, 결과물 퀄리티가 높은 걸 선호하니까 굳이 Opus 4.8이나 Sonnet 4.6으로도 충분히 해결될 작업까지 더 비싼 모델을 써서 그렇다는 거야. Fable 5/5.1이 나오면서 Sonnet 4.6이나 5는 이제 Haiku 4.5 같은 위치가 됐고, Opus 4.8/5는 Sonnet, Fable 5는 Opus, Fable 5.1은 그 위의 새로운 티어가 됐어. 작업 끝낼 때까지 사용량 제한을 다 써버리지 않으려면 모델 선택을 신중하게 해야 해!
노력 수준(effort level)도 마찬가지야. 항상 'max'나 'extra'로만 설정해두고 있는 거 아니야? 가끔은 Opus 5를 'medium'으로만 돌려도 충분히 잘해! 그러면 사용량을 엄청나게 아낄 수 있어.
결론적으로, 사용량이 예전보다 빨리 줄어든다고 불평하는 사람들은 그냥 'skill issue'라고 봐. 모델이나 노력 수준을 잘못 조합해서 쓰고 있거나, 아니면 예전엔 불가능했던 작업을 지금 하고 있으면서, 정작 그 작업을 할 때 토큰이 훨씬 많이 든다는 사실은 인정하고 싶지 않은 거겠지. 사실 모델을 한계까지 밀어붙여서 편하게 작업하고 싶다면 200달러짜리 계정을 두 개는 써야 할 수도 있어. 그게 싫으면 AI 쓰기 전후로 수동 작업을 더 많이 하든가 해야지.
한마디로, 어떤 경우에는 사용량이 늘어나는 게 당연한 거야.