Fable 5 성능은 미쳤는데 사용량 주의하세요, 20x 요금제에서 분당 2%씩 타버리네요
Fable 5 is insanely good but watch your usage, I was burning 2% a minute on 20x
핵심 요약
Fable 5는 뛰어난 성능을 보여주지만, 높은 토큰 소모량과 과도한 보안 필터링으로 인한 Opus 전환 문제가 사용자들 사이에서 논란입니다.
- 압도적 성능 — 이전 모델 대비 확실한 업그레이드 체감함
- 높은 비용 — 토큰 소모가 극심해 기업용 배포 시 비용 부담 큼
- 보안 필터링 — 사소한 질문에도 Opus로 강제 전환되는 문제 발생
- 효율적 라우팅 — 비용 절감을 위해 모델별 적절한 선택이 필수적임
Fable 5가 오늘 아침에 출시된 이후로 계속 써보고 있는데, 모델이 확실히 한 단계 업그레이드된 건 맞습니다. 그런데 세상에, 토큰 소모 속도가 장난 아니네요.
저는 Max 20x 요금제를 쓰고 있는데, 좀 빡세게 돌릴 때는 사용량이 분당 2%씩 올라가는 걸 봤습니다. 시간당이 아니라 분당이요. 에이전트 기반으로 길게 작업하면 점심 먹기 전에 할당량을 다 써버릴 기세입니다. 참고로 Opus 4.8 쓸 때는 같은 작업을 해도 한도에 근접한 적조차 없었습니다.
API 가격을 확인해보니 이해가 가더군요. Fable 5는 입력 토큰 100만 개당 10달러, 출력 토큰 100만 개당 50달러입니다. Opus 4.8(5달러/25달러)의 정확히 두 배죠. 문제는 비용이 단순히 요금표에만 있는 게 아니라는 겁니다. 이런 추론 중심 모델들은 더 길게 생각하고 요청당 훨씬 더 많은 토큰을 생성하기 때문에, 작업당 실제 비용은 몇 배로 불어납니다.
기업용 배포 환경에서 계산해보면 금방 미친 수준이 됩니다. 에이전트 시스템에 던지는 "질문" 하나가 단순한 완료가 아니라, 계획 수립, 수많은 하위 에이전트 호출, 도구 사용 루프, 재시도, 자체 검증 과정을 거치기 때문입니다. 복잡한 요청 하나가 수천만 개의 토큰으로 쉽게 불어날 수 있죠. 출력 토큰 100만 개당 50달러라면, 최종 사용자에게는 질문 하나로 보이는 작업에 기업들은 수천 달러의 청구서를 받게 될 겁니다. 우버가 연간 AI 예산을 4개월 만에 다 써버렸다는 보도가 있었는데, 그건 이 티어 모델이 나오기도 전의 일입니다.
불평하는 건 아닙니다. 성능은 확실하고 어려운 문제들을 해결하는 데는 그만한 가치가 있을 겁니다. 하지만 최신 모델을 정액제 유틸리티처럼 쓰던 시대는 끝났습니다. 비용을 고려한 라우팅(기본은 저렴한 모델, 정말 중요할 때만 Fable 사용)은 이제 선택이 아니라 필수가 되었습니다.
Max 요금제 쓰시는 분들 중에 비슷한 소모 속도 겪고 계신 분 있나요? 하루 종일 Claude Code 돌리는 분들의 사용량이 어떤지 궁금하네요.

