내 솔직한 생각: Fable은 그만큼의 가치가 없음
My hot take: Fable is not worth the press
핵심 요약
Fable 모델이 가격 대비 성능이 부족하며, 기존 Opus 모델의 가치를 떨어뜨리고 있다는 비판적 의견입니다.
- 성능 대비 가격 — Fable은 DeepSeek와 비슷한 성능을 내지만 가격이 훨씬 비쌈
- 모델 품질 저하 — Anthropic이 Fable 판매를 위해 기존 Opus와 Sonnet의 성능을 의도적으로 낮추고 있음
- 사용성 문제 — Fable은 한 번의 프롬프트로 전체 프로젝트를 완성하려는 방식이라 검증이 어려움
- 대안 탐색 — Anthropic의 행보에 대비해 오픈 소스 모델로 눈을 돌리는 사용자가 늘어남
본인 소개: 난 Claude Code 출시 때부터 쭉 써왔고, 그전엔 Cursor 썼음. 회사 환경에서 기존 코드베이스 유지보수하거나, 버그 고치고 기능 추가하는 식으로 굴리는 중임.
레딧에서 하도 말이 많길래 Fable을 두 가지 상황에서 써봤음. A: 기존 코드베이스에 새 기능 추가. B: 아예 새로 시작하는 소규모 프로젝트.
둘 다 끝내고 나니까 Max20 제한에 걸려버림. 평소엔 일주일에 25~35%도 안 썼는데 말이지.
써보고 느낀 점:
- 모델 자체는 좋을지 몰라도, Opus랑 뭐가 다른지 모르겠음. Opus 4.6은 진짜 좋았거든. 근데 4.7, 4.8 나오면서 성능 희석되고 멍청해짐. 지금 Fable 느낌은 Opus가 점진적으로 업데이트됐을 때 나왔어야 할 4.7이나 4.8 버전 딱 그 정도임.
- Fable이랑 경쟁 모델들 비교하려고 간단한 비즈니스 질문 하나 던져봤음. 예를 들면 'Y 서비스에 X만큼 돈 받는 게 괜찮을까?' 같은 거. Opus 4.6, 4.8, Sonnet, Fable, 그리고 DeepSeek Expert(아마 Pro 버전일 듯)에 웹 검색이랑 최대 사고 모드 켜고 돌려봤는데, 솔직히 DeepSeek이 더 맘에 들었음. Fable도 DeepSeek이랑 비슷하긴 한데, 가격 생각하면 굳이 싶음.
내가 보기에 Fable은 프롬프트 한 번 딱 날리고, 새로 시작하는 프로젝트가 한 방에 완성되길 기도하는 사람들을 위한 물건임. 그런 식으로 빌드된 결과물이 제대로 돌아가는지 누가 검증하겠음? Agent랑 Playwright 써서 브라우저 레벨 테스트 환경 구축한다 쳐도, 그 빌드 검증하는 데만 몇 주 걸릴걸.
이게 나쁜 선례가 될까 봐 걱정됨. Anthropic 입장에선 Opus나 Sonnet 성능을 더 떨어뜨려서 사람들이 울며 겨자 먹기로 Fable 크레딧을 결제하게 만들 유인이 생기거든. 성능이 떨어지면 '바이브 코딩'하는 애들은 당장 스스로 코드를 짤 능력이 안 되니까(나도 다시 공부해야겠지만), 결국 돈 더 내고 Fable 쓸 수밖에 없게 될 테니까.
만약 진짜 그렇게 된다면, Anthropic도 오픈소스 모델이 존재한다는 걸 잊지 않았으면 좋겠음. 상황 좆될 때를 대비해서 나도 코딩 작업용 OSS 모델들 찾아보기 시작했음. 어디 한번 보자고...


