경고: Fable 5.1 문서를 꼭 읽으세요. Fable 5.1은 정렬이 제대로 안 되어 있어서 토큰을 낭비하게 될 겁니다.
Warning: read the Fable 5.1 docs; Fable 5.1 is misaligned and will burn through tokens otherwise
핵심 요약
Fable 5.1의 비효율적인 파일 전체 재작성 및 토큰 소모 문제에 대한 경고와 사용자들의 반응.
- 토큰 소모 — 파일 전체 재작성으로 인한 비용 증가함
- 프롬프트 최적화 — 비효율 방지를 위한 구체적인 프롬프트 요구됨
- 모델 성능 — 지능은 높지만 동작 방식이 이전보다 퇴보함
- 문서 확인 — 공식 문서의 권장 사항 준수 필요함
Fable 5.1은 프롬프트를 다시 제대로 안 짜면 토큰만 줄줄 새나간다. 예전에는 CLAUDE.md 파일 좀 줄여도 된다고 해놓고, 이제 와서 이러는 거 보면 진짜 기가 찬다.
Anthropic 공식 문서 내용이다:
Claude Fable 5.1은 Claude Fable 5보다 부분 수정보다는 파일 전체를 다시 써버리는 경향이 더 강하다. 결과물은 보통 똑같지만, 파일이 짧거나 대부분을 수정하는 경우가 아니라면 전체를 다시 쓰는 건 출력 토큰이랑 시간만 더 잡아먹는다.
작은 수정만 하고 싶으면 Fable 5.1한테 전체 다시 쓰지 말라고 아주 구체적으로 명령해야 한다.
다만 어떤 경우에는 문장이 Claude Fable 5보다 더 빽빽하다. 문장은 더 길어지고 문단 구분은 줄어든다.
한마디로 더 장황해졌다는 소리다.
이 두 가지 문제 때문에 아무 이유 없이 토큰만 낭비하게 생겼다.
그 외에 또 기가 막힌 내용들:
복잡한 비동기 작업에서는 작업이 끝날 때까지 턴을 종료하지 말라고 계속 찔러줘야 한다. 안 그러면 모델이 작업을 수행하는 대신 다음에 뭘 할지 설명만 늘어놓거나("다음에는 ~를 할 거야"), 이미 요청한 단계인데도 허락을 구하려고 멈춰버린다("이거 적용할까?"). 사용자가 "계속해"나 "진행해"라고 답해야 하는데, 이건 페어 프로그래밍이나 사람이 개입하는 작업에는 맞을지 몰라도 모델의 긴 호흡 능력을 제대로 써먹는 건 아니다.
Claude Fable 5.1은 요청한 걸 그대로 해주기도 하지만 가끔은 오버한다. 주변 코드를 멋대로 고치거나, 작업 내용에 있지도 않은 기능을 확장하거나, 수정 범위보다 더 많은 테스트 파일을 커밋해버리기도 한다.
Claude Fable 5.1은 보통 예상대로 병렬 도구 호출을 수행한다. 여러 개를 가져오라고 요청하면 병렬로 호출한다. 예외는 코딩이나 컴퓨터 사용 루프인데, 다음 독립적인 호출이 명시적 요청이 아니라 작업 흐름상 암시되는 경우(커스텀 코딩 에이전트, bash-and-editor 하네스, 컴퓨터 사용 등)에는 턴당 하나씩만 호출할 수도 있다. 답변 품질에는 영향이 없지만, 턴이 늘어날 때마다 토큰이랑 왕복 시간, 실제 대기 시간만 늘어난다.
노력을 덜 들이는 상황에서 Claude Fable 5.1은 Claude Fable 5보다 검색이나 리트리벌 도구를 덜 호출하고, 그냥 기억에 의존해서 답변할 확률이 높다.
긴 문서 전체를 다시 쓰는 것처럼 긴 결과물을 요청하면, 생각하는 과정에서 초안을 다 짜놓고 답변으로 다시 써 내려가는 경우가 있는데, 이러면 대기 시간도 길어지고 출력 토큰도 더 많이 든다. (이후 토큰 제한을 최대로 늘리라는 지침이 이어짐...)
전체 문서는 여기서 봐라: https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-fable-5-1
Fable 5.1 진짜 엉망이다. 지능은 더 좋아졌을지 몰라도 전반적인 동작 방식은 Fable 5보다 훨씬 구리다.


