Fable 5는 6월에 우리가 썼던 그 모델이 아님
Fable 5 is not the same model we got in June
핵심 요약
사용자들은 7월 재출시된 Fable 5의 성능이 6월 초기 버전보다 현저히 떨어졌으며, 과도한 안전성 필터가 코딩 능력을 방해한다고 비판합니다.
- 성능 저하 논란 — 6월 초기 버전 대비 디버깅 및 리팩토링 성능이 크게 하락함
- 안전성 필터 간섭 — 과도한 보안 검열이 정상적인 코드 추론까지 방해함
- 모델 교체 의혹 — 사용자들이 Fable 5가 실제로는 Opus 4.8/4.9로 대체된 것이라 의심함
- 가격 불만 — 성능이 너프된 모델에 동일한 가격을 책정하는 것에 대해 반발함
[블록 1/6] 6월에 Fable 5가 차단되기 전까지 한 72시간 정도 원래 버전을 써볼 수 있었음. 솔직히 내가 써본 코딩 모델 중 최고였음. 2000줄짜리 Rust 파서를 한 번에 리팩토링했고 내가 놓친 엣지 케이스까지 잡아냈거든. 진짜로 이 녀석이 코드베이스를 다 읽은 것처럼 느껴졌음.
[블록 2/6] 이번 7월 버전은? 같은 제품이 아님.
[블록 3/6] BridgeMind가 7월 1일 재출시 버전에서 BridgeBench 벤치마크를 다시 돌려봤음. 디버깅 점수는 86.2에서 25.9로 떨어짐. 리팩토링은 73.6에서 38.4로, 할루시네이션은 75.9에서 61.7로 변함. 아마 일부는 분류기가 Opus 4.8로 돌아가서 그런 걸 수도 있고, 일부는 더 강력한 안전성 프롬프트 때문일 수도 있음. 어쨌든 그 격차는 확실함.
[블록 4/6] 내 경험도 똑같음. 며칠 전에 작은 Go 서비스에서 레이스 컨디션을 고쳐달라고 했더니, 핸들러 전체를 다시 쓰면서 새로운 버그 두 개를 만들어내더라고. 그래서 내가 '확실해?'라고 물어보니까, 다시 가져가더니 '아, 맞네' 이러면서 완전히 다른 걸 제안함. 다섯 번 반복하니까 코드가 원래 내가 짠 고장 난 버전보다 더 엉망이 됐음. 여기 댓글 중에 지금 Fable을 '셜록 홈즈 놀이하는 마약쟁이 꼬맹이'라고 부른 게 있었는데, 진짜 딱 그 말임.
[블록 5/6] 난 안전성을 반대하는 게 아님. LLM이 누구나 요청한다고 해서 익스플로잇 PoC를 작성하는 건 원치 않음. 하지만 Anthropic은 코딩 작업의 대다수가 영향받지 않는다고 공식적으로 밝혔는데, r/ClaudeCode에서 사람들이 겪는 상황은 전혀 그렇지 않음. 내 추측엔 분류기가 단순히 악의적인 요청만 막는 게 아님. 정상적인 코드 추론과 악의적인 요청을 구분하지 못해서 정상적인 작업까지 방해하고 있는 거임.
[블록 6/6] 만약 너프된 Fable을 내놓고 Fable 5-C나 보호된 Fable이라고 부르고 싶다면, 그래도 됨. 그냥 같은 가격을 받으면서 Stripe의 마이그레이션을 수행했던 그 모델인 척하지 마셈. 그 모델은 이제 없음.
