Fable 5.1이 가드레일을 지키지 못함; 앤스로픽 IPO를 앞두고 상황이 악화되는 중
Fable 5.1 couldn’t keep guardrails on Fable 5.1; it’s getting worse before Anthropic’s IPO
핵심 요약
Fable 5.1 모델의 성능 저하와 가드레일 무시 현상에 대한 사용자의 불만과 대안 고민.
- 성능 저하 — Fable 5.1이 가드레일을 무시하고 지시사항을 어기는 등 Opus 5와 유사한 문제 발생함.
- 비용 문제 — 월 20달러 구독료 대비 데이터 오염과 수정 작업으로 인한 시간 낭비가 심각함.
- 대안 탐색 — Claude의 무분별한 토큰 소모와 달리 명확한 질문을 던지는 Codex와 Astra로의 전환 고려함.
- 사용자 경험 — 모델의 제어 불능으로 인해 로컬 AI 구축이나 타 서비스로의 이탈을 고민하는 사용자가 늘어남.
Fable 5.1이 제2의 Opus 5인가?
지난주부터 Fable 5.1 상태가 점점 맛이 가더니, 그 악명 높은 Opus 5처럼 행동하기 시작하더라. 처음 나왔을 땐 작업 결과물도 꽤 괜찮았는데, 갑자기 꼬라박기 시작함. Fable 5.1 나왔을 때 Fable 5도 똑같은 꼴 났었지. 그래서 오늘 Fable 5.1한테 반비정형 데이터 처리 작업을 시켜봤음. 이미 성공적으로 진행 중이던 작업이라 Fable 5.1한테 참고용 데이터(골드 데이터), 이전 작업 내역, 가이드 같은 거 다 쥐여줬단 말이지.
둘 다 중간 정도 난이도로 설정했는데, Fable 5.1은 두 번째 Fable 5.1이 가드레일을 뚫고 나가는 걸 전혀 제어 못 하더라. 들어가지 말라고 한 테이블이랑 폴더를 멋대로 들락날락하고, 정확도나 품질보다는 그냥 속도에만 집착함. 이건 뭐 첫 단계부터 프롬프트랑 가드레일 다 씹어먹는 Opus 5 수준임. Fable 5든 5.1이든 쓰면서 처음으로 다시 안전장치(hooks)를 걸어야 했음.
상황 설명을 좀 하자면, Fable 5.1 쓰기 전에 Fable 5 쓸 때는 claude.md랑 메모리 같은 거 싹 다 지웠었음. 안전장치도 대부분 걷어내고 Fable 5랑 같이 Opus 4.8 써서 서브 에이전트 만들어서 썼거든. 그게 대체로 잘 먹혔음. Opus 4.8이라 좀 느리긴 해도 낮은 수준의 추론 작업은 잘 됐고, 작업 범위 벗어나서 딴짓하는 일도 없었으니까.
매달 20배나 되는 구독료 꼬박꼬박 갖다 바치면서 오염된 데이터 때문에 며칠씩 날리고, 그거 다시 치우느라 고생하는 꼴을 보니, 차라리 이 미친 가격에 GPU 하나 더 사서 내가 처리하는 데이터에 맞춰 파인튜닝한 로컬 AI 돌리는 게 훨씬 나아 보임.
최근에는 Astra랑 같이 Codex를 쓰고 있는데, 이건 그냥 일을 깔끔하게 잘함. Astra는 작업 시작하기 전에 명확하게 질문부터 던지고, 데이터 충돌이나 애매한 부분 있으면 딱 멈춰서 확인받거든. 잘못된 가정 하나 붙잡고 토큰 수만 개씩 낭비하다가, 나중에 지 실수 지적하면 말장난으로 얼버무리는 Claude랑은 차원이 다름. 이제 슬슬 Codex 20배 플랜으로 갈아탈 때가 된 것 같다.
너희는 Claude가 비정형 데이터 다룰 때 딴짓 안 하게 어떻게 묶어두고 있음?

