지금의 Fable이 첫 주에 썼던 그 모델이랑 같은 건가요?
Is this Fable the same model we used in the first week?
핵심 요약
최근 Fable 모델의 성능 저하를 체감한 사용자들이 모델 변경이나 정밀도 하향을 의심하며 불만을 토로하고 있습니다.
- 성능 저하 체감 — 초기와 달리 최근 모델은 오류가 잦고 지시 이행 능력이 떨어짐
- 모델 변경 의혹 — 정부와의 마찰 이후 재출시 시점에 성능이 변했다는 의견이 지배적임
- 비용 절감 추측 — 동일 모델이지만 비용 절감을 위해 정밀도를 낮췄을 가능성이 제기됨
- 사용자 워크플로우 붕괴 — 모델 결과물을 수정하기 위해 별도의 도구를 써야 하는 상황에 불만 폭주
안녕하세요, 바보 같은 소리처럼 들릴지 모르겠지만 지난 며칠간 Fable의 품질이 급격히 떨어진 것에 놀랐습니다. 처음에는 계획과 기술 테스트를 가위처럼 정밀하게 감사하고, 여러 번의 검토에서도 발견하지 못한 문제들을 찾아내는 날카롭고 똑똑한 모델이었습니다. 그런데 지금은 Fable이 작성하고 교정하고 승인한 텍스트에서 GLM 5.2는 5개의 문제를, Sol은 7개의 문제를 찾아내는 모델이 되었습니다. 정말로 지난 이틀 동안 하루 종일 이런 일이 벌어졌습니다. 적어도 이상한 일입니다.

