지난 1~2주 동안 Opus랑 Fable이 얼마나 멍청해졌는지 진짜 어이가 없네
That's wild how stupid opus and fable became for the last 1-2 weeks
핵심 요약
최근 Claude 모델들의 성능 저하에 대한 사용자들의 불만과 객관적인 성능 검증 필요성이 제기됨.
- 성능 저하 논란 — 최근 1~2주 사이 Opus와 Fable의 지능과 성실도가 눈에 띄게 떨어짐.
- 검증 체계 필요성 — LLM의 성능 변화를 실시간으로 측정할 수 있는 벤치마크 도입이 요구됨.
- 기업 의존성 우려 — 유료 사용자임에도 불구하고 모델 품질 변동을 감수해야 하는 상황에 대한 불만.
요즘 나랑 똑같은 불만 가진 사람들 보여서 진짜 속이 다 시원하다. 몇 달 동안 실무 프로젝트 돌리면서 내 실력이랑 파이프라인 검증 다 끝냈는데도, 내가 문제인가 싶어서 스스로를 가스라이팅하고 멍청한 짓이라고 자책했거든. 근데 이제 진짜 못 참겠다. 2주 전이랑 비교하면 지능도, 성실함도 딱 절반 수준으로 떡락했어. 도대체 무슨 일이 벌어지는 거냐? 우리 같은 개발자나 빌더들은 이 거대 LLM 기업들의 횡포로부터 어떻게 스스로를 지켜야 하냐? 뭐, 어차피 답 없는 수사 의문문인 거 알지만 말이야. 걔네가 기술 독점하고 있으니까 우리는 돈 내고 쓰면서도 서비스 품질이나 성능이 널뛰기하는 걸 그냥 감수해야 하는 상황이잖아. 진짜 멍청하고 불공평한 처사 아니냐.


